AI時短ラボ

ニュース一覧

最新のAIニュースを出典付きでお届けします。

メール秘書AI「Fyxer」は1つのモデルに書かせない──30〜50の小さなモデルに分け、人が直した下書きをDPOで学習、A/Bテストで有意差が出た版だけ出す。下書きの53%がそのまま送信、90日後の継続率90%超、ARRは1年で100万→3,200万ドルの記事画像
業界09.22読了6

メール秘書AI「Fyxer」は1つのモデルに書かせない──30〜50の小さなモデルに分け、人が直した下書きをDPOで学習、A/Bテストで有意差が出た版だけ出す。下書きの53%がそのまま送信、90日後の継続率90%超、ARRは1年で100万→3,200万ドル

出典 ─ OpenAI(Startup・2026年9月14日・9月18日取得)
GPT-6 AstraをPerplexityとCognition(Devin)はどう使っているか──OpenAIの事例2本(日本語版あり)。Perplexityは「本番システムを監視させ、確認の頻度を大きく減らした」、DevinはAstraで自分の成果物をテストして録画とレポートを返すの記事画像
業界09.22読了8

GPT-6 AstraをPerplexityとCognition(Devin)はどう使っているか──OpenAIの事例2本(日本語版あり)。Perplexityは「本番システムを監視させ、確認の頻度を大きく減らした」、DevinはAstraで自分の成果物をテストして録画とレポートを返す

出典 ─ OpenAI(日本語版・2026年9月14日・9月18日取得)
Qwen4とは──9月22日の雲栖大会で「Qwen4 Series Coming Soon」として Qwen4-Max/Flash & Plus/27B の3枠が出た。公式プレスリリースは「訓練中」「4.5・5は5〜10兆パラメータ」まで。「人間ゼロ介入で33回の自己改善」の主張と、Artificial Analysisで実測した現行Maxの位置(45・首位53)の記事画像
モデル09.22読了12

Qwen4とは──9月22日の雲栖大会で「Qwen4 Series Coming Soon」として Qwen4-Max/Flash & Plus/27B の3枠が出た。公式プレスリリースは「訓練中」「4.5・5は5〜10兆パラメータ」まで。「人間ゼロ介入で33回の自己改善」の主張と、Artificial Analysisで実測した現行Maxの位置(45・首位53)

出典 ─ Alibaba Unveils Roadma
Sakana AIの9月10〜17日──Sakana ChatでFugu Maxが全ユーザーに+会話を覚える「メモリー」、Marlinに引用の裏取りができる「Interactive Reading」と編集可能なPowerPoint出力、SCSK・住友商事と包括提携(金融・製造の実案件、脆弱性診断〜修正のサービス、住商の連結900社・顧客10万社)の記事画像
プロダクト09.22読了7

Sakana AIの9月10〜17日──Sakana ChatでFugu Maxが全ユーザーに+会話を覚える「メモリー」、Marlinに引用の裏取りができる「Interactive Reading」と編集可能なPowerPoint出力、SCSK・住友商事と包括提携(金融・製造の実案件、脆弱性診断〜修正のサービス、住商の連結900社・顧客10万社)

出典 ─ Sakana AI(2026年9月17日・9月18日取得)
SpaceXAIがGrok 4.7を公開──価格は4.6と同じ2ドル/6ドルのまま、公式表7項目で対Fable 5.1は3勝4敗・対GPT-5.6 Solは5勝2敗の記事画像
モデル09.21読了19

SpaceXAIがGrok 4.7を公開──価格は4.6と同じ2ドル/6ドルのまま、公式表7項目で対Fable 5.1は3勝4敗・対GPT-5.6 Solは5勝2敗

出典 ─ SpaceXAI 公式発表: Introdu
XiaomiがMiMo-V2.6を公開──1.02兆パラメータのオープンウェイト、公式掲載のArtificial Analysis指数46、価格はV2.5据え置きの記事画像
モデル09.21読了22

XiaomiがMiMo-V2.6を公開──1.02兆パラメータのオープンウェイト、公式掲載のArtificial Analysis指数46、価格はV2.5据え置き

出典 ─ Xiaomi MiMo 公式ブログ: Int
Anthropicが「Life Sciences Verification Program」を開始──審査を通った生命科学の組織に、Mythos 5.1・Opus 5・Sonnet 5を生物学向けに緩めた安全装置で提供。Standard Use(年次更新・チーム単位)とHigh-risk Use(半年更新・プロジェクト単位・生命科学の遮断を全解除)、リアルタイム遮断から30日保持の事後監視への記事画像
業界09.21読了7

Anthropicが「Life Sciences Verification Program」を開始──審査を通った生命科学の組織に、Mythos 5.1・Opus 5・Sonnet 5を生物学向けに緩めた安全装置で提供。Standard Use(年次更新・チーム単位)とHigh-risk Use(半年更新・プロジェクト単位・生命科学の遮断を全解除)、リアルタイム遮断から30日保持の事後監視へ

出典 ─ Anthropic(2026年9月17日・9月18日取得)
Introducing ChatGPT for Financial Services(OpenAI公式の画像)
プロダクト09.21読了8

OpenAI「ChatGPT for Financial Services」──モルガン・スタンレーとエバコアと設計した金融機関向けChatGPT Work、Daloopa・PitchBook・LSEG・Crunchbaseのデータを内蔵、GPT-6 AstraはOfficeQA Proで69.9%(Solは60.2%)

出典 ─ OpenAI公式(2026-09-10)
Now everyone can put data to work(OpenAI公式の画像)
プロダクト09.21読了9

ChatGPT Workに「Data」エージェント──Redshift・BigQuery・Snowflake・Databricksなどに接続して質問だけで分析とダッシュボード、Tableau・Power BIにも書き出し。NTTデータは「非エンジニアが自分でダッシュボードを作れるようになった」

出典 ─ OpenAI公式(2026-09-10)
Googleが「300言語超・70億人・世界人口の86%」と数字を出した言語AIの現在地──Gemini 3.5 Live Translateは70言語・2,000超の言語ペア、目標は「話者数上位1,000言語」、端末内翻訳TranslateGemmaは55言語、フィーチャーフォンでもGeminiの記事画像
研究09.21読了8

Googleが「300言語超・70億人・世界人口の86%」と数字を出した言語AIの現在地──Gemini 3.5 Live Translateは70言語・2,000超の言語ペア、目標は「話者数上位1,000言語」、端末内翻訳TranslateGemmaは55言語、フィーチャーフォンでもGemini

出典 ─ Google公式ブログ(James Manyika・2026年9月15日・9月18日取得)
Your Agent Aced the Task. Will It Do It Again?(IBM Research・Hugging Faceブログの画像)
研究09.21読了11

AIエージェントは同じ課題を5回やって全部成功するか──IBM Researchが「Pass^k」で測ると、平均77.4%のエージェントの全回成功は53.0%。温度0でも起きる24.4ポイントの「一貫性ギャップ」を、自分の記録から作ったガイドラインで半減

出典 ─ IBM Research(Hugging Face Blog・2026-09-15)
Manusが独立運営を再開──2025年12月29日のMeta買収から8か月で分離。「特定の法域の規制対応」で一部ユーザーの買収後データを8月23〜24日に削除、バックアップ→復元(期限なし)、データの保存先は米国とシンガポール、創業チームが引き続き経営の記事画像
業界09.21読了6

Manusが独立運営を再開──2025年12月29日のMeta買収から8か月で分離。「特定の法域の規制対応」で一部ユーザーの買収後データを8月23〜24日に削除、バックアップ→復元(期限なし)、データの保存先は米国とシンガポール、創業チームが引き続き経営

出典 ─ Manus公式ブログ(2026年9月1日・9月18日取得)
Mistral AIの資金調達発表(Mistral AI公式の画像)
業界09.21読了8

Mistral AIが30億ユーロを調達、評価額210億ユーロ超──欧州テック史上最大の株式調達をサムスン電子が主導、「主権を保てるオープンウェイトAI」を旗印に20か国・125社超へ

出典 ─ Mistral AI公式(2026-09-08)
OpenAI、55歳以上のChatGPT利用が米国で1年で6%→約10%に、「怪しいメールやサイトの判定」は週に数千万回──AARP系のOATSと高齢者向け無料ワークショップを米10都市・1,000人にの記事画像
業界09.21読了5

OpenAI、55歳以上のChatGPT利用が米国で1年で6%→約10%に、「怪しいメールやサイトの判定」は週に数千万回──AARP系のOATSと高齢者向け無料ワークショップを米10都市・1,000人に

出典 ─ OpenAI(Global Affairs・2026年9月16日・9月18日取得)
OpenAIが米GSAと27か月の新契約──連邦・州・地方・部族政府にChatGPT Enterpriseのライセンス料$0(通常$15/人/月)と利用料50%オフ、対象は公務員約2,300万人。政府の防御側は「Daybreak Blue」を半額で、Redは通常価格で申請可の記事画像
業界09.21読了6

OpenAIが米GSAと27か月の新契約──連邦・州・地方・部族政府にChatGPT Enterpriseのライセンス料$0(通常$15/人/月)と利用料50%オフ、対象は公務員約2,300万人。政府の防御側は「Daybreak Blue」を半額で、Redは通常価格で申請可

出典 ─ OpenAI(2026年9月10日・9月18日取得)
Alibaba、Qwen-Image-2.1の重みを公開──絵を描く部分は7B、自社ベンチで29モデル中7位(Nano Banana 2.0より上)、透明PNGと参照10枚の編集を1モデルで。ライセンスは研究限定の記事画像
モデル09.20読了20

Alibaba、Qwen-Image-2.1の重みを公開──絵を描く部分は7B、自社ベンチで29モデル中7位(Nano Banana 2.0より上)、透明PNGと参照10枚の編集を1モデルで。ライセンスは研究限定

出典 ─ Qwen公式ブログ「Qwen-Image-2
AnthropicがAccentureと「埋め込み型の独立評価」で提携──評価者が社員と同等のアクセスで社内に入り、学習中のモデルを見て、安全の約束が守られているかを検証し、事故を報告する。Accenture傘下のFacultyが主導し、評価・レッドチーム・アラインメント評価・安全装置の試験。両社が5年で各10億ドル以上。非独占でMETR等とも協議の記事画像
検証09.20読了7

AnthropicがAccentureと「埋め込み型の独立評価」で提携──評価者が社員と同等のアクセスで社内に入り、学習中のモデルを見て、安全の約束が守られているかを検証し、事故を報告する。Accenture傘下のFacultyが主導し、評価・レッドチーム・アラインメント評価・安全装置の試験。両社が5年で各10億ドル以上。非独占でMETR等とも協議

出典 ─ Anthropic(2026年9月18日・9月19日取得)
運用資産約380億ドルのBalyasny、Claude Fable 5を「数千の実在する金融タスク」で評価してから採用──正答89.4%(前の本番モデル86.1%)、一度も解けなかった経済学の問題群を初めて完走し「評価の不具合」を疑って再検証。M&Aアービトラージの初期分析は3〜5日→1日未満、中銀分析は2日→30分。自社基盤BAMAgentで数千のエージェントが24時間稼働の記事画像
検証09.20読了8

運用資産約380億ドルのBalyasny、Claude Fable 5を「数千の実在する金融タスク」で評価してから採用──正答89.4%(前の本番モデル86.1%)、一度も解けなかった経済学の問題群を初めて完走し「評価の不具合」を疑って再検証。M&Aアービトラージの初期分析は3〜5日→1日未満、中銀分析は2日→30分。自社基盤BAMAgentで数千のエージェントが24時間稼働

出典 ─ Claude Blog(2026年9月17日・9月19日取得)
Claude Codeの「プロジェクト」が再設計──目標を渡すと、コーディネーターがスレッド(=クラウドのClaude Codeセッション)に仕事を割り振り、並列でPRを開いて結果を組み立てる。9月17日からPro・Maxの一部でベータ、既存プロジェクトはそのままの記事画像
プロダクト09.20読了7

Claude Codeの「プロジェクト」が再設計──目標を渡すと、コーディネーターがスレッド(=クラウドのClaude Codeセッション)に仕事を割り振り、並列でPRを開いて結果を組み立てる。9月17日からPro・Maxの一部でベータ、既存プロジェクトはそのまま

出典 ─ Anthropic公式ブログ(2026年9月17日・9月18日取得)
Google AI & Economy ATLAS(Google公式ブログの画像)
研究09.20読了9

Googleの「AI & Economy ATLAS」9月版──米国は仕事のAI利用の30%がコンピュータ・数学職、インドは19%がクリエイティブ職、日本は手作業向けの利用が4%。科学者の半数近くが毎日AIを使い、週7時間弱を節約しても「仮説の積み残し」が増える

出典 ─ Google公式ブログ(2026-09-15・Zanna Iscenko/Scott Strand)
5 things to know about teens' views on AI today(Google公式ブログの画像)
研究09.20読了7

米国の13〜17歳の94%が過去1年にAIを使い、74%は週1回以上「勉強の相棒」に──Googleが公開した10代1,000人超の調査、55%は他の情報源で裏を取り、67%はネットの習慣で親を最も信頼

出典 ─ Google公式ブログ(2026-09-16・Jennifer Kotler氏)
Introducing the Agents API(OpenAI公式の画像)
プロダクト09.20読了11

OpenAI「Agents API」パブリックベータ──Codexを動かしているハーネスとサンドボックスをAPI1回で借りる。文脈の自動圧縮・ツール検索・既定6並列のサブエージェント、環境はOpenAIホスト/自社/提携9社から、追加料金はコンテナ代(1GB 20分$0.03)

出典 ─ OpenAI公式(日本語版・2026-09-10)
Introducing GPT-Live-1 in the API(OpenAI公式の画像)
プロダクト09.20読了12

OpenAI、全二重の音声モデル「GPT-Live-1」をAPIで提供──1分$0.05(秒単位課金)の会話層に、推論とツールはGPT-6 Astraなど後ろのモデルへ委任。Full Duplex BenchでGPT-Realtime-2.1より30ポイント上、電話(SIP)対応、声は12種類

出典 ─ OpenAI公式(2026-09-10)
OpenAIが「週に10億人超」の裏側のストレージ基盤Habitatを解説──毎秒7,000万リクエスト・500PB・3年連続で年10倍超の成長。Pythonで粘ってから、エンジニア2人+Codex+GPT-5.5でRustに書き直し、CPU効率6倍・メモリ15倍の記事画像
研究09.20読了10

OpenAIが「週に10億人超」の裏側のストレージ基盤Habitatを解説──毎秒7,000万リクエスト・500PB・3年連続で年10倍超の成長。Pythonで粘ってから、エンジニア2人+Codex+GPT-5.5でRustに書き直し、CPU効率6倍・メモリ15倍

出典 ─ OpenAI Engineering(2026年9月11日・Jon Lee, Chaomin Yu, Ben Ries・9月18日取得)

新しい記事をメールで受け取る

AIの新しい発表を、公式資料にあたって数字を確認したうえで届けます。盛らない・出典を明記する・確認できていないことは書かない、を守ります。