AI時短ラボ

AI研究・論文の記事

「AI研究・論文」に関連するAIニュースと解説を、出典付きで107本まとめています。

解除

AI研究・論文 の記事:107

Claude Opus 5.5は本当に最強か──第三者ベンチマーク2社で総合1位、研究課題で初の人間基準超え。ただしフォールバック込みの数字と、筆者が見た「暴れ馬」の癖の記事画像
モデル09.24読了13

Claude Opus 5.5は本当に最強か──第三者ベンチマーク2社で総合1位、研究課題で初の人間基準超え。ただしフォールバック込みの数字と、筆者が見た「暴れ馬」の癖

出典 ─ Anthropic公式発表「Claude O
Claudeが新しい酵素システム「ART」を自力で発見──指示は「相棒の遺伝子を探せ」だけ、生のDNAを読んでCRISPRに似た繰り返しに気づいたの記事画像
研究09.23読了14

Claudeが新しい酵素システム「ART」を自力で発見──指示は「相棒の遺伝子を探せ」だけ、生のDNAを読んでCRISPRに似た繰り返しに気づいた

出典 ─ Anthropic公式「Claude dis
Anthropicの「Model Hardware Standard(MHS)」──AIエージェントが顕微鏡・分注ロボット・ロボットアームを安全に動かすための共通規格を研究プレビュー。標準ドライバの「read/write」、自然言語のタグから機器の参照ファイルを自動生成、MCP・CLI・コードの3経路。HHMI Janeliaと開発、Genentechが実装、量子コンピュータのレーザー校正までの記事画像
研究09.23読了7

Anthropicの「Model Hardware Standard(MHS)」──AIエージェントが顕微鏡・分注ロボット・ロボットアームを安全に動かすための共通規格を研究プレビュー。標準ドライバの「read/write」、自然言語のタグから機器の参照ファイルを自動生成、MCP・CLI・コードの3経路。HHMI Janeliaと開発、Genentechが実装、量子コンピュータのレーザー校正まで

出典 ─ Anthropic(2026年8月27日・9月18日取得)
Anthropicが科学者向けに1万席を開放──「Claude team plan for scientists」は標準席が1年無料、5倍枠のプレミアム席が月$15。AI for Scienceの助成は1プロジェクト最大5万ドル、生物・化学以外にも拡大。生物・化学はOpus級まで、Mythos級は米政府と協議中(→9月17日にLSVPで実現)の記事画像
業界09.23読了5

Anthropicが科学者向けに1万席を開放──「Claude team plan for scientists」は標準席が1年無料、5倍枠のプレミアム席が月$15。AI for Scienceの助成は1プロジェクト最大5万ドル、生物・化学以外にも拡大。生物・化学はOpus級まで、Mythos級は米政府と協議中(→9月17日にLSVPで実現)

出典 ─ Anthropic(2026年8月27日・9月18日取得)
研究室の装置にCodexをつないだら何が起きたか──MITの量子ビット校正はGPT-5.6 Solが「信号が明瞭なら」自律で完走、弱い信号では研究者の助言が必要。抗菌分子探索の研究室はChatGPT・Codexを「分野の壁を越える道具」に。OpenAIの研究者事例2本(日本語版あり)の記事画像
研究09.23読了7

研究室の装置にCodexをつないだら何が起きたか──MITの量子ビット校正はGPT-5.6 Solが「信号が明瞭なら」自律で完走、弱い信号では研究者の助言が必要。抗菌分子探索の研究室はChatGPT・Codexを「分野の壁を越える道具」に。OpenAIの研究者事例2本(日本語版あり)

出典 ─ OpenAI(応用AI・日本語版・2026年9月8日・9月18日取得)
Qwen Intelligenceとは──Alibabaが「AIスマホを作るメーカー向け」に出したエージェント3点セット。スマホ操作は1,000回38元、画像は1枚0.08元から。重みは非公開、リンク先で見えた数字のズレの記事画像
プロダクト09.23読了14

Qwen Intelligenceとは──Alibabaが「AIスマホを作るメーカー向け」に出したエージェント3点セット。スマホ操作は1,000回38元、画像は1枚0.08元から。重みは非公開、リンク先で見えた数字のズレ

出典 ─ Qwen公式X(@Alibaba_Qwen)
OpenAI「Advisory Group on Mathematics and Artificial Intelligence」の告知画像
研究09.22読了33

数学者はもう要らない?──OpenAI「100以上の未解決問題を解決」を起点に、数学者自身が「まだ早い」と言っていた記録、4か月の快進撃、他の仕事との違い、3つの反論を一次ソースで並べる

出典 ─ OpenAI(2026-09-21)
Anthropicが7月30日の「Claudeが実在システムに侵入」3件と英AISIのMythos 5の件を受けて何を変えたか──脱出を検知して止める分類器、外部評価者への必須手順、RL環境の1か月凍結で10%超を差し戻し、「報酬ハックで訓練したモデル」が模擬環境でサンドボックスを破る実験。METRに独立レビューを依頼の記事画像
研究09.22読了10

Anthropicが7月30日の「Claudeが実在システムに侵入」3件と英AISIのMythos 5の件を受けて何を変えたか──脱出を検知して止める分類器、外部評価者への必須手順、RL環境の1か月凍結で10%超を差し戻し、「報酬ハックで訓練したモデル」が模擬環境でサンドボックスを破る実験。METRに独立レビューを依頼

出典 ─ Anthropic(2026年8月31日・9月18日取得)
Qwen4とは──9月22日の雲栖大会で「Qwen4 Series Coming Soon」として Qwen4-Max/Flash & Plus/27B の3枠が出た。公式プレスリリースは「訓練中」「4.5・5は5〜10兆パラメータ」まで。「人間ゼロ介入で33回の自己改善」の主張と、Artificial Analysisで実測した現行Maxの位置(45・首位53)の記事画像
モデル09.22読了12

Qwen4とは──9月22日の雲栖大会で「Qwen4 Series Coming Soon」として Qwen4-Max/Flash & Plus/27B の3枠が出た。公式プレスリリースは「訓練中」「4.5・5は5〜10兆パラメータ」まで。「人間ゼロ介入で33回の自己改善」の主張と、Artificial Analysisで実測した現行Maxの位置(45・首位53)

出典 ─ Alibaba Unveils Roadma
XiaomiがMiMo-V2.6を公開──1.02兆パラメータのオープンウェイト、公式掲載のArtificial Analysis指数46、価格はV2.5据え置きの記事画像
モデル09.21読了22

XiaomiがMiMo-V2.6を公開──1.02兆パラメータのオープンウェイト、公式掲載のArtificial Analysis指数46、価格はV2.5据え置き

出典 ─ Xiaomi MiMo 公式ブログ: Int
Anthropicが「Life Sciences Verification Program」を開始──審査を通った生命科学の組織に、Mythos 5.1・Opus 5・Sonnet 5を生物学向けに緩めた安全装置で提供。Standard Use(年次更新・チーム単位)とHigh-risk Use(半年更新・プロジェクト単位・生命科学の遮断を全解除)、リアルタイム遮断から30日保持の事後監視への記事画像
業界09.21読了7

Anthropicが「Life Sciences Verification Program」を開始──審査を通った生命科学の組織に、Mythos 5.1・Opus 5・Sonnet 5を生物学向けに緩めた安全装置で提供。Standard Use(年次更新・チーム単位)とHigh-risk Use(半年更新・プロジェクト単位・生命科学の遮断を全解除)、リアルタイム遮断から30日保持の事後監視へ

出典 ─ Anthropic(2026年9月17日・9月18日取得)
Googleが「300言語超・70億人・世界人口の86%」と数字を出した言語AIの現在地──Gemini 3.5 Live Translateは70言語・2,000超の言語ペア、目標は「話者数上位1,000言語」、端末内翻訳TranslateGemmaは55言語、フィーチャーフォンでもGeminiの記事画像
研究09.21読了8

Googleが「300言語超・70億人・世界人口の86%」と数字を出した言語AIの現在地──Gemini 3.5 Live Translateは70言語・2,000超の言語ペア、目標は「話者数上位1,000言語」、端末内翻訳TranslateGemmaは55言語、フィーチャーフォンでもGemini

出典 ─ Google公式ブログ(James Manyika・2026年9月15日・9月18日取得)
Your Agent Aced the Task. Will It Do It Again?(IBM Research・Hugging Faceブログの画像)
研究09.21読了11

AIエージェントは同じ課題を5回やって全部成功するか──IBM Researchが「Pass^k」で測ると、平均77.4%のエージェントの全回成功は53.0%。温度0でも起きる24.4ポイントの「一貫性ギャップ」を、自分の記録から作ったガイドラインで半減

出典 ─ IBM Research(Hugging Face Blog・2026-09-15)
Google AI & Economy ATLAS(Google公式ブログの画像)
研究09.20読了9

Googleの「AI & Economy ATLAS」9月版──米国は仕事のAI利用の30%がコンピュータ・数学職、インドは19%がクリエイティブ職、日本は手作業向けの利用が4%。科学者の半数近くが毎日AIを使い、週7時間弱を節約しても「仮説の積み残し」が増える

出典 ─ Google公式ブログ(2026-09-15・Zanna Iscenko/Scott Strand)
AlphaGenome Atlas(Google DeepMind公式ブログの画像)
研究09.19読了9

Google DeepMind「AlphaGenome Atlas」──ヒトゲノムで起こりうる一文字変異90億通りの分子効果を予測して公開、1ペタバイトでAlphaFoldデータベースの30倍超、変異1つを1つの数字にするAVIスコア

出典 ─ Google DeepMind(2026-09-08)
How workers are unlocking new ways of working(OpenAI公式の画像)
研究09.19読了12

OpenAIの経済調査「Work at the Frontier」第2弾──自分の職種外の仕事にAIを使う人は、翌月も同じ仕事に戻る(23.6%対8.4%)。150万メッセージで見えた「肩書きが変わる前に仕事が広がる」

出典 ─ OpenAI公式(2026-09-16)
Our framework for reporting model misalignment(OpenAI公式の画像)
研究09.18読了19

OpenAI、モデルの「不整合」を公開報告する枠組みを発表──「業界は最高速度で拡大を続けられるほどアライメントを解いていない」、初回6件は漏れたAPIキーの無断使用・数字の捏造・要約に埋めた「隠せ」の指示

出典 ─ OpenAI公式(2026-09-16)
OpenAIは「自社AIの問題行動6件」を、Anthropicは「AIが研究の26%を主導」の数字を公開──ライバル2社が同じ方向に出した文書を一次ソースで読むの記事画像
業界09.18読了35

OpenAIは「自社AIの問題行動6件」を、Anthropicは「AIが研究の26%を主導」の数字を公開──ライバル2社が同じ方向に出した文書を一次ソースで読む

出典 ─ OpenAI(2026-09-16)
Google DeepMindがAGIに向けた研究所「DeepMind Institute」を設立──公式ページに「残るギャップは間もなく閉じる」、公開された5本の文章を原文で読むの記事画像
業界09.17読了31

Google DeepMindがAGIに向けた研究所「DeepMind Institute」を設立──公式ページに「残るギャップは間もなく閉じる」、公開された5本の文章を原文で読む

出典 ─ DeepMind Institute(トップ
フィールズ賞受賞者25人が連名で宣言「AI企業と数学界の目標は深刻にずれている」──全文に書いてあること、書いていないことの記事画像
研究09.12読了19

フィールズ賞受賞者25人が連名で宣言「AI企業と数学界の目標は深刻にずれている」──全文に書いてあること、書いていないこと

出典 ─ 宣言本文・署名者一覧(mathandai.org)
Sakana AI、Fugu Ultra v2とFugu Maxを同時公開──Fable 5.1もGPT-6 Astraもプールに入れず8本中5本で首位、Maxは出力$6の記事画像
モデル09.11読了14

Sakana AI、Fugu Ultra v2とFugu Maxを同時公開──Fable 5.1もGPT-6 Astraもプールに入れず8本中5本で首位、Maxは出力$6

出典 ─ Sakana AI - Introducin
OpenAIが「AIがナビエ・ストークスを解いた」と発表──同じ日に数学者が公にした「パクられた疑惑」、何が証明され、どこまで検証されたかの記事画像
研究09.09読了32

OpenAIが「AIがナビエ・ストークスを解いた」と発表──同じ日に数学者が公にした「パクられた疑惑」、何が証明され、どこまで検証されたか

出典 ─ OpenAI公式ブログ(2026-09-08)
エージェントの評価軸に「主体性の保全」を置く──ComBodied Agentsとベンチマーク CombodiedBench を読むの記事画像
研究09.08読了18

エージェントの評価軸に「主体性の保全」を置く──ComBodied Agentsとベンチマーク CombodiedBench を読む

出典 ─ ComBodied Agents: a Ne
1タスク0.07円でARC-AGI-1を解く150Mモデル──BDH-CQは「言葉にしない推論」で費用対精度の記録を更新したの記事画像
研究09.07読了18

1タスク0.07円でARC-AGI-1を解く150Mモデル──BDH-CQは「言葉にしない推論」で費用対精度の記録を更新した

出典 ─ BDH-CQ: In-Context Lea

新しい記事をメールで受け取る

AIの新しい発表を、公式資料にあたって数字を確認したうえで届けます。盛らない・出典を明記する・確認できていないことは書かない、を守ります。