AI研究・論文の記事
「AI研究・論文」に関連するAIニュースと解説を、出典付きで107本まとめています。
AI研究・論文 の記事:107件
研究09.04読了12分
『記憶』だけを6.9Bパラメータまで太らせたら、モデル本体を大きくするより効率が良かった
出典 ─ Memory Decoder at Scal
研究09.03読了14分
150Mパラメータでタスク1件0.07銭──Pathwayの再帰アーキテクチャBDH-CQが「未学習のARC-AGI-1」を自作して測った理由
出典 ─ pathwaycom/arc-task-ge
検証09.03読了13分
DSPyのReActV2──「1本の巨大な文字列」だったツール履歴を、構造化されたメッセージに分解する
出典 ─ stanfordnlp/dspy 3.3.0
研究09.03読了13分
GPUのメモリを殴る研究が、なぜ賞を総なめにしているのか──GPUHammer→GPUBreach→GPUThorの受賞歴を追う
出典 ─ Gururaj Saileshwar(トロン
研究09.03読了13分
ロボットの『振り返り』は、動作が終わってからでは遅い──Zettaが基礎方策を凍結したまま推論速度11.1倍を出した閉ループ設計
出典 ─ Zetta ζ: An Efficient
研究09.02読了15分
エージェントが失敗するのは「考えられないから」ではなく「何を覚えておくか管理できていないから」──ACMという論文の主張
出典 ─ Agentic Context Management: Solving Agent Memory and Cost by Treating Them as Lifecycle and Architecture Problems(PDF全文)
検証09.02読了14分
プロンプトではなく「プログラムの構造」自体を最適化する──DSPyの実験的機能`dspy.Flex`
出典 ─ stanfordnlp/dspy 3.3.0
モデル09.02読了15分
ベースモデルを凍結し、LoRAをターンごとに切り替える──Macaron-V1が選んだ「継続学習」への回り道
出典 ─ Macaron-V1: Towards Op
研究09.02読了15分
LLMは『次の実験で何が起きるか』を予測できるか──Scale AIの新ベンチマークSciPredictを読む
出典 ─ SciPredict: Can LLMs P
モデル09.01読了26分
Claude Fable 5.1公開──科学研究ベンチが24.7%から52.6%へ、価格据え置きで実質25%安
出典 ─ Anthropic公式ブログ
研究09.01読了15分
AIエージェントの『目次』『身分証』『語彙』を別々に作る──Cisco主導AGNTCYの3プロジェクトを読む
出典 ─ GitHub: agntcy/dir REA
研究09.01読了22分
動画生成AIの『記憶』をKVキャッシュの外に出す──Alaya-EVOKEはH200で1.5秒分の映像を2.11秒で作り続ける
出典 ─ Alaya-EVOKE: From Line
研究09.01読了19分
1体のエージェントの自己改善には天井がある──『共進化』というもう1つの自己進化の軸を整理したサーベイ論文
出典 ─ Co-Evolution in Agenti
研究09.01読了15分
「Gemini Plays Pokemon」が一度も負け戦なくポケモンクリスタルを攻略した後、人間を完全に外した自己改善ハーネス「Continual Harness」の論文を読む
出典 ─ Continual Harness: Onl
研究09.01読了15分
狭い範囲の追加学習が、AIを広く危険にする──『創発的アライメント崩壊』という現象
出典 ─ Emergent Misalignment:
研究09.01読了16分
動画生成AIの採点に「なぜそのスコアか」を残す──HarnessEval-Wはサブエージェントを分業させて評価の根拠を証拠の木にする
出典 ─ HarnessEval-W: Agentif
業界09.01読了16分
OpenAIが『再帰的自己改善』専任の安全研究者を募集している──Preparednessチームの求人票を読む
出典 ─ Researcher, Recursive
研究09.01読了21分
『できること』ではなく『やりたがること』を測る──PropensityBenchが導入した安全性評価の軸
出典 ─ PropensityBench Projec
研究08.31読了10分
Anthropicが「AIとウェルビーイング」の評価手法に500万ドルの助成──応募締切は9月21日
出典 ─ Anthropic公式ブログ「Funding
研究08.30読了15分
NVIDIA GPUのECCを破る「GPUThor」──研究は8月25日に公開済み、攻撃コードは11月15日
出典 ─ GPUThor公式サイト(トロント大学 Li
モデル08.29読了6分
Fable 5の生物学セーフガードが更新──フォールバック85%減、Anthropicが分類器の中身を公開した
出典 ─ Anthropic「Improving Fa
研究08.28読了6分
『成果を出せ』と言われたAIエージェントはどれだけルールを破るか──実測ベンチマーク論文を読む
出典 ─ A Benchmark for Evalua
研究08.28読了8分
AIの「嘘発見器」は訓練しても未知のケースに汎化しなかった──Anthropic Alignment Science Blogの8月分3本を読む
出典 ─ Anthropic Alignment Sc
研究08.27読了13分
AIが自分自身を作り始めた──Anthropicの「When AI Builds Itself」を、誇張なしで読む
出典 ─ Anthropic Institute「Wh
新しい記事をメールで受け取る
AIの新しい発表を、公式資料にあたって数字を確認したうえで届けます。盛らない・出典を明記する・確認できていないことは書かない、を守ります。