AI時短ラボ

AI研究・論文の記事

「AI研究・論文」に関連するAIニュースと解説を、出典付きで107本まとめています。

解除

AI研究・論文 の記事:107

ベンチマークの点数ではなく「最後までやりきる力」──Apodex 1.1が持ち出した新指標『Working Capability』の記事画像
モデル08.27読了7

ベンチマークの点数ではなく「最後までやりきる力」──Apodex 1.1が持ち出した新指標『Working Capability』

出典 ─ Apodex 1.1: Scaling Ag
AIは仕事を奪うのか──雇用データと企業発表で見る2026年の現在地の記事画像
研究08.25読了12

AIは仕事を奪うのか──雇用データと企業発表で見る2026年の現在地

出典 ─ Stanford Digital Economy Lab
Google I/O 2026、「Gemini 3.5 Flash」を発表 ― エージェント・コーディング特化の記事画像
モデル08.25読了11

Google I/O 2026、「Gemini 3.5 Flash」を発表 ― エージェント・コーディング特化

出典 ─ Google Cloud Blog
GPT-4が人間アナリストに勝ったとされる論文は、取り下げられていた — Chicago Boothの財務分析研究を読むの記事画像
研究08.24読了7

GPT-4が人間アナリストに勝ったとされる論文は、取り下げられていた — Chicago Boothの財務分析研究を読む

出典 ─ Kim, Muhn, Nikolaev (arXiv)
OpenAIが「Codex」の実行の仕組みを丸ごと公開──ARC-AGI-3のスコアが2つの設定変更だけで3倍になった話もの記事画像
プロダクト08.20読了9

OpenAIが「Codex」の実行の仕組みを丸ごと公開──ARC-AGI-3のスコアが2つの設定変更だけで3倍になった話も

出典 ─ OpenAI Developers Blog
Claudeがタンパク質を設計、外部2社が製造して確かめた──354個が結合、数か月かかっていた工程が48時間にの記事画像
研究08.19読了10

Claudeがタンパク質を設計、外部2社が製造して確かめた──354個が結合、数か月かかっていた工程が48時間に

出典 ─ Anthropic公式研究ブログ「Claud
Claude未公開モデルが数学の"人類80年の記録"を更新──リーマン予想の関連問題で41.6%→67.2%、論文著者は「CLAUDE」の記事画像
研究08.11読了10

Claude未公開モデルが数学の"人類80年の記録"を更新──リーマン予想の関連問題で41.6%→67.2%、論文著者は「CLAUDE」

出典 ─ Anthropic公式ブログ: Learni
AIの中に83億人分の「模擬人類」が作られた──MatrAIxの正体と、演じるAIで結果が逆転する問題の記事画像
研究08.10読了19

AIの中に83億人分の「模擬人類」が作られた──MatrAIxの正体と、演じるAIで結果が逆転する問題

出典 ─ MatrAIx: Simulating th
OpenAIの未公開AI「Astra」が未解決問題10問を解いた──機械検証付きの証明を読むの記事画像
研究08.07読了14

OpenAIの未公開AI「Astra」が未解決問題10問を解いた──機械検証付きの証明を読む

出典 ─ openai/ten-proofs: Lea
DeepMind創業者ハサビス、日常運営から退任──理由は「AGIに専念」の記事画像
業界08.06読了7

DeepMind創業者ハサビス、日常運営から退任──理由は「AGIに専念」

出典 ─ Google公式ブログ「The next c
Jeff DeanがGoogleを退社、4人で新会社「Discovery Loop」を設立──史上2人しかいない「レベル11」がそろって独立、Googleも出資の記事画像
業界08.06読了12

Jeff DeanがGoogleを退社、4人で新会社「Discovery Loop」を設立──史上2人しかいない「レベル11」がそろって独立、Googleも出資

出典 ─ Google公式ブログ: The next
AI業界の重鎮15人が「大麻栽培の論文」を共著していた──Google Scholarを汚す偽論文を解剖するの記事画像
研究08.04読了15

AI業界の重鎮15人が「大麻栽培の論文」を共著していた──Google Scholarを汚す偽論文を解剖する

出典 ─ AI models collapse when trained on recursively generated data (Shumailov et al.)
MiniMax M3──428Bパラメータ・100万トークン文脈のオープンウェイト中国モデルの記事画像
モデル07.26読了7

MiniMax M3──428Bパラメータ・100万トークン文脈のオープンウェイト中国モデル

出典 ─ MiniMax Blog
数百万件の実ログが示す、海外のAI活用のリアル──OpenAIとAnthropicの一次データを読み比べるの記事画像
研究07.26読了7

数百万件の実ログが示す、海外のAI活用のリアル──OpenAIとAnthropicの一次データを読み比べる

出典 ─ NBER Working Paper 34255(OpenAI研究者ら)
Microsoftが「AIの作り方」を全公開──蒸留なしでAIME 97%のMAI-Thinking-1の記事画像
研究07.25読了25

Microsoftが「AIの作り方」を全公開──蒸留なしでAIME 97%のMAI-Thinking-1

出典 ─ MAI-Thinking-1: Buildi
AIは正しい答えを出した後、反論されると撤回する ──「59%」は出所未確認、実測は14.66% — 追従性の問題の記事画像
研究07.20読了13

AIは正しい答えを出した後、反論されると撤回する ──「59%」は出所未確認、実測は14.66% — 追従性の問題

出典 ─ AI Sycophancy in Education(原文未確認)
OpenAI「GPT-Red」発表──AIが自分自身を攻撃して安全になる時代の記事画像
研究07.16読了7

OpenAI「GPT-Red」発表──AIが自分自身を攻撃して安全になる時代

出典 ─ OpenAI
生成AIの雇用予測、2026年8月時点でどうなったか──Stanfordの数字が自らの前年推計を更新していたの記事画像
研究07.10読了12

生成AIの雇用予測、2026年8月時点でどうなったか──Stanfordの数字が自らの前年推計を更新していた

出典 ─ Brynjolfsson, Chandar,
AIコーディングベンチマークの3割は壊れていた──OpenAIが自ら暴いたSWE-Bench Proの監査結果の記事画像
研究07.08読了12

AIコーディングベンチマークの3割は壊れていた──OpenAIが自ら暴いたSWE-Bench Proの監査結果

出典 ─ OpenAI「Separating sign
AIに「ありがとう」は電気の無駄?──アルトマンは「やめて」と言っていない、実額はオーブン約1秒分の記事画像
研究07.03読了9

AIに「ありがとう」は電気の無駄?──アルトマンは「やめて」と言っていない、実額はオーブン約1秒分

出典 ─ arXiv:2402.14531
Anthropic「Claude Science」を発表──科学研究専用のAIワークベンチ、ベータ版を公開の記事画像
プロダクト07.01読了8

Anthropic「Claude Science」を発表──科学研究専用のAIワークベンチ、ベータ版を公開

出典 ─ Anthropic公式「Claude Sci
スタートアップSubquadratic、Transformerの二次スケーリング問題を『突破した』と主張——$29Mシード調達の記事画像
研究06.29読了9

スタートアップSubquadratic、Transformerの二次スケーリング問題を『突破した』と主張——$29Mシード調達

出典 ─ MIT Technology Review
Alphabet株が約5%急落――AI投資拡大と主要研究者の流出が重なり、投資家の懸念が表面化の記事画像
業界06.26読了13

Alphabet株が約5%急落――AI投資拡大と主要研究者の流出が重なり、投資家の懸念が表面化

出典 ─ CNBC
Google、Gemini 2.5 ProにDeep Think推論モードを追加──公式が主張するのはLiveCodeBenchとHLEでの最高性能、MMLU-Pro 89.8%はリンク切れ出典の未確認値の記事画像
モデル06.26読了14

Google、Gemini 2.5 ProにDeep Think推論モードを追加──公式が主張するのはLiveCodeBenchとHLEでの最高性能、MMLU-Pro 89.8%はリンク切れ出典の未確認値

出典 ─ Google Blog

新しい記事をメールで受け取る

AIの新しい発表を、公式資料にあたって数字を確認したうえで届けます。盛らない・出典を明記する・確認できていないことは書かない、を守ります。