AI時短ラボ
モデル· 約6

Fable 5の生物学セーフガードが更新──フォールバック85%減、Anthropicが分類器の中身を公開した

AnthropicはClaude Fable 5の生物学分野の安全分類器を書き直し、誤検知(無関係な質問までOpus 5に切り替わる「フォールバック」)を製品全体で約85%減らしたと発表した。ウイルス学・毒性学・分子設計など「デュアルユース」領域は今も専門研究には使えないままだと自ら明記している。

Fable 5の生物学セーフガードが更新──フォールバック85%減、Anthropicが分類器の中身を公開した
執筆・編集:
目次

Claude Fable 5は、生物学関連の質問をすると高い確率で「フォールバック」する――つまり、Fable 5本体ではなく一段階能力の低いOpus 5に自動で切り替わる――という挙動で知られていた。Anthropicは2026年8月7日、この挙動の原因になっている安全分類器を書き直し、誤って発動するケースを大幅に減らしたと公式ブログで発表した。うちはFable 5を6月の輸出規制停止騒動から一貫して追ってきたが、「なぜFable 5は生物学の質問に答えないのか」という疑問への一つの答え合わせになる発表だ。

何が変わったか、数字で

Anthropicが発表した内容を、公式ブログの本文と脚注からそのまま拾う。

項目 内容
発表日 2026年8月7日
対象 Claude Fable 5の生物学分野セーフガード(分類器)
生物学関連フォールバックの削減幅 製品全体で約85%(社内テスト)
フォールバック総数の削減幅(脚注) Claude.aiで約67%、Cowork 55%、Claude Code 17%、Claude Platform 7%
それでもブロックされる領域 ウイルス学・毒性学・分子設計を含む「デュアルユース」領域
結論として明記された制約 「専門的な生物学研究・創薬にはまだ使えない」

フォールバックの削減幅が製品ごとに大きく違う点は見落とせない。Claude.ai(一般ユーザー向けチャット)とCoworkでは半分以上減っているのに対し、Claude CodeとClaude Platform(開発者向けAPI)は17%・7%と小幅にとどまっている。これは、コーディングや業務API経由のリクエストは元々「生物学関連の誤検知」自体が少なかった可能性を示す数字で、Anthropicはこの差の理由を本文では説明していない。

なぜ最初から厳しく制限していたのか

Anthropicが本文で明かしている経緯はこうだ。Fable 5はリリース時点で、生物学に関するほぼ全ての質問をブロックする、意図的に広範な分類器を搭載していた。理由は明確で、生物学領域は「デュアルユース」――同じ知識・能力が新薬開発にも生物兵器開発にも使えてしまう――の典型であり、Fable 5は「一部の高度に複雑な生物学タスクで専門家を上回る」水準に達していたため、悪用された場合の被害(Anthropicの言葉では「破局的」)が大きいと判断したという。

ブログはこの判断のトレードオフを率直に書いている。「代替案(セーフガードがもっと進むまでモデルを差し止める)は、モデルの一般提供とその便益を数週間から数ヶ月遅らせていただろう」。つまり、広く浅く止める分類器を先に出し、後から精度を上げる順番を選んだと説明している。

分類器の仕組み自体も具体的に書かれている。安全分類器は「コンスティテューション」と呼ばれるルール集に従って、対象範囲(in scope)と対象外(out of scope)を判別する。今回のアップデートでは、このコンスティテューションを数週間かけて書き直し、内部・外部の専門家からフィードバックを集め、新しい訓練データで分類器を再訓練し、「有害・デュアルユースの研究的な生物学コンテンツには引き続き反応しつつ、良性で有益な利用の幅を広げる」ことを検証したという。

それでも残る制約――「まだ使えない」という自己申告

Anthropicは今回の更新を成果として発表しながら、同じ文中で限界も明記している。ウイルス学・毒性学・分子設計を含むデュアルユース領域については、引き続きOpus 5へのフォールバックが起きる。結論部分では「Fableは引き続き、デュアルユースのリスクの可能性から、デュアルユースの専門的な生物学・創薬クエリをブロックする」と述べ、「信頼されたアクセス経路(trusted access pathways)」を通じてフロンティア生物学能力への安全でスケーラブルな道を作ることに取り組んでいるとしている。つまり、専門的な生物学研究者向けのアクセス拡大は、今回の分類器更新とは別の、別途進行中の取り組みという位置づけだ。

ブログはまた、「誤検知(安全マージン内にある、リスクの非常に低いリクエストが依然として分類器を発動させてしまうケース)は今後も避けられない」とも認めている。今回の更新は「改善」であって「解決」ではない、という書き方だ。

85%減少はAnthropic自己申告、第三者検証はない

  • 「85%減少」「67%/55%/17%/7%」はいずれもAnthropic自身の社内テストによる自己申告の数値で、第三者による独立検証は確認できていない。分類器の具体的な判定ロジックやコンスティテューションの中身は公開されておらず、外部から再現・検証する手段はない。
  • 「フォールバックが減った」ことと「実際に使える生物学タスクの範囲が広がった」ことはブログ上では同じ現象として語られているが、利用者側の体感(実際にどんな質問が通るようになったか)はうちの手元では検証していない。
  • Fable 5の生物学領域の扱いは6月の輸出規制騒動とは別の文脈(安全分類器の精度問題)であり、今回の発表を輸出規制の続報として読むのは誤り。Fable 5シリーズの経緯はClaude Fable 5 完全ガイドFable 5・Mythos 5への輸出規制解除を参照。

この記事は2026年8月27日時点でAnthropic公式ブログを確認して書いたものです。

シェア: ポスト はてブ

出典・参照資料

AIニュースの解説を動画でも

YouTubeでは注目ニュースの背景を解説し、Xでは新着記事をお知らせしています。

コメント

まだコメントはありません。最初のコメントを書いてみませんか?

AIについて聞きたいことはありますか?

質問箱で無料で受け付けています。回答は公開され、他の方の参考にもなります。

質問箱を見る →

新しい記事をメールで受け取る

AIの新しい発表を、出典付きで整理して届けます。

関連記事

Claude Fable 5.1公開──科学研究ベンチが24.7%から52.6%へ、価格据え置きで実質25%安の記事画像
モデル09.01読了26

Claude Fable 5.1公開──科学研究ベンチが24.7%から52.6%へ、価格据え置きで実質25%安

出典 ─ Anthropic公式ブログ
Claude Mythosとは──Fable 5.1と「同じモデルで安全装置が違う」招待制の最上位版。4月のPreviewから5.1までの経緯、誰が使えるか、価格、個人が触れる経路は無いの記事画像
モデル09.20読了14

Claude Mythosとは──Fable 5.1と「同じモデルで安全装置が違う」招待制の最上位版。4月のPreviewから5.1までの経緯、誰が使えるか、価格、個人が触れる経路は無い

出典 ─ Anthropic(2026年4月7日)
Claude Fable 5 完全ガイド ― 何が強く、何がブロックされ、いくらかかるのかの記事画像
モデル06.11読了13

Claude Fable 5 完全ガイド ― 何が強く、何がブロックされ、いくらかかるのか

出典 ─ Anthropic実機検証
AIの「嘘発見器」は訓練しても未知のケースに汎化しなかった──Anthropic Alignment Science Blogの8月分3本を読むの記事画像
研究08.28読了8

AIの「嘘発見器」は訓練しても未知のケースに汎化しなかった──Anthropic Alignment Science Blogの8月分3本を読む

出典 ─ Anthropic Alignment Sc
Anthropicが「AIとウェルビーイング」の評価手法に500万ドルの助成──応募締切は9月21日の記事画像
研究08.31読了10

Anthropicが「AIとウェルビーイング」の評価手法に500万ドルの助成──応募締切は9月21日

出典 ─ Anthropic公式ブログ「Funding
AIが自分自身を作り始めた──Anthropicの「When AI Builds Itself」を、誇張なしで読むの記事画像
研究08.27読了13

AIが自分自身を作り始めた──Anthropicの「When AI Builds Itself」を、誇張なしで読む

出典 ─ Anthropic Institute「Wh
「AIモデルの福祉」を研究する仕事がある──Anthropicが2025年に始め、2026年に「退職面接」を実施した論点の記事画像
研究09.04読了12

「AIモデルの福祉」を研究する仕事がある──Anthropicが2025年に始め、2026年に「退職面接」を実施した論点

出典 ─ Anthropic
Anthropicが自社AIの危険度を3つとも引き上げた──186ページのリスクレポート第2回を読むの記事画像
研究08.15読了13

Anthropicが自社AIの危険度を3つとも引き上げた──186ページのリスクレポート第2回を読む

出典 ─ Anthropic「Risk Report: