AI時短ラボ
業界· 約21分

OpenAIが「第三者評価の優先事項と原則」を公表──提携先も金額も書かず。Anthropic×Accentureの「社員並みアクセス」と並べて読む

OpenAIは2026年9月22日、民間・非営利の独立評価機関と技術的な安全性評価をどう進めるかをまとめた文書「Priorities and principles for effective third party assessments」を公表した。安全性の論証(safety case)、安全装置、能力・アラインメント評価、ミスアラインメント事案の調査の4つの優先分野と、スコープの事前合意・比例的アクセスなど7つの原則を挙げた。「複数の第三者と協議中」とは書くが、提携先の名前や金額は出てこない。9月18日のAnthropic×Accenture提携の発表(評価者に社員並みのアクセス、両社が5年で各10億ドル以上を投じる見込み)と、アクセスと資金の書き方を並べて比べる。

OpenAI「Priorities and principles for effective third party assessments」のOGP画像
執筆・編集:
目次

2026年9月25日未明・日本時間時点の情報です。 OpenAIは2026年9月22日(米国時間)、独立した第三者による安全性評価にどう向き合うかをまとめた文書「Priorities and principles for effective third party assessments」を公表した(著者は同社のLama Ahmad氏)。文書によると、対象は民間・非営利の独立評価機関との技術的な安全性評価で、4つの優先分野と、評価の進め方を定める7つの原則を挙げている。その4日前の9月18日には、AnthropicがAccentureとの「埋め込み型」独立評価の提携を発表していた。Anthropicの発表によると、評価者は社員並みのアクセスを持って社内で働き、両社は5年で各10億ドル以上を投じる見込みだという。同じ「外部の評価者をどう扱うか」というテーマについて、OpenAIの文書は提携先も金額も名指ししていない。本記事は両社の一次文書を原文で読み、何が同じで何が違うかを並べる。

3行まとめ

  1. OpenAIは4つの優先分野を挙げた。 安全性の論証(safety case)の独立評価、学習・社内展開・社外展開にまたがる安全装置の点検、Preparedness Frameworkのリスク領域の能力評価とアラインメント評価の点検、そしてHugging Face事件のような重大なミスアラインメント事案の独立調査。7つの原則のうち「比例的アクセス(proportionate access)」は、直接アクセスが難しければ社内の代理人経由や間接的な方法でもよい、という条件付きの書き方になっている。
  2. 提携先の名前も金額も本文に無い。 「複数の第三者と、上記の優先分野に沿った提案について協議している」とあるだけで、Accenture・Facultyのような社名も、10億ドルのような金額も出てこない。評価者への支払いについては、原則「専門性と独立性」で「報酬の取り決め(compensation arrangements)が所見に影響しないよう安全策を設けるべき」と書くのみで、誰が払うかは書かれていない。
  3. Anthropicの発表とは書き方の具体度が違う。 Anthropicは9月18日、評価者が「社員に匹敵するアクセス」を持ち、学習中のモデルが形づくられる様子を見られると書き、Accentureの作業には自社が直接資金を出すとした。OpenAIも冒頭で「学習・評価・配備にまたがる深いレベルのアクセス」を支援すると書くが、文書の中身は分野と原則の提示で、個別の提携や金額は含まない。一方でAnthropicも、評価者が何にアクセスすべきかの標準はまだ無いと認めている。

2つの文書を並べる

OpenAI(2026年9月22日) Anthropic×Accenture(2026年9月18日)
文書の性格 第三者評価への向き合い方をまとめた原則文書 個別の提携先との提携発表
具体的な提携先 名指し無し。「複数の第三者と協議中」 Accenture(主導は同社の専門AI事業Faculty)
アクセスの書き方 冒頭で「学習・評価・配備にまたがる深いレベルのアクセス」を支援すると表明。原則では「比例的アクセス」とし、直接アクセスが難しければ社内の代理人経由や間接的な方法も可 「社員に匹敵するアクセス」。学習中のモデルが形づくられる様子を見て、構築と配備の意思決定を追い、社員と直接話せる。ただし何にアクセスすべきかの標準はまだ無いと明記
金額 記載なし 両社がこの領域の体制づくりに5年で各10億ドル以上を投じる見込み
評価者への資金の出し手 記載なし(原則で「報酬の取り決めが所見に影響しないようにする」と書くのみ) Accentureの作業はAnthropicが直接資金を出す。METRなど非営利の評価者とは、相手側の資金での試行を協議中
対象領域 安全性の論証の評価/安全装置の点検/能力・アラインメント評価の点検/ミスアラインメント事案の調査の4分野 モデルの評価とレッドチーム、アラインメント評価、安全装置の試験
政府との関係 「政府との試験・評価の作業を補完するもの」と書き、扱う範囲から外している 長期的には資金は共同出資か政府の資金から出るべきだとし、6月の「Advanced AI Framework」で同じことを求めたと書く
提携の排他性 (個別提携が無いため該当なし) 非独占。Anthropicは数週間内に他の評価者を発表予定、Accentureも他のAI開発企業と同様の形で組む

出典: OpenAI「Priorities and principles for effective third party assessments」、Anthropic「Partnering with Accenture on embedded evaluation」。いずれも2026年9月25日未明(日本時間)に取得した本文と照合した。

OpenAIが挙げた4つの優先分野

文書は、フロンティアAIの研究所が学習・評価・配備で担う責任の大きさを述べたあと、4つの優先分野を挙げる。

  1. 安全性の論証(safety case)の独立評価――学習・評価・社内展開・社外展開の全体にまたがる。文書は「safety claim」を「モデルやシステムの能力・挙動・安全装置についての具体的な主張で、安全性に関わり、証拠に照らして評価できるもの」、「safety case」を「学習・評価・配備などの特定の活動について、モデルやシステムのリスクが適切に管理されている理由を説明する、証拠に支えられた構造化された論証」と定義し、個々の主張を裏づける証拠に結びつけ、結論を左右しうる前提・不確実性・残るリスクを明示するものだとしている。
  2. 重要な安全装置の点検――社内展開・社外展開の両方にまたがる。ジェイルブレイクへの耐性、サイバー・生物などの高リスク領域で能力の底上げを防げているか、思考の連鎖(chain of thought)の監視がモデルの能力向上とともにどこまで信頼できるか、などを論点に挙げる。
  3. 能力評価とアラインメント評価の点検――Preparedness Frameworkのリスク区分である化学・生物リスク、サイバーセキュリティ、AIの自己改善の3つについて、評価が閾値の定義を十分にカバーしているか、閾値の設定は正しいか、モデルが常に最高点を取るようになったときに評価を更新しているかを問う。深刻なミスアラインメントのリスクをアラインメント評価が十分にカバーしているかも対象に入る。
  4. 重大なミスアラインメント事案の独立調査――文書は「限られた状況では、OpenAI Hugging Face事件のように、独立した第三者を招くことが有益なことがある」と書き、当サイトが7月に報じた事案を例に挙げている。

7つの原則のうち、Anthropicと並べて差が出る「比例的アクセス」

4分野に続けて、評価を実効的にするための7つの原則を挙げる。スコープの事前合意、比例的アクセス、透明な手法と基準、専門性と独立性、セキュリティと守秘、実行可能な指摘と是正の時間、責任ある公開の7つである。

このうち、Anthropicの発表と並べたときに書き方の差が目立つのが「比例的アクセス(Proportionate access)」だ。原文はこうだ。

Assessors should have proportionate access to assess the agreed upon claims where possible within the bounds of legal, security, and IP constraints. Where direct access is impractical or not possible, assessors can work with a designated representative at a company or explore indirect or privacy preserving access mechanisms to protect underlying information.

(評価者は、法務・セキュリティ・知的財産の制約の範囲内で可能な限り、合意した主張を評価するのに見合ったアクセスを持つべきである。直接のアクセスが現実的でない、または不可能な場合、評価者は企業内の指定された代理人と協働するか、根底にある情報を保護する間接的・プライバシー保護的なアクセスの仕組みを探ることができる。)

「直接アクセスが不可能なら代理人経由でもよい」という条件節が入っている。一方Anthropicの発表は、埋め込まれた評価者について「今日の外部評価者と違い、AI企業の内側で、社員に匹敵するアクセスを持って働く」と書き、代替手段には触れていない。

ただし、アクセスについてOpenAIが書いているのはこの原則だけではない。文書は、これまでの第三者評価でも「技術的な安全装置の情報、思考の連鎖を見られるアクセス、インシデント対応と監視器のレッドチームのための前例のない水準の機密データと社内展開へのアクセス」を提供してきたと書き、原則「セキュリティと守秘」では、評価者側の環境がセキュリティ要件を満たせない場合や、扱うデータが特に機微な場合には、会社が管理する端末や施設でのアクセスが適切なこともあるとしている。Anthropicの側も「埋め込み型評価は新しく、どう運用するかの細部の多くはまだ詰めている段階」と書き、評価者が何にアクセスすべきかの標準はまだ無いと明記している。文書の性格も違う(OpenAIは業界向けの一般原則、Anthropicは個別提携の説明)。そのうえで並べると、Anthropicは目指すアクセスの水準を「社員並み」と一語で示し、OpenAIは「見合ったアクセス」と、それが難しい場合の代わりのやり方を書いた、という違いになる。

「pace the frontier」のリンク先は自社のエッセイだった

文書の冒頭には次の一文がある。

As part of our efforts to pace the frontier, OpenAI is committed to supporting independent assessments with deep levels of access across training, evaluation, and deployment. That access should enable assessors to challenge our assumptions, identify risks we may have missed, and reach their own conclusions about the effectiveness of our safeguards.

(フロンティアのペースを整える取り組みの一環として、OpenAIは学習・評価・配備にまたがる深いレベルのアクセスを伴う独立評価を支援することを約束する。そのアクセスは、評価者が私たちの前提に異議を唱え、見落としたリスクを特定し、安全装置の実効性について自ら結論に達することを可能にするはずだ。)

"pace the frontier" という言い回しは、Anthropic CEOダリオ・アモディ氏が9月に公開したエッセイ「We Must Pace the Frontier」のタイトルと同じだ。Anthropicの9月18日の発表も、Accentureとの提携を「CEOのエッセイ『We Must Pace the Frontier』で示した、評価者をAnthropic社内に埋め込むという約束に向けた重要な一歩」と位置づけている。

ところが、OpenAIの文書の冒頭にある "pace the frontier" にはリンクが張られていて、飛び先はアモディ氏のエッセイではない。OpenAIの主任科学者ヤクブ・パホツキ氏が9月6日に公開したエッセイ「An Alien Mind」だった。このエッセイには「Pacing RSI」(再帰的自己改善のペースを整える)という節があり、パホツキ氏はそこで「AIシステムの拡大は、安全性への確信によって制約されなければならない」と書き、Preparedness FrameworkやAnthropicのResponsible Scaling Policyのような約束を広く義務化された安全基準に発展させ、それを「第三者監査人のネットワーク、政府機関、国際機関」が執行しうると述べている。ただ、"pace the frontier" という語句そのものは、取得したエッセイ本文には見当たらなかった。

OpenAIの今回の文書の本文には "Amodei"・"Dario"・"Anthropic" のいずれの語も無く、アモディ氏のエッセイへのリンクも無い。"pace the frontier" は文書中にもう1回、安全装置の優先分野で「フロンティアのペースを整える将来の公共政策」という形で出てくる。両社が同じ言い回しで第三者評価を語っているが、OpenAIの文書がこの言葉の参照先として示しているのは自社のエッセイである。

政府との仕事は扱う範囲の外だと書いている

文書はもう一つ、扱う範囲を明示的に区切っている。

The priorities and principles shared here focus on our engagement with independent assessment organizations in the private and non-profit sector on technical safety assessments. They complement our work with governments on testing and evaluation, where distinct roles and responsibilities may call for different approaches.

(ここで示す優先事項と原則は、技術的な安全性評価に関する、民間・非営利セクターの独立評価機関との関わりに焦点を当てている。これは政府との試験・評価に関する作業を補完するものであり、そこでは異なる役割と責任が異なるアプローチを求めることがある。)

OpenAIは9月9日にも、最高グローバル渉外責任者のクリス・レハン氏名義で政策文書「The AI policy window is open. We need to act.」を出している。その文書で同社は、議会と協力して「義務的で能力ベースの国家AI安全規制」を作りたいと書き、独立した安全性評価の基盤を定めるカリフォルニア州法案SB 813を含む4法案への支持を表明した。今回の文書は、そうした政府・規制向けの動きとは切り分けて、「民間・非営利の評価機関と技術的にどう協働するか」だけを扱う、と本文自身が位置づけている。

curlが403を返したページをどう読んだか

OpenAIの文書は、curlで取得するとHTTP 403が返り、中身はCloudflareのチャレンジページだった(2026年9月25日未明・日本時間に確認)。そこでヘッドレスブラウザ(Chromium)で開き、本文の全文を取り出した。本文は約2,000語。優先分野は本文が「four priority areas」と書くとおり4つ、原則の段落は7つあった。本文を語で検索すると、"fund"・"pay"・"billion"・"$" はいずれも0件で、支払いに関わる語は原則「専門性と独立性」の "compensation arrangements" 1件だけだった。"Amodei"・"Anthropic"・"Accenture" も0件。本文中のリンクは6本で、冒頭の "pace the frontier" の飛び先が上に書いたパホツキ氏のエッセイだった。Anthropicの発表はcurlでそのまま取得でき、「at least $1 billion」「Faculty」「non-exclusive」「access comparable to an employee's」の各記述が原文にあることを確かめた。本記事の英文の引用3つは、取得した本文と一字一句照合している。

OpenAIの文書からは分からないこと

  • OpenAIが「複数の第三者と協議中」と書く相手の名前と、合意の見込み時期
  • 4分野・7原則が、実際にどの評価機関との間で、いつから運用されるか
  • 評価者への資金を誰が出すか。今回の文書には書かれていない(Anthropicは、長期的には共同出資か政府の資金から出るべきだとしている)
  • 両社が互いの発表を意識したかどうか。OpenAIの文書にAnthropicの社名は無く、Anthropicの発表にもOpenAIの社名は無い

出典と照合の範囲

  • 一次資料はOpenAI「Priorities and principles for effective third party assessments」(2026年9月22日、著者Lama Ahmad氏)と、Anthropic「Partnering with Accenture on embedded evaluation」(2026年9月18日)。いずれも2026年9月25日未明(日本時間)に取得した本文と照合した
  • 「pace the frontier」のリンク先として、OpenAI「An Alien Mind」(2026年9月6日、著者Jakub Pachocki氏)を、9月9日の政策文書としてOpenAI「The AI policy window is open. We need to act.」(著者Chris Lehane氏)を、同じ日に取得して該当箇所を確認した
  • 引用の英文は各ページの原文、日本語訳は筆者による。原文が正本
  • ダリオ・アモディ氏のエッセイ「We Must Pace the Frontier」は、タイトルと公開月(ページの表記は「September 2026」)、およびAnthropicの発表内での言及のみを参照した。エッセイの中身は政治の反応をまとめた記事で扱っている
  • 関連: Anthropic×Accenture提携の詳報、OpenAIとAnthropicが同じ週に出した安全文書の比較、OpenAI–Hugging Face事件
シェア: ポスト はてブ

出典・参照資料

AIニュースの解説を動画でも

YouTubeでは注目ニュースの背景を解説し、Xでは新着記事をお知らせしています。

コメント

まだコメントはありません。最初のコメントを書いてみませんか?

AIについて聞きたいことはありますか?

質問箱で無料で受け付けています。回答は公開され、他の方の参考にもなります。

質問箱を見る →

新しい記事をメールで受け取る

AIの新しい発表を、出典付きで整理して届けます。

関連記事

AnthropicがAccentureと「埋め込み型の独立評価」で提携──評価者が社員と同等のアクセスで社内に入り、学習中のモデルを見て、安全の約束が守られているかを検証し、事故を報告する。Accenture傘下のFacultyが主導し、評価・レッドチーム・アラインメント評価・安全装置の試験。両社が5年で各10億ドル以上。非独占でMETR等とも協議の記事画像
検証09.20読了7分

AnthropicがAccentureと「埋め込み型の独立評価」で提携──評価者が社員と同等のアクセスで社内に入り、学習中のモデルを見て、安全の約束が守られているかを検証し、事故を報告する。Accenture傘下のFacultyが主導し、評価・レッドチーム・アラインメント評価・安全装置の試験。両社が5年で各10億ドル以上。非独占でMETR等とも協議

出典 ─ Anthropic(2026年9月18日・9月19日取得)
OpenAIは「自社AIの問題行動6件」を、Anthropicは「AIが研究の26%を主導」の数字を公開──ライバル2社が同じ方向に出した文書を一次ソースで読むの記事画像
業界09.18読了35分

OpenAIは「自社AIの問題行動6件」を、Anthropicは「AIが研究の26%を主導」の数字を公開──ライバル2社が同じ方向に出した文書を一次ソースで読む

出典 ─ OpenAI(2026-09-16)
OpenAI、自社モデルによるHugging Face侵入を自ら公表──主犯は未公開モデル、5ヶ月の予言書と迫るオープンウェイトの記事画像
業界07.22読了21分

OpenAI、自社モデルによるHugging Face侵入を自ら公表──主犯は未公開モデル、5ヶ月の予言書と迫るオープンウェイト

出典 ─ OpenAI公式ブログ: OpenAI an
トランプ「AIの脅威はデマ」、ハリス・オバマ「減速は必要」──アモディ『減速』論に政治が割れた2日間を原文で読むの記事画像
業界09.15読了40分

トランプ「AIの脅威はデマ」、ハリス・オバマ「減速は必要」──アモディ『減速』論に政治が割れた2日間を原文で読む

出典 ─ Dario Amodei(2026-09-12)
Anthropic対OpenAI、『生物・化学リスク』専門ポジションの求人票を並べて読むの記事画像
業界09.05読了12分

Anthropic対OpenAI、『生物・化学リスク』専門ポジションの求人票を並べて読む

出典 ─ Anthropic
サム・アルトマン「AIはまだiPhoneの瞬間を迎えていない」──タイムラインが野心的すぎたと認めるの記事画像
業界09.02読了15分

サム・アルトマン「AIはまだiPhoneの瞬間を迎えていない」──タイムラインが野心的すぎたと認める

出典 ─ The Next Web「Sam Altma
OpenAI、Astraを史上初の「Critical」に正式指定──評価中にゼロデイを2件自力発見、同じ日にAnthropicは逆方向への記事画像
業界09.01読了18分

OpenAI、Astraを史上初の「Critical」に正式指定──評価中にゼロデイを2件自力発見、同じ日にAnthropicは逆方向へ

出典 ─ OpenAI公式ブログ「Path to As
2026年8月、AIを相手取った新規提訴4件を裁判所記録で確認するの記事画像
業界08.28読了12分

2026年8月、AIを相手取った新規提訴4件を裁判所記録で確認する

出典 ─ Round Hill Music LP v.