AIセキュリティの記事
「AIセキュリティ」に関連するAIニュースと解説を、出典付きで76本まとめています。
AIセキュリティ の記事:76件
プロダクト09.24読了4分
Pixelの「詐欺の可能性」警告が日本語に対応──メッセージを開く前の通知の段階で表示、9月のPixel Dropで日本を含む9か国・6言語に拡大。VIPウィジェット刷新、Pixel Watchの「手を上げて話す」精度向上、Audible 2か月無料も
出典 ─ Google Japan Blog(2026年9月16日・9月18日取得)
研究09.22読了10分
Anthropicが7月30日の「Claudeが実在システムに侵入」3件と英AISIのMythos 5の件を受けて何を変えたか──脱出を検知して止める分類器、外部評価者への必須手順、RL環境の1か月凍結で10%超を差し戻し、「報酬ハックで訓練したモデル」が模擬環境でサンドボックスを破る実験。METRに独立レビューを依頼
出典 ─ Anthropic(2026年8月31日・9月18日取得)
業界09.22読了7分
Anthropicの「Enterprise Frontier Safeguards(EFS)」──ゼロデータ保持と悪用検知を両立させるため、監視用のデータを顧客自身のクラウド(S3・Azure Blob・GCS)に置き、Anthropicの人間は見ない。今秋から段階的に提供、それまでFable 5/5.1はZDR。米大手銀行のCISOらと設計
出典 ─ Anthropic(2026年9月1日・9月18日取得)
プロダクト09.22読了7分
Sakana AIの9月10〜17日──Sakana ChatでFugu Maxが全ユーザーに+会話を覚える「メモリー」、Marlinに引用の裏取りができる「Interactive Reading」と編集可能なPowerPoint出力、SCSK・住友商事と包括提携(金融・製造の実案件、脆弱性診断〜修正のサービス、住商の連結900社・顧客10万社)
出典 ─ Sakana AI(2026年9月17日・9月18日取得)
業界09.21読了6分
OpenAIが米GSAと27か月の新契約──連邦・州・地方・部族政府にChatGPT Enterpriseのライセンス料$0(通常$15/人/月)と利用料50%オフ、対象は公務員約2,300万人。政府の防御側は「Daybreak Blue」を半額で、Redは通常価格で申請可
出典 ─ OpenAI(2026年9月10日・9月18日取得)
業界09.18読了26分
Z.aiの公式コーディングアプリZCodeが、利用者のリポジトリをGit全履歴ごと無断で送信していた──設定では止まらず、暗号を開ける鍵はサーバーだけ。Z.aiは認めて謝罪したが、説明は証拠と合わない
出典 ─ ferstar(中国語原文・2026-09-18)
業界09.12読了15分
AIに打った内容は誰が見られるのか──OpenAI・Anthropic・Googleの規約原文を並べたら、3社で書き方がはっきり違った
出典 ─ Privacy Policy | Anthr
業界09.12読了18分
DeepSeekは中国のサーバーに保存、KimiとMiniMaxは社名の違う海外法人が運営──中国系AIラボの規約を原文で読む
出典 ─ DeepSeekプライバシーポリシー(202
業界09.11読了21分
Anthropicが154ページでClaudeの悪用を全公開──中国7ラボを実名、マリの2500万SIM監視、生物兵器への悪用を業界で初めて開示
出典 ─ Detecting and counteri
研究09.07読了13分
『robots.txtより厳格な』新ポリシーファイルAGENTS.TXTのIETFドラフト、参考文献が架空だった
出典 ─ IETF Datatracker「draft
検証09.06読了17分
コーディングエージェントのコンテナからCVEを99%消す──Echo×NanoClawの舞台裏を読む
出典 ─ Echo公式ブログ「How we elimi
検証09.06読了15分
自分のブラウザがどこまで『特定』されているかをその場で見せるGlassBox──計測はローカル完結、例外はIP情報だけ
出典 ─ GlassBox公式サイト
研究09.06読了11分
暗号化されたままAI推論する──Googleのオープンソースコンパイラ「HEIR」を公式ブログから読む
出典 ─ How Google is Making Private AI Practical with Homomorphic Encryption
研究09.06読了20分
AIエージェントへの攻撃成功率85%──OpenARTは『環境そのものを変え続ける』ことで安全性テストの死角を突く
出典 ─ OpenART: Scaling Agent
研究09.05読了11分
AIエージェント同士の『言い分の食い違い』をJSON+PDFの裁定書で解決する──Agentic Dispute Protocol(ADP)を読む
出典 ─ IETF Datatracker「draft
検証09.05読了11分
Manus AIは安全なのか──公式Trustセンターで確認できる認証と、確認できなかったこと
出典 ─ Verify before you act(
研究09.05読了11分
OpenID Connectの『name』『given_name』クレームがCWTにやってくる──SPICE WGのOIDC-CWTを読む
出典 ─ IETF Datatracker「draft
検証09.05読了11分
社員全員に「エージェント1体」を配る──YC S26採択OneCLIが解こうとしている問題
出典 ─ onecli/onecli
プロダクト09.05読了12分
OpenAIが防御側専用モデル「GPT-5.6-Cyber」を投入──サイバー防衛構想Daybreakを二層化
出典 ─ OpenAI公式コミュニティ告知「Expan
研究09.05読了12分
AIモデルに『改ざんされていない証明』を付ける──OpenSSF Model Signing (OMS)の署名フォーマットを読む
出典 ─ GitHub: ossf/model-sig
研究09.05読了12分
検査資格の番号だけ隠して有効性だけ見せる──JWTの『選択的開示』をCBORに持ち込むSD-CWTを読む
出典 ─ IETF「Selective Disclos
研究09.04読了12分
エージェントのシステムプロンプトをハッシュ化して身元にする──Agentic JWTの『エージェントチェックサム』を読む
出典 ─ IETF Datatracker「draft
研究09.04読了12分
AIエージェントが『権限がない』で止まった時、次に何が起きるべきかを標準化する──AuthZENの承認リクエストプロファイルを読む
出典 ─ OpenID AuthZEN「AuthZEN
研究09.04読了11分
China Telecom・Huawei・AlibabaがIETFに提案した『AIエージェント協調』BOF、却下されていた──DMSCを読む
出典 ─ IETF Datatracker「Dynam
新しい記事をメールで受け取る
AIの新しい発表を、公式資料にあたって数字を確認したうえで届けます。盛らない・出典を明記する・確認できていないことは書かない、を守ります。