gemini-robotics-er-1.6-preview、8月31日に終了──ロボット向けVLMのER 2移行で変わること
ロボット向け視覚言語モデル`gemini-robotics-er-1.6-preview`は2026年8月31日に提供終了しました(9月4日追記:ER 2の能力5項目と、公式が挙げる4つの制約=制限なしAPIキーは403、thinking_levelはmedium推奨ほかを追記)。同じ2026年7月30日の告知で後継の`gemini-robotics-er-2-preview`と`gemini-robotics-er-2-streaming-preview`が公開プレビューになっており、確認時点(8月27日)のドキュメントでは移行はmodelパラメータの書き換えだけで済む設計です。入出力の単価はほぼ倍になります。

目次
2026年8月31日、Gemini APIのロボット向け視覚言語モデルgemini-robotics-er-1.6-previewが提供終了します。Google公式のリリースノートに2026年7月30日付で「Deprecation announcement: The gemini-robotics-er-1.6-preview model will be shut down on August 31, 2026.」と明記されています。同じ日の告知で、後継となるgemini-robotics-er-2-previewとgemini-robotics-er-2-streaming-previewが公開プレビューになりました。gemini-robotics-er-1.6-previewをAPIで呼んでいる場合にやることは、公式ドキュメントを見る限り1つです。modelパラメータをどちらかの後継モデル名に書き換えること。エンドポイントや認証方式は変わりません。
- 提供終了は2026年8月31日。対象は
gemini-robotics-er-1.6-previewで、移行先はGoogle公式ドキュメントの案内でgemini-robotics-er-2-preview(標準)またはgemini-robotics-er-2-streaming-preview(リアルタイム配信向け)- 入力トークン上限131,072・出力トークン上限65,536はER 1.6とER 2で同じだが、標準料金は入力$1.00→$2.00、出力$5.00→$10.00(1Mトークンあたり、いずれもテキスト/画像/動画)とほぼ倍になる
- 8月31日という日付そのものは「終了しうる最も早い日」を示す社の一般的な注記があり、当日に何が起きるか(呼び出した場合のエラー内容など)は公式ドキュメントに明記が見当たらなかった
いつ何が起きるか──ロボット向けプレビューモデルは実質1つが対象
Gemini APIのDeprecationsページには、モデルの種別ごとに終了スケジュールの表がまとまっています。その中の「Robotics models」の表は、この記事の確認時点(2026年8月27日)でちょうど2行しかありません。
| モデル | 公開日 | 終了日 | 推奨移行先 |
|---|---|---|---|
gemini-robotics-er-1.6-preview |
2026年4月14日 | 2026年8月31日 | gemini-robotics-er-2-preview |
gemini-robotics-er-1.5-preview |
2025年9月25日 | 2026年4月30日(終了済み) | gemini-robotics-er-1.6-preview |
つまり、今回終了するgemini-robotics-er-1.6-preview自体も、2026年4月30日に終了したgemini-robotics-er-1.5-previewの後継として2026年4月14日に公開されたモデルです。公開から終了までは4ヶ月半ほどでした。一方、2026年7月30日に公開プレビューとなったgemini-robotics-er-2-previewとgemini-robotics-er-2-streaming-previewは、この記事の確認時点でDeprecationsページの表にまだ登場していません(終了日はまだ発表されていません)。
なお、Deprecationsページの冒頭には「表に記載された終了日は、そのモデルが終了しうる最も早い日を示す。実際の終了日はユーザーに十分な猶予をもって個別に伝える」という趣旨の注記があります。8月31日という日付自体は7月30日のリリースノートに明記された具体的な予定日ですが、この一般的な注記がある以上、日付が動く可能性そのものはゼロではありません。
Gemini Robotics ERとは何か
Gemini Robotics ER(Embodied Reasoning、身体化推論)は、ロボットが物理世界を認識し、行動を計画するための視覚言語モデル(VLM)です。Google公式のRobotics overviewページでは「画像・映像・音声から視覚データを解釈し、空間的・時間的な推論を行い、複数ステップのタスクを計画し、ロボットやツールをオーケストレーションする」モデル群と説明されています。
具体的な機能としては次の4つが挙げられています。
- 空間推論:物体を指し示す、映像内でトラッキングする、バウンディングボックスで検出する、軌道を計画する
- エージェント型ビジョン:コード実行を使って画像操作ツールを活用し、他の機能を拡張する
- タスクオーケストレーション:空間推論とロボット固有のAPIを組み合わせて長時間タスクを完遂する
- ストリーミング(ER 2 Streamingエンドポイントのみ):Live APIを使った双方向のリアルタイム処理
Google DeepMindのブログによると、gemini-robotics-er-1.6-previewは2026年4月14日の公開時点で「計器の針や液面計を読み取る」instrument reading機能が新規に追加されたモデルでした。この用途は、パートナーであるBoston Dynamicsとの協業を通じて見つかったとブログに明記されています。
ER 1.6からER 2で何が変わったか
2026年7月30日のリリースノートは、ER 2を「2つの新しいembodied reasoningモデルエンドポイント」として紹介しています。
| 項目 | ER 1.6 Preview | ER 2 Preview | ER 2 Streaming Preview |
|---|---|---|---|
| モデルコード | gemini-robotics-er-1.6-preview |
gemini-robotics-er-2-preview |
gemini-robotics-er-2-streaming-preview |
| 入力トークン上限 | 131,072 | 131,072 | 131,072 |
| 出力トークン上限 | 65,536 | 65,536 | 65,536 |
| Live API(リアルタイム配信) | 非対応 | 非対応 | 対応 |
| Batch API | 対応 | 対応 | 非対応 |
| Structured outputs / Code execution | 対応 | 対応 | 非対応 |
| 公開日 | 2026年4月14日 | 2026年7月30日 | 2026年7月30日 |
| 終了予定日 | 2026年8月31日 | 未発表 | 未発表 |
トークン上限自体は変わりません。変わるのはRobotics overviewページの説明文にある機能面です。gemini-robotics-er-2-previewは「Gemini 3.5 Flashをベースに、空間推論・動画のモーメント検出・進捗分類・複数ロボットのオーケストレーション・複数ステップのツール利用を改善した」モデルと説明されています。DeepMindが公開しているモデルカード(2026年7月30日公開)にも「Gemini Robotics ER 2はGemini 3.5 Flashをベースにしている」と明記されています。gemini-robotics-er-1.6-previewのモデルページには同種の「ベースモデル」表記が見当たらず、この点は非対称です。
gemini-robotics-er-2-streaming-previewは表のとおり対応範囲が絞られており、Live APIでの双方向ストリーミングに特化しています。連続した音声・映像入力を処理する低遅延のロボットエージェントを組む場合はこちらが対象です。
実際に2つの公式ページを突き合わせると数字が食い違っていた
ここは自分で確認していて気づいた点です。gemini-robotics-er-1.6-previewの情報は、Robotics overviewページに集約された表と、モデル単体のページの2箇所に載っています。同じモデルの同じ「Consumption options」欄を見比べると、Robotics overviewページでは「Flex inference: Not supported / Priority inference: Not supported」となっているのに対し、モデル単体のページでは「Flex inference: Supported / Priority inference: Supported」と、正反対の記載になっていました。どちらも2026年8月27日に取得した同じGoogle公式ドメイン内のページで、片方の転記ミスだと思われますが、この記事ではどちらが正しいか判断できていません(Flex/Priority inferenceを使う予定がある場合は、移行前に自分の環境で実際にリクエストして確認するのが確実です)。
移行方法──modelパラメータを書き換える
Robotics overviewページの案内は明快です。「model="gemini-robotics-er-1.6-preview"をmodel="gemini-robotics-er-2-preview"またはmodel="gemini-robotics-er-2-streaming-preview"に置き換えてください」とだけ書かれています。エンドポイントやSDKの初期化方法に変更はありません。
from google import genai
client = genai.Client()
image_response = client.interactions.create(
model="gemini-robotics-er-2-preview", # ← gemini-robotics-er-1.6-preview から書き換える
input=[
{"type": "image", "uri": uploaded_file.uri, "mime_type": uploaded_file.mime_type},
{"type": "text", "text": PROMPT},
],
generation_config={"thinking_level": "high"},
)
リアルタイムのストリーミング処理をすでにgemini-robotics-er-1.6-previewで組んでいる場合は、gemini-robotics-er-2-streaming-previewとLive APIの組み合わせに変わる点に注意が必要です。ER 1.6にはLive APIの対応自体がありませんでした。
料金はどう変わるか
1Mトークンあたりの単価です(USD、Standard/Batchとも公式Pricingページの記載)。
| モデル | 区分 | 入力価格 | 出力価格(thinking込み) |
|---|---|---|---|
gemini-robotics-er-1.6-preview |
Standard | $1.00(テキスト/画像/動画)/$2.00(音声) | $5.00 |
gemini-robotics-er-1.6-preview |
Batch | $0.50(テキスト/画像/動画)/$1.00(音声) | $2.50 |
gemini-robotics-er-2-preview |
Standard | $2.00(テキスト/画像/動画/音声) | $10.00 |
gemini-robotics-er-2-preview |
Batch | $1.00(テキスト/画像/動画/音声) | $5.00 |
gemini-robotics-er-2-streaming-preview |
Standard | $2.00(テキスト/画像/動画/音声) | $10.00 |
ER 1.6では音声入力だけ単価が別($2.00)でしたが、ER 2 Previewは入力データ型が何であっても一律$2.00です。結果として、テキスト・画像・動画入力の単価はER 1.6からER 2 Previewで2倍($1.00→$2.00)、出力も2倍($5.00→$10.00)になります。ER 2 Streamingにはこの記事の確認時点でBatch料金の記載自体がありませんでした(Consumption optionsの表でもBatch API非対応と一致します)。
追記(2026年9月4日)──ER 2の能力一覧と、公式が挙げる4つの制約
8月31日の終了日を過ぎたので、公式の「Robotics overview」ページを取り直して、ER 2側の記述を確認した。
まず、ER 2は2つのエンドポイントに分かれている。標準版のgemini-robotics-er-2-previewは「Gemini 3.5 Flashをベースに、空間推論の改善・動画のモーメント検索・動画の進捗分類・複数ロボットのオーケストレーション・複数ステップのツール利用」を備えるとされ、ストリーミング版はLive API経由の低遅延・双方向の音声/動画入力に最適化されている。
公式ドキュメントは、ERモデルが対応する身体化推論の能力を5項目に整理している。
| 能力 | 内容 | エンドポイント |
|---|---|---|
| 空間推論(Spatial reasoning) | 物体へのポインティング、動画中の追跡、バウンディングボックス検出、軌道計画 | 両方 |
| エージェント的視覚(Agentic vision) | コード実行を使い、画像操作ツールで他の能力を拡張する | 両方 |
| タスクオーケストレーション | 空間推論とロボット独自APIを組み合わせ、長時間タスクを完遂する | 両方 |
| ストリーミング | 低遅延の関数呼び出しを伴う双方向ストリーミング | ER 2 Streaming限定 |
| 動画進捗理解 | 連続動画フィードからのモーメント検索・進捗分類 | ER 2(標準版)限定 |
同じページの「Limitations」欄には、開発時に考慮すべき点として次の5つが挙げられている。
- APIキーの制限が必須:制限をかけていない(unrestricted)APIキーからのリクエストは受け付けず、403 Forbiddenが返る(原文: "The Gemini API does not accept requests from unrestricted API keys and returns a 403 Forbidden error.")
- レイテンシと性能のトレードオフ:複雑なクエリ・高解像度入力・高い
thinking_levelは処理時間を増やす。公式は「レイテンシと性能のバランスにはmediumを使え」としている - ハルシネーション:他の大規模言語モデルと同様、曖昧なプロンプトや分布外の入力では誤った情報を出すことがあると明記されている
- プロンプト品質への依存:出力品質は入力プロンプトの明確さに左右される
- 計算コスト:動画入力や高い
thinking_budgetは、モデル実行にかかる計算資源とコストを増やす
ロボット制御という実世界に作用する用途では、ハルシネーション1回の重みが通常のチャット用途と異なる。公式が「高精度が要るタスクでは複数回問い合わせて結果を平均せよ(この合議アプローチが空間出力のばらつきを減らす)」と書いているのも、そこを意識した書き方だと読める。
なお、上で「確認できなかった」と書いた3点(終了時刻のタイムゾーン、終了後のエラー内容、Context caching priceの2つの数字の意味)は、9月4日に取り直した時点でも公式ページに記載が見当たらなかった。
8月31日以降のことで、この記事では確認できなかったもの
- 正確な終了時刻とタイムゾーン:
gemini-robotics-er-1.5-previewの終了告知(2026年4月14日付)には「will be shut down on April 30, 2026 at 9AM PST」と時刻まで明記されていました。今回のgemini-robotics-er-1.6-previewの告知(2026年7月30日付)には「will be shut down on August 31, 2026」とだけあり、時刻・タイムゾーンの記載がありません。省略の理由は分かりません。 - 終了後に呼び出すとどうなるか:8月31日以降に
gemini-robotics-er-1.6-previewをAPIで呼んだ場合に返るエラーの内容(コード・メッセージ)は、今回参照した公式ページのいずれにも記載が見当たりませんでした。 - ER 2 Previewの「Context caching price」欄:Pricingページの当該セルには「$0.20」と「$1.00 / 1,000,000 tokens per hour」という2つの数字が改行区切りで並んでおり、どちらが何を指すのか(例えばキャッシュのTTLや保存期間による違いなのか)を区別する記載がありませんでした。この記事のキャッシュ料金の比較には使っていません。
関連記事
Gemini API以外も含めた終了スケジュールの読み方は使っていたAIモデルが消える日の記事、Claude・GPT・Geminiの料金体系を横断で比較した記事はAI API料金の読み方の記事、embodied reasoningの前提になる「フィジカルAI」という言葉の位置づけはフィジカルAIとはの記事、Boston Dynamicsを含むロボット各社の動向はAIロボット最新動向の記事にまとめています。8月31日以降に実際に呼び出して確認できたことがあれば、次の記事で追記します。
出典・参照資料
- 一次資料Gemini API release notes / changelog(Google公式) ↗
- 一次資料Gemini API: Deprecations(Google公式) ↗
- 一次資料Gemini Robotics ER overview(Google公式) ↗
- 一次資料gemini-robotics-er-1.6-preview モデルページ(Google公式) ↗
- 一次資料Gemini API: Pricing(Google公式) ↗
- 一次資料Gemini Robotics-ER 1.6: Enhanced Embodied Reasoning(Google DeepMindブログ) ↗
- 一次資料Gemini Robotics ER 2 モデルカード(Google DeepMind) ↗
更新・訂正履歴
- 公式ドキュメントのLimitations欄を4項目として紹介していたが、実際は5項目だった。抜けていたのは計算コスト(動画入力や高いthinking_budgetがモデル実行の計算資源とコストを増やす)の1項目。Wayback Machineで記事執筆時点の版も確認し、後から追加された項目ではなく数え漏れであることを確かめたうえで、項目を追加し件数を5つに直した。
AIニュースの解説を動画でも
YouTubeでは注目ニュースの背景を解説し、Xでは新着記事をお知らせしています。
コメント
まだコメントはありません。最初のコメントを書いてみませんか?
AIについて聞きたいことはありますか?
質問箱で無料で受け付けています。回答は公開され、他の方の参考にもなります。
質問箱を見る →新しい記事をメールで受け取る
AIの新しい発表を、出典付きで整理して届けます。