GPT-5.6 Solに「Ultrafast mode」──標準比最大14倍速い新サービス階層
OpenAIが2026年8月13日、GPT-5.6 Sol向けの新しいAPIサービス階層「Ultrafast mode」を発表しました。標準処理に対して最大14倍の速度で、現時点では一部顧客への限定プレビューです。8月5日にはFast modeも272Kトークン超の長文脈に対応済みです。

目次
2026年8月27日時点の情報です。 OpenAIは2026年8月13日、GPT-5.6 Sol向けの新しいAPIサービス階層「Ultrafast mode」を発表しました。OpenAI API変更履歴の該当項目を確認したところ、標準(Standard)処理に対して最大14倍速いとされ、現時点では一部顧客への限定プレビューです。
3行まとめ
- GPT-5.6 Sol向けの新サービス階層「Ultrafast mode」を2026年8月13日に発表。標準処理比で最大14倍速く、一部顧客への限定プレビュー
- 8月5日には、Sol・Terra・Lunaの3モデルで272Kトークンを超える長文脈プロンプトもFast mode(標準比最大2.5倍速)で処理できるようになった
- 自社チップJalapeñoの初の実測値公開(8月26日)で、OpenAIは「これまでFast modeでしか出せなかった効率でultra-fast-modeの推論を回せるようになる」と自社チップとの関連にも言及している
Ultrafast modeの中身
OpenAI API変更履歴(8月13日項、カテゴリ「Announcement」)には次のように記載されています。
Announced Ultrafast mode, a new API service tier for GPT-5.6 Sol that runs up to 14x faster than Standard processing. Available in limited preview to select customers.
(GPT-5.6 Sol向けの新しいAPIサービス階層Ultrafast modeを発表した。標準処理に対して最大14倍速い。一部顧客への限定プレビュー)
申込はopenai.com/form/ultrafast/から可能とされていますが、このページ自体(openai.com本体)は403でアクセスできず、当サイトでは審査基準や一般提供の見通しまでは確認できていません。
Fast modeの長文脈対応(8月5日)
同じ週の8月5日には、既存の「Fast mode」機能がアップデートされています。変更履歴には次の記載があります。
Fast mode now supports long-context requests for GPT-5.6 Sol, GPT-5.6 Terra, and GPT-5.6 Luna. As of today, long-context prompts exceeding 272K tokens can run in Fast mode, delivering speeds up to 2.5× faster than the Standard tier.
(Fast modeがGPT-5.6 Sol・Terra・Lunaの長文脈リクエストに対応した。本日以降、272Kトークンを超える長文脈プロンプトもFast modeで実行でき、標準ティア比で最大2.5倍の速度を実現する)
Fast modeとUltrafast modeは別の仕組みで、Fast modeはすでに広く利用可能な高速ティア、Ultrafast modeは限定プレビュー中のさらに上位のティアという位置づけです。なお、Ultrafast modeの料金は、当サイトが確認した範囲の変更履歴・料金ページには記載がありませんでした。
Fast modeの料金と技術的な制約(公式ドキュメントより)
Fast modeの公式ガイドと料金ページを直接確認すると、Ultrafast modeとは違い、Fast mode自体は料金・制約とも詳細に公開されています。
- 料金: Fast modeは標準処理の2倍の単価。GPT-5.6 Solの場合、短文脈は入力$8/出力$40(1Mトークンあたり)、長文脈は入力$16/出力$60。この価格は少なくとも2026年11月21日までのプロモーション価格とされています
- 前身の名称: Fast modeは2026年7月30日に「Priority processing」から改称されたもので、リクエストには
service_tier: "fast"または旧名の"priority"のどちらでも指定可能(挙動は同じ) - 対応していないもの: ファインチューニング済みモデルと埋め込み(embeddings)はFast mode非対応
- Ramp rate limit(急増制限): 1分あたり100万トークン(TPM)以上のトラフィックを送っている状態で、15分以内にTPMを50%以上増やすと、一部のFast modeリクエストが自動的にStandard相当の速度・料金にダウングレードされる場合があります。この場合、レスポンスの
service_tierは"default"になるとドキュメントに明記されています
GPT-5.6 SolのStandard料金(短文脈: 入力$4/出力$20、長文脈: 入力$8/出力$30)と比較すると、Fast modeの料金がちょうど2倍になっていることを料金ページで確認できました。GPT-5.6 Solの処理階層を整理すると、次のようになります(1Mトークンあたりの料金、短文脈時)。
| 処理階層 | 速度(公式発表値) | 入力料金 | 出力料金 | 備考 |
|---|---|---|---|---|
| Standard | 基準 | $4.00 | $20.00 | 通常のAPIリクエスト |
| Fast mode | 標準比最大2.5倍 | $8.00(2倍) | $40.00(2倍) | 旧称Priority processing。ファインチューニング・埋め込み非対応 |
| Ultrafast mode | 標準比最大14倍 | 非公開 | 非公開 | 一部顧客への限定プレビュー中。料金体系は未公開 |
Priority processing時代(2026年7月30日の改称前)のFAQページ(Web Archive経由で確認)には「Priority processing is currently available to Enterprise customers(Priority processingは現在Enterpriseの顧客に提供されている)」という記載がありました。改称後のFast modeガイド本文には、この「Enterprise限定」という制約が同じ明確さでは書かれておらず、Enterprise向けの支出コミットメントやSLAへの言及にとどまっています。改称にあわせて対象顧客の範囲が変わったのかどうかは、本記事で確認した範囲の公式文書からは断定できませんでした。
自社チップJalapeñoとのつながり
当サイトは2026年8月26日、OpenAIの自社推論チップ「Jalapeño」の初の実測値公開を記事化しています。そのJalapeño関連の公式発表内容(releasebot.ioのミラー経由で確認)には、次のような記述がありました。
ultra-fast-mode の推論を、これまで fast mode でしか出せなかった効率で回せるようになる
Ultrafast modeという新しいサービス階層の背景に、自社チップによる推論効率の向上があることをうかがわせる記述です。ただし、Ultrafast modeが現時点でJalapeñoチップ上で動いているかどうかは、当サイトが確認した一次情報からは明言されていません。
「14倍速い」の測定条件は公式文書以上に分からない
- Ultrafast modeの料金体系、審査基準、一般提供の時期は、当サイトが確認できた一次情報(API変更履歴・料金ページ・Fast modeガイド)のいずれにも記載がなく、本記事では扱っていません。申込フォーム(
openai.com/form/ultrafast/)自体もopenai.com本体が403でアクセスできず、確認できていません。 - 「最大14倍速い」「Fast modeは最大2.5倍速い」という数値の測定条件(どのタスク・どのハードウェア・どの比較基準か)は、公式文書のどこにも詳細が見当たりませんでした。
- Ultrafast modeとJalapeñoチップの直接的な技術的関係は、本記事では複数の発表を並べた上での推測の域を出ません。OpenAIが両者の関係を明示的に説明した一次情報は確認できていません。
- Fast modeの対象顧客が「Enterprise限定」のままなのか、改称にあわせて範囲が広がったのかは、改称前後のドキュメントを比較しても断定できませんでした。
- Fast modeのramp rate limit(急増制限)に実際に引っかかった場合の具体的な挙動(どの程度の期間ダウングレードされるか等)は、ドキュメントの説明以上の実測データを本記事では持っていません。
情報源はOpenAI公式ドキュメント4点
- OpenAI API変更履歴: developers.openai.com/api/docs/changelog.md(2026年8月13日・8月5日項)
- Fast modeガイド: developers.openai.com/api/docs/guides/fast-mode.md
- 料金ページ: developers.openai.com/api/docs/pricing.md
- Priority Processing FAQ(改称前・Web Archive経由で確認): help.openai.com/en/articles/11647665-priority-processing-faq
本記事公開時点の位置づけ(2026年9月4日追記)
本記事が扱っているのは2026年8月13日・8月5日の発表で、対象は当時のフラッグシップだったGPT-5.6 Solです。 その後2026年9月3日にOpenAIはGPT-6 Astraを公開しており(詳報)、 Astra側でもFastモードが提供されています。Ultrafast modeがAstraに適用されるかどうかは、 本記事の情報源(API変更履歴・Fast modeガイド・料金ページ)では確認できていません。
関連記事: OpenAI自社チップJalapeño、初の実測値公開 / Claude・GPT・GeminiのAPI料金早見表 / GPT-6 Astra公開
出典・参照資料
AIニュースの解説を動画でも
YouTubeでは注目ニュースの背景を解説し、Xでは新着記事をお知らせしています。
コメント
まだコメントはありません。最初のコメントを書いてみませんか?
AIについて聞きたいことはありますか?
質問箱で無料で受け付けています。回答は公開され、他の方の参考にもなります。
質問箱を見る →新しい記事をメールで受け取る
AIの新しい発表を、出典付きで整理して届けます。