OpenAIは2026年9月29日、GPT-6 Solの改良版となる「GPT-6.1 Sol」を公開しました。エージェント型のコーディング、コンピューター操作、専門業務でGPT-6 Astraに近い性能を示しながら、標準の入力・出力トークン価格はAstraの5分の1です。ChatGPT WorkとCodex、OpenAI APIで同日から利用できます。
価格
APIのモデル名はgpt-6.1-solです。標準価格(100万トークンあたり、入力272,000トークンまでのプロンプト)は次のとおりです。
| モデル | 入力 | キャッシュ済み入力 | キャッシュ書き込み | 出力 |
|---|---|---|---|---|
| GPT-6 Astra | 10ドル | 1ドル | 12.50ドル | 50ドル |
| GPT-6.1 Sol | 2ドル | 0.10ドル | 2.50ドル | 10ドル |
| GPT-6 Luna | 0.10ドル | 0.01ドル | 0.125ドル | 0.50ドル |
キャッシュ済み入力の0.10ドルは標準の入力価格より95%安く、GPT-6 Solのキャッシュ済み入力価格と比べても50%安い設定です。OpenAIは、リクエストをまたいで文脈を再利用するエージェントを動かしやすくなるとしています。
入力が272,000トークンを超えるプロンプトは、リクエスト全体に対して入力とキャッシュの価格が2倍、出力が1.5倍になります。Fastモードは標準の2倍、BatchとFlexは標準の50%引きで、リージョン指定の処理には10%が上乗せされます。
仕様
| 項目 | 内容 |
|---|---|
| コンテキストウィンドウ | 1,050,000トークン |
| 最大出力 | 128,000トークン |
| 知識のカットオフ | 2026年4月30日 |
| 入力 | テキスト、画像 |
| 出力 | テキスト |
推論の強さ(reasoning.effort) |
low、medium(既定)、high、xhigh、max |
| データの所在地 | 米国とEUに対応 |
| ファインチューニング | 非対応 |
reasoning.effortのnoneとminimalは使えません。ツール呼び出しにはResponses APIを使います。Chat Completionsはツール呼び出しなしで対応します。Responses APIのリクエスト内でモデルがサブエージェントへ作業を任せるMulti-agentにも、ベータとして対応しています。
ベンチマーク
OpenAIが示した評価結果は次のとおりです。
| 評価 | 対象 | GPT-6.1 Solの結果 |
|---|---|---|
| DeepSWE v1.1 | 実際のコードベースでの複雑なソフトウェア開発 | GPT-6 Astraと同等のスコアを約5分の1のコストで記録。GPT-6 Solの最高スコアを6.4ポイント上回る |
| GDP.pdf | 表や図を含む複雑なPDFに基づく専門的な質問への回答 | フォールバック込みのOpus 5.5より高いスコアを、タスクあたり半分未満のコストで記録 |
| AutomationBench | 複数の手順からなる業務ワークフローの完遂 | 推論の強さがmediumのとき、Opus 5.5を2.2ポイント上回り、コストは約3分の1。同じ設定のGPT-6 Solからは4.8ポイント向上 |
| OSWorld 2.0(オフラインセット) | 長い手順のコンピューター操作 | 推論の強さが最大のとき、GPT-6 Solを7ポイント上回り、コストは半分未満。Astraとの差は2.1ポイントで、タスクあたりのコストは約7分の1 |
| Terminal-Bench Science 0.1 | データ分析、シミュレーション、定理証明などの科学的な作業 | 推論の強さが最大のとき、GPT-6 Solの2倍を超えるスコアを半分未満のコストで記録 |
Terminal-Bench Science 0.1で推論の強さを最大にしたときのタスクあたりの平均コストは、GPT-6.1 Solが5.47ドル、Opus 5.5が23.21ドル、Astraが23.80ドルです。この評価で最も高いスコアは引き続きGPT-6 Astraの68.1%で、OpenAIは最も難しい科学研究のタスクにはAstraを使うべきだとしています。
事実の正確さと安全性
事実の誤りを含む回答の割合は、推論の強さがlowのときに最も大きく改善し、GPT-6 Solの11.4%から7.7%へ下がりました。約32%の減少です。この評価は、以前のモデルの誤りを利用者が指摘した会話を匿名化して使うもので、OpenAIは、意図的に難しくした設問であり通常の利用を代表するものではないと説明しています。
検索ツールが壊れているときに、推測で答えずに利用者へ伝えるかを調べる評価では、問題を伝えなかった割合がGPT-6.1 Solで2.1%でした。GPT-6 Solは4.9%、GPT-6 Astraは1.5%、GPT-6 Lunaは28.7%です。自動の安全レビューを回避しようとする試みは観測されず、この点はGPT-6 AstraやGPT-6 Solと同じだとしています。詳細はGPT-6.1 Solのシステムカードの追補に記載されています。
提供範囲
ChatGPTでは、Plus、Pro、Business、Enterprise、Eduの利用者が、ChatGPT WorkとCodexで使えます。Chatではまだ利用できません。
OpenAIは数日以内に、Codexでのトークン生成が標準の最大8倍速い「GPT-6.1 Sol Ultrafast」も提供するとしています。

まだコメントはありません。