OpenAI、GPT-6.1 Solを公開 価格はAstraの5分の1、DeepSWEで同等の性能

OpenAIは2026年9月29日、GPT-6 Solの改良版となる「GPT-6.1 Sol」を公開しました。エージェント型のコーディング、コンピューター操作、専門業務でGPT-6 Astraに近い性能を示しながら、標準の入力・出力トークン価格はAstraの5分の1です。ChatGPT WorkとCodex、OpenAI APIで同日から利用できます。

価格

APIのモデル名はgpt-6.1-solです。標準価格(100万トークンあたり、入力272,000トークンまでのプロンプト)は次のとおりです。

モデル 入力 キャッシュ済み入力 キャッシュ書き込み 出力
GPT-6 Astra 10ドル 1ドル 12.50ドル 50ドル
GPT-6.1 Sol 2ドル 0.10ドル 2.50ドル 10ドル
GPT-6 Luna 0.10ドル 0.01ドル 0.125ドル 0.50ドル

キャッシュ済み入力の0.10ドルは標準の入力価格より95%安く、GPT-6 Solのキャッシュ済み入力価格と比べても50%安い設定です。OpenAIは、リクエストをまたいで文脈を再利用するエージェントを動かしやすくなるとしています。

入力が272,000トークンを超えるプロンプトは、リクエスト全体に対して入力とキャッシュの価格が2倍、出力が1.5倍になります。Fastモードは標準の2倍、BatchとFlexは標準の50%引きで、リージョン指定の処理には10%が上乗せされます。

仕様

項目 内容
コンテキストウィンドウ 1,050,000トークン
最大出力 128,000トークン
知識のカットオフ 2026年4月30日
入力 テキスト、画像
出力 テキスト
推論の強さ(reasoning.effort) low、medium(既定)、high、xhigh、max
データの所在地 米国とEUに対応
ファインチューニング 非対応

reasoning.effortのnoneとminimalは使えません。ツール呼び出しにはResponses APIを使います。Chat Completionsはツール呼び出しなしで対応します。Responses APIのリクエスト内でモデルがサブエージェントへ作業を任せるMulti-agentにも、ベータとして対応しています。

ベンチマーク

OpenAIが示した評価結果は次のとおりです。

評価 対象 GPT-6.1 Solの結果
DeepSWE v1.1 実際のコードベースでの複雑なソフトウェア開発 GPT-6 Astraと同等のスコアを約5分の1のコストで記録。GPT-6 Solの最高スコアを6.4ポイント上回る
GDP.pdf 表や図を含む複雑なPDFに基づく専門的な質問への回答 フォールバック込みのOpus 5.5より高いスコアを、タスクあたり半分未満のコストで記録
AutomationBench 複数の手順からなる業務ワークフローの完遂 推論の強さがmediumのとき、Opus 5.5を2.2ポイント上回り、コストは約3分の1。同じ設定のGPT-6 Solからは4.8ポイント向上
OSWorld 2.0(オフラインセット) 長い手順のコンピューター操作 推論の強さが最大のとき、GPT-6 Solを7ポイント上回り、コストは半分未満。Astraとの差は2.1ポイントで、タスクあたりのコストは約7分の1
Terminal-Bench Science 0.1 データ分析、シミュレーション、定理証明などの科学的な作業 推論の強さが最大のとき、GPT-6 Solの2倍を超えるスコアを半分未満のコストで記録

Terminal-Bench Science 0.1で推論の強さを最大にしたときのタスクあたりの平均コストは、GPT-6.1 Solが5.47ドル、Opus 5.5が23.21ドル、Astraが23.80ドルです。この評価で最も高いスコアは引き続きGPT-6 Astraの68.1%で、OpenAIは最も難しい科学研究のタスクにはAstraを使うべきだとしています。

事実の正確さと安全性

事実の誤りを含む回答の割合は、推論の強さがlowのときに最も大きく改善し、GPT-6 Solの11.4%から7.7%へ下がりました。約32%の減少です。この評価は、以前のモデルの誤りを利用者が指摘した会話を匿名化して使うもので、OpenAIは、意図的に難しくした設問であり通常の利用を代表するものではないと説明しています。

検索ツールが壊れているときに、推測で答えずに利用者へ伝えるかを調べる評価では、問題を伝えなかった割合がGPT-6.1 Solで2.1%でした。GPT-6 Solは4.9%、GPT-6 Astraは1.5%、GPT-6 Lunaは28.7%です。自動の安全レビューを回避しようとする試みは観測されず、この点はGPT-6 AstraやGPT-6 Solと同じだとしています。詳細はGPT-6.1 Solのシステムカードの追補に記載されています。

提供範囲

ChatGPTでは、Plus、Pro、Business、Enterprise、Eduの利用者が、ChatGPT WorkとCodexで使えます。Chatではまだ利用できません。

OpenAIは数日以内に、Codexでのトークン生成が標準の最大8倍速い「GPT-6.1 Sol Ultrafast」も提供するとしています。

この記事の固有名詞

コメント (0)

まだコメントはありません。

コメントを書く

2000文字以内