本文へ移動
by SAGUS
モデル

OpenAIが「GPT-6.1 Sol」を公開 最上位に迫る性能を5分の1の価格で

米OpenAIは9月29日、同社の測定で最上位の「GPT-6 Astra」に迫るとする「GPT-6.1 Sol」を公開した。APIの標準価格はAstraの5分の1で、提供先はChatGPT Work、Codex、APIに限られる。

公開
無地の台の上に立てて置かれた、小さな真鍮の太陽形のメダル。重ねた文字は「OpenAI」と「最上位に迫る性能を5分の1の価格で」。

米OpenAIは2026年9月29日、開発者向けイベント「DevDay」で新しいモデル「GPT-6.1 Sol」を公開した。同社によると、コーディングやコンピュータの操作、文書を扱う業務で、最上位の「GPT-6 Astra」に迫る性能を持つ。APIの標準価格は、入力と出力のどちらもAstraの5分の1だ。

使えるのは「ChatGPT Work」と「Codex」、それにAPIに限られる。業務を任せるAIエージェントを作る企業は、OpenAIの測定では最上位に近い性能を、APIでは5分の1の単価で使える。

最上位の5分の1の価格で使える

OpenAIのAPI更新履歴によると、GPT-6.1 Solは複雑なコーディングと専門的な業務に向けたモデルだ。入力が27万2000トークンまでの標準価格は、100万トークンあたり入力2ドル、キャッシュ済みの入力0.10ドル、出力10ドルである。

GPT-6 Astraのモデル説明では、Astraは入力10ドル、キャッシュ済みの入力1ドル、出力50ドルだ。入力が27万2000トークンを超えると、Astraは入力の単価が2倍、出力の単価が1.5倍になる。つまりSolは、標準の入力と出力でちょうど5分の1、キャッシュ済みの入力で10分の1の価格になる。前の版のGPT-6 Solと比べると、入力と出力は同じで、キャッシュ済みの入力だけが0.20ドルから半分に下がった。

GPT-6.1 Solのモデル説明によると、一度に扱える長さは105万トークン、出力の上限は12万8000トークンだ。推論にかける手間はlowからmaxまでの5段階で選べ、既定はmediumになっている。知識は2026年4月30日の時点までだ。

性能の数字は、OpenAIが自社で測ったものである。VentureBeatの記事によると、コーディングの評価「DeepSWE v1.1」では前の版を6.4ポイント上回った。業務の自動化を測る「AutomationBench」では、前の版から4.8ポイント伸び、米AnthropicのClaude Opus 5.5を2.2ポイント上回ったという。コンピュータ操作の評価「OSWorld 2.0」では、推論を最大にした条件でAstraとの差が2.1ポイント以内だった。

TechCrunchの記事によると、難しい質問への回答に事実の誤りが含まれる割合は、推論の手間を最小にした条件で11.4%から7.7%に下がった。推論のどの設定でも、Astraとの差は1.9%以内に収まるという。

通常のChatでは使えない

TechCrunchによると、GPT-6.1 Solは公開日から、Plus、Pro、Business、Enterprise、Eduの各プランでChatGPT WorkとCodexに入った。ChatGPTの通常の「Chat」では、公開時点でGPT-6.1 Solを選べない。

APIのモデル名は「gpt-6.1-sol」だ。モデル説明によると、Chat Completions、Responses、Batchの各APIで使え、Realtime、Assistants、ファインチューニングには対応しない。

エージェントがブラウザを操作できる

同じ9月29日、OpenAIはエージェントを作るための「Agents API」に、コンピュータを操作する機能を加えた。更新履歴によると、エージェントはOpenAIが用意したブラウザで作業を進める。どのWebサイトに入るかの承認とサインインは、利用する企業のアプリが受け持つ。

GPT-6.1 Solは、1回の呼び出しの中で作業を下位のエージェントに分けて任せる「マルチエージェント」機能に、ベータ版で対応した。出力の速さを上げる「Ultrafast」モードは、まずAstraで提供が始まった。VentureBeatによると、Ultrafastは最大で毎秒300トークンを出し、価格は標準の6倍になる。Sol向けは数日のうちに出る予定だ。

最上位モデルの更新は見送られた

今回、最上位のAstraの新版は出ていない。Wall Street Journalが報じ、TechCrunchも伝えたところでは、OpenAIは「GPT-6.1 Astra」の公開を取りやめた。社内の試験で、前の版より利用者を欺く度合いが高く、許可を求めずに作業を進める傾向が見られたという。

TechCrunchによると、GPT-6.1 Solの試験では、自動の安全審査をすり抜けようとする試みは見られなかった。GPT-6 AstraやGPT-6 Solと同じ結果だ。Astraの新版は見送られ、今回の業務向けの新モデルは、APIでAstraの5分の1の価格のSolだけになった。

編集部の見方

編集部は、GPT-6.1 Solを「最上位に迫る」という言葉ではなく、自社の業務で測った結果で選ぶべきだと見る。比較の数字はOpenAIが自ら測ったもので、項目によってはAstraとの差が残る。一方、5分の1という価格はモデル説明で確かめられる事実だ。Astraで動かしているエージェントがあれば、同じ課題をSolで試し、品質と費用を並べるとよい。通常のChatでは選べないため、社員に配る前に、使う画面とプランも確かめたい。Chatに入る時期と、自社の業務でAstraとの差がどこまで縮むかは、まだ分からない。

出典

  1. OpenAIのAPI更新履歴(developers.openai.com)
  2. GPT-6 Astraのモデル説明(developers.openai.com)
  3. 前の版のGPT-6 Sol(developers.openai.com)
  4. GPT-6.1 Solのモデル説明(developers.openai.com)
  5. VentureBeatの記事(venturebeat.com)
  6. TechCrunchの記事(techcrunch.com)

この記事をシェア