メインコンテンツへスキップ

GPT-6.1 Sol・6 Sol・Astra比較:移行の判断

GPT-6 Solからは同じ単価で性能が上がる6.1 Solへ移るのが基本で、none設定だけ要注意です。Astraは同点で比べると3〜5倍高く、最上位の精度が要る仕事に絞ります。

LaoZhang AI Team公開26 分で読めます
目次
GPT-6.1 SolとGPT-6 Solは入力2ドル・出力10ドル、GPT-6 Astraは入力10ドル・出力50ドルという100万トークンあたりの単価を並べ、6.1 Solへ移るべきかを問うカバー画像

GPT-6 Solを使っているなら、GPT-6.1 Solへの切り替えを前提に準備して構いません。単価はキャッシュ入力が半額になった以外は同じで、第三者機関Artificial Analysisの総合指数では、どの推論強度でも4〜8ポイント上がっています。ただしreasoning.effortのnoneが使えないなど、モデル名を書き換えるだけでは動かない設定があります。

GPT-6 Astraを使っているなら、大半の仕事は6.1 Solで試す価値があります。同じ指数の点数になる推論強度同士で比べると、6.1 Solのタスク当たりコストはAstraの約3〜5分の1です。Astraを残すのは、最高点そのものが必要な仕事、OpenAI自身がAstraを勧める最難関の科学タスク、そして自分の受け入れテストで6.1 Solの失敗が目立つ仕事です。

料金はOpenAI APIを直接使う場合のStandard単価で、内容は2026年9月30日時点の公式資料と公開ベンチマークに基づきます。GPT-6 Solは提供終了になったわけではなく、APIで引き続き指定できます。

3つのモデルの関係と公式単価

GPT-6 Astraは2026年9月3日、GPT-6 Solは9月22日、GPT-6.1 Solは9月29日に公開されました(OpenAIの変更履歴)。6.1 SolはGPT-6 Solの改良版です。OpenAIのGPT-6利用ガイドは、Astraを「最も要求の厳しい推論・コーディング・専門業務向け」、6.1 Solを「Astraに近い性能を、より低いコストで」と位置づけています。

GPT-6 SolはAPI料金表の主要モデル欄から外れましたが、廃止予定の一覧には載っていません。GPT-6 Solのモデルページも残っており、「新しいSolはGPT-6.1 Sol」と案内しているだけです。「6.1 SolがGPT-6 Solを置き換えた」という言い方は、OpenAIが勧めるSolが替わったという意味で、6 Solの提供終了を指すものではありません。

項目GPT-6.1 SolGPT-6 SolGPT-6 Astra
モデルIDgpt-6.1-solgpt-6-solgpt-6-astra
入力$2.00$2.00$10.00
キャッシュ入力$0.10$0.20$1.00
キャッシュ書き込み$2.50$2.50$12.50
出力$10.00$10.00$50.00
推論強度low、medium、high、xhigh、maxnone、low、medium、high、xhigh、maxlow、medium、high、xhigh、max
Chat Completionsでの関数呼び出し不可(Responses APIを使う)noneのときだけ可不可(Responses APIを使う)
知識のカットオフ2026年4月30日2026年4月20日2026年4月30日

単価は100万トークンあたりのStandard料金で、入力が272Kトークン以下のリクエストに適用されます(GPT-6.1 Solのモデルページ、GPT-6 Astraのモデルページ、API料金表)。コンテキストウィンドウ1,050,000トークン、最大出力128,000トークンは3モデルとも同じです。

6 Solから6.1 Solへの単価の変化はキャッシュ入力だけで、割引率が90%から95%に広がりました。Astraとの比較では、入力・キャッシュ書き込み・出力がちょうど5倍、キャッシュ入力は10倍の差です。

「5分の1」は単価の話で、タスク当たりでは約3〜5倍

発表で目立つ「Astraの5分の1」は、Standardの通常入力と出力の単価を比べた数字です。実際の支払額は、キャッシュの使い方、出力トークン数、推論強度で変わります。

処理区分を揃えれば差は変わりません。入力が272Kトークンを超えるとリクエスト全体が入力・キャッシュ2倍、出力1.5倍になり、6.1 Solは入力$4/出力$15、Astraは入力$20/出力$75です。BatchとFlexはどちらもStandardの半額、Fastは2倍です。つまりAstraをBatchで回しても入力$5/出力$25で、6.1 SolのStandard($2/$10)より2.5倍高いままです。

最速の処理区分であるUltrafastについては、2026年9月30日時点でAPI料金が公開されているのはAstraだけです(入力$60/出力$300、Standardの6倍)。OpenAIの発表記事は6.1 Sol Ultrafastの提供にも触れていますが、ChatGPTとCodexのモデル案内は「GPT-6.1 SolのUltrafast対応は後日」としており、料金表にも6.1 Solの行はありません。

1リクエストで計算してみる

エージェント処理のようにキャッシュが多い呼び出しを想定します。入力200,000トークン(うちキャッシュ150,000、非キャッシュ50,000)、出力20,000トークン、Standard、キャッシュ書き込みは除外という仮定です。単価は100万トークンあたりなので、トークン数を100万で割って掛けます。

モデル非キャッシュ入力キャッシュ入力出力合計
GPT-6.1 Sol0.05×$2=$0.1000.15×$0.10=$0.0150.02×$10=$0.200$0.315
GPT-6 Sol0.05×$2=$0.1000.15×$0.20=$0.0300.02×$10=$0.200$0.330
GPT-6 Astra0.05×$10=$0.5000.15×$1=$0.1500.02×$50=$1.000$1.650

トークン数が同じならAstraは6.1 Solの約5.2倍です。一方で、Artificial Analysisの計測では6.1 SolはGPT-6 Solより出力トークンが約10〜30%多くなっています。上の例で出力が20%増えて24,000トークンになると6.1 Solは$0.355となり、$0.330のGPT-6 Solをわずかに上回ります。出力の多い処理では、キャッシュ入力の値下げ分が出力の増加で相殺されることがあります。

性能差の根拠:第三者の数字とOpenAIの発表を分けて読む

性能については、独立した第三者の総合評価と、OpenAI自身が選んだベンチマークの2種類の数字が出回っています。前者は3モデルを同じ条件で測っており、後者は個別分野の差を示しますが評価の選び方はOpenAIによるものです。

Artificial Analysisの総合指数

Artificial AnalysisのIntelligence Index v4.3.2は、エージェント型の業務、端末操作、科学コード、知識問題など10種類の評価をまとめた総合点です。下の表は推論強度ごとの点数と、指数のタスク1件あたりのコスト(Artificial Analysisが各評価の入出力トークンに単価を掛けて加重平均したもの)です。

推論強度GPT-6 SolGPT-6.1 SolGPT-6 Astra
none28点/$0.33非対応非対応
low34点/$0.1342点/$0.1346点/$0.82
medium40点/$0.2548点/$0.2150点/$1.54
high43点/$0.3850点/$0.3251点/$1.73
xhigh44点/$0.5251点/$0.3952点/$2.31
max48点/$1.0552点/$0.7253点/$3.26

値は2026年9月30日時点のもので、Astraと6 Solの数字はそれぞれGPT-6 Astra、GPT-6 Solのページに載っています。指数タスク当たりのコストは評価用の加重平均で、あなたの請求額ではありません。

この表から読み取れることは3つあります。

  • 6.1 Solは同じ推論強度のGPT-6 Solより4〜8点高く、コストは同じか低い。6.1 Solのmedium(48点、$0.21)はGPT-6 Solのmax(48点、$1.05)と同点で、コストは約5分の1です。
  • 同じ推論強度ならAstraが1〜4点上。差はlowで4点、mediumで2点、high以上では1点です。
  • 点数を揃えると6.1 Solが大幅に安い。6.1 Sol high(50点、$0.32)とAstra medium(50点、$1.54)は約4.8倍、6.1 Sol xhigh(51点、$0.39)とAstra high(51点、$1.73)は約4.4倍、6.1 Sol max(52点、$0.72)とAstra xhigh(52点、$2.31)は約3.2倍の差です。Astra maxの53点に届く6.1 Solの設定はありません。

総合指数が50点、51点、52点で並ぶ6.1 SolとAstraの推論強度の組を指数タスク当たりのコストで比べ、約4.8倍、4.4倍、3.2倍の差と、53点はAstra maxだけであることを示した図

Artificial Analysisの解説記事によると、コーディングエージェント向けの指数では6.1 Solのxhighが、Astraより1点高い結果をAstraの15%未満のコストで出しています。しかも6.1 Sol自身のmaxよりxhighのほうが3点高く、推論強度を上げれば必ず良くなるわけではありません。知識問題での誤答(ハルシネーション)率も、GPT-6 Solの60%から54%に下がっています。

出力速度は6.1 Solが毎秒59〜66トークン、Astraが44〜51トークンです。

OpenAIが発表した比較

OpenAIの発表記事の主な数字は次のとおりです。評価はOpenAIの研究環境またはAPIで行われ、ChatGPTの本番環境とは結果が異なる場合があると注記されています。

  • DeepSWE v1.1(コーディング):6.1 SolはAstraと同等の水準を約5分の1のコストで達成。GPT-6 Solの最高点を、より低い推論強度とコストで6.4ポイント上回る。
  • OSWorld 2.0(コンピューター操作):max設定でGPT-6 Solより7ポイント高く、コストは半分未満。Astraとの差は2.1ポイント以内、タスク当たりコストは約7分の1。
  • Terminal-Bench Science 0.1(科学研究):6.1 SolはGPT-6 Solの2倍を超えるスコア。平均タスクコストは6.1 Sol $5.47、Astra $23.80。ただし首位は68.1%のAstraで、OpenAIは「最も難しい科学研究タスクにはAstraを使うべき」としています。
  • 事実誤り率(xhigh、意図的に難しくしたプロンプト):6.1 Sol 4.1%、GPT-6 Sol 4.5%、Astra 4.0%。
  • 検索ツールの故障を伝えずに回答した割合(max):6.1 Sol 2.1%、GPT-6 Sol 4.9%、Astra 1.5%。

どの数字も「GPT-6 Solより明確に良く、Astraにはわずかに届かない」という同じ傾向を示しています。ただし差の大きさは分野によって違い、科学研究では差が大きく残ります。

GPT-6 Solを使っている場合:切り替えてよい条件

単価が同じで、第三者評価でも同じ推論強度で上回っているため、次の条件に当てはまらなければ6.1 Solに切り替えて問題ありません。

  • noneで低遅延の応答を得ている。6.1 Solの最低はlowなので、応答までの時間とトークンが増えます。noneのまま使いたいならGPT-6 Solにとどまるか、noneに対応するGPT-6 Lunaを検討します(Lunaとの違いはGPT-6 Sol・Luna・AstraとTerraの違い:API料金と用途から選ぶを参照)。
  • Chat Completionsで、noneにしたうえで関数呼び出しをしている。6.1 SolはChat Completionsでツールを呼べないため、Responses APIへの移行が先に必要です。
  • 出力が長く、キャッシュ入力が少ない処理。出力トークンが増える分、1リクエストの費用がGPT-6 Solより上がることがあります。

推論強度は、まず今と同じ設定で比べ、次に一段下げた設定も試す価値があります。総合指数では6.1 Solのmediumが6 Solのmaxと同点、6.1 Solのhighは6 Solのxhighを6点上回っています。一段下げて品質が保てれば、出力増による費用増を打ち消せます。

もう一点、GPT-6 Solには画像のエンコードの不具合があり、9月25日に修正されています(変更履歴)。それ以前に画像入力を含む評価でGPT-6 Solを測っていた場合は、比較の前に取り直してください。

Solの他社代替も含めて検討するなら、GPT-6 Sol時点の比較としてOpus 5.5とGPT-6 Sol比較:料金2倍はどこに効くかがあります。

GPT-6 Astraを使っている場合:6.1 Solに移す仕事と残す仕事

Astraから6.1 Solへの移行は「全部か、ゼロか」ではなく、仕事の種類ごとに分けて考えます。

状況おすすめ理由
件数が多く、同じ種類の仕事を繰り返す6.1 Solに移す点数を揃えたタスク当たりコストが約3〜5分の1
コーディングエージェント6.1 Solのxhighから試す第三者のコーディングエージェント指数でAstraを1点上回り、maxよりxhighが高い
Astra medium〜xhighで運用している6.1 Solを一段上の強度で比べるAstra medium≒6.1 Sol high、high≒xhigh、xhigh≒maxが総合指数で同点
Astra maxの性能に依存しているAstraを残す53点に並ぶ6.1 Solの設定がない
最難関の科学研究・長い多段階作業Astraを残すOpenAIが最難関の科学タスクと、判断を持続させる一連の作業にAstraを勧めている
最速の応答が必要Astra Ultrafast6.1 SolのUltrafastは料金未公開・対応は後日

Astraの請求額を長文・Batch・Fastまで含めて見積もる方法は、GPT-6 Astra API料金:8つの単価と長文・Batch・Fastの計算方法で確認できます。

安全面の扱いは両者で同じです。OpenAIは6.1 Solをサイバーセキュリティで「Critical」、生物・化学で「High」の能力と分類し、Astraと同じ安全対策を適用しています(6.1 Solのシステムカード補遺)。セキュリティ関連の作業で、Astraから移れば制限が緩くなるとは考えないほうが安全です。

Astraの代わりにOpenAI以外のモデルも比べたい場合はSonnet 5.5とGPT-6 Astra比較:費用と使い分け、Astraを初めてAPIで使う場合の手順はGPT-6 Astra APIの始め方:利用権限の確認から最初の応答までが参考になります。

切り替え前に確認するリクエスト設定

gpt-6-solやAstraの設定を6.1 Solに向ける前に、GPT-6利用ガイドの移行手順に沿って次を確かめます。

  1. モデルIDはドット入りのgpt-6.1-sol。gpt-6-1-solのようにハイフンにすると別の文字列になります。
  2. reasoning.effortのnoneとminimalは使えない。OpenAIは代わりにlowから始めるよう勧めています。Chat Completionsではreasoning_effortです。
  3. ツール呼び出しはResponses APIで行う。Chat Completionsはツールなしのリクエストだけに対応します。
  4. 推論強度がnone以外ならtemperature、top_p、top_logprobsを外す。Chat Completionsではlogprobsも外し、Responses APIではincludeからmessage.output_text.logprobsを除きます。noneで温度を指定していた設定は、lowに変える時点でこれらを削る必要があります。
  5. EUデータレジデンシーではFastモードが使えない。6.1 Sol自体はUSとEUのデータレジデンシーに対応していますが、EUでFastを前提にした構成は組み直しが必要です。
  6. 出力トークンの上限と予算を見直す。出力がGPT-6 Solより約10〜30%増えるため、上限ぎりぎりの設定では途中で切れることがあります。
  7. 画像入力を含む評価は取り直す。9月25日の修正前に取ったGPT-6 Solの画像入力の結果は、そのまま比較に使わないでください。OpenAIも画像入力の評価の再実行を勧めています。

gpt-6-solから実際にリクエストを書き換えるときの具体的な変更点は、GPT-6.1 Sol:GPT-6 Solとの違いと移行の注意点で順に確認できます。

Microsoft FoundryやAmazon Bedrockでも6.1 Solが案内されていますが、クラウド経由の料金や設定項目は各社の資料で別途確認が必要です。

合格した成果1件あたりのコストで決める

単価や総合指数は判断の出発点にすぎません。最終的には、自分の代表的なタスクを同じ条件で両モデルに実行し、合格した成果1件あたりのコストで比べます。

計算式は「総コスト÷合格件数」です。失敗した分を人が直す手間も含めるなら、API費用に「失敗件数×1件の手直し費用」を足した総費用で比べます。

仮に50件のタスクを流し、1件あたりのトークン量は先ほどの計算例と同じ(6.1 Sol $0.315、Astra $1.650)とします。合格数はAstra 45件、6.1 Sol 40件と置きます。

  • Astra:$1.650×50=$82.50、合格1件あたり$82.50÷45≒$1.83
  • 6.1 Sol:$0.315×50=$15.75、合格1件あたり$15.75÷40≒$0.39

API費用だけなら6.1 Solが大幅に安くなります。ところが失敗1件を直す手間をR(ドル)とすると、総費用はAstraが$82.50+5R、6.1 Solが$15.75+10Rです。両者が等しくなるのはR=$66.75÷5≒$13.35のときで、失敗1件の手直しにこれ以上かかる仕事ではAstraのほうが安くつきます。

50件の仮定例で、Astraの総費用82.50ドル+5Rと6.1 Solの総費用15.75ドル+10Rを手直し費用Rに対して描き、Rが約13.35ドルで逆転することを示したグラフ

一般には「(AstraのAPI費用−6.1 SolのAPI費用)÷(6.1 Solの失敗件数−Astraの失敗件数)」が分岐点です。失敗件数が同じか6.1 Solのほうが少なければ分岐点はなく、6.1 Solが常に安くなります。

この例はトークン量を揃えた仮定の計算で、実際にはモデルごとに出力量も合格率も変わります。それでも、合格率の差が小さい仕事では6.1 Solが勝ち、失敗の後始末が高くつく仕事ではわずかな合格率の差がAPI単価の差を上回るという構図は変わりません。受け入れテストは次の点を揃えて行います。

  • 比べる推論強度は、総合指数で点数が並ぶ組(Astra mediumと6.1 Sol highなど)を含める
  • プロンプトとツール設定、キャッシュの条件を同じにする
  • 合否の基準をテスト前に決め、人の判定が要るなら判定者を固定する
  • トークン使用量はAPIの使用量記録から実数で取る

ChatGPTのWorkとCodexで選ぶ場合

ChatGPTのWorkとCodexでは、APIのトークン単価ではなくプランの使用量(ChatGPTクレジット)で消費が決まるため、上の料金表はそのまま当てはまりません。モデルごとのクレジット消費はプランの料金ページで確認してください。

ChatGPTとCodexのモデル案内によると、6.1 SolはPlus、Pro、Business、Enterprise、Eduの各プランで、Codex(デスクトップアプリとCLI)とChatGPTのWork(Webとモバイル)に順次提供されています。EnterpriseとEduは管理者が有効にするまで使えず、FreeとGoは提供開始時点で対象外です。6.1 SolとGPT-6 SolはWorkとCodexのモデルで、通常のチャット画面では選べません。

CLIではcodex -m gpt-6.1-sol、Astraならcodex -m gpt-6-astraで指定します。推論強度の表示はLightからUltraまでで、APIのreasoning.effortとは名前が異なります(AstraのLightは設定上low)。OpenAIの案内も、繰り返しや長時間の作業には6.1 Sol、最も要求の厳しい作業にはAstraという分け方です。

よくある質問

GPT-6 Solはもう使えなくなりますか?

2026年9月30日時点で、APIの廃止予定一覧にGPT-6 Solは載っておらず、gpt-6-solは引き続き指定できます。ただしOpenAIが勧めるSolは6.1 Solに替わったため、新しく組む処理は6.1 Solを基準にするのが自然です。

6.1 Solに替えるとAPIの費用は下がりますか?

単価ではキャッシュ入力が$0.20から$0.10に下がるだけで、ほかは同じです。キャッシュの多い処理ではわずかに安くなりますが、出力トークンが約10〜30%増えるため、出力の多い処理ではかえって上がることがあります。一段低い推論強度で同じ品質が出れば、費用は下がります。

Astraと比べるときは、どの推論強度同士を並べればよいですか?

同じ名前の強度同士ではなく、総合指数で点数が並ぶ組を比べます。Artificial Analysisの値では、Astra mediumと6.1 Sol high、Astra highと6.1 Sol xhigh、Astra xhighと6.1 Sol maxが同点です。コーディングエージェントでは6.1 Solのxhighがmaxを上回っているため、xhighから試すのが近道です。

Ultrafastは6.1 Solでも使えますか?

OpenAIの発表では6.1 Sol Ultrafastにも触れていますが、2026年9月30日時点のAPI料金表でUltrafastの料金があるのはAstraだけで、ChatGPTとCodexの案内も6.1 Solの対応は後日としています。今すぐ最速の応答が必要ならAstra Ultrafastが選択肢です。

さらに読む: モデル比較
GPT-6.1 Solの移行の注意点:キャッシュ入力は$0.20から$0.10に半額、入力と出力は$2と$10で据え置き、推論設定の最小はlow
API 料金とプラン

GPT-6.1 Sol:GPT-6 Solとの違いと移行の注意点

GPT-6.1 SolはGPT-6 Solの後継で、キャッシュ入力だけが半額です。APIではnoneの推論設定とChat Completionsでのツール呼び出しが使えません。

23 分
GPT-6のSol、Luna、AstraとGPT-5.6 Terraを世代と用途で見分ける概念図
API 料金とプラン

GPT-6 Sol・Luna・AstraとTerraの違い:API料金と用途から選ぶ

最初の候補は、反復しやすい定型処理ならLuna、複雑な開発や日常の判断ならSol、難度の高い多段階作業ならAstra。TerraはGPT-6ではなくGPT-5.6で、既存の運用と同じ課題で比較する候補です。

11 分
「どちらを先に試す?」の見出しの下、机で考え込む開発者の左右にClaude Opus 5.5とGPT-6 Solが並び、どちらからも同じ成果物へ矢印が向かい、コスト・レビュー工数・タスクの成功が比較の軸として示されたイラスト
Claude Code

Opus 5.5とGPT-6 Sol比較:料金2倍はどこに効くか

Opus 5.5が2倍なのは短い依頼の入力・出力だけで、キャッシュ読み出しは同額、272K超では逆転もあります。ただ実測のタスク単価は約5倍差。合格1件あたりの費用で選びます。

23 分