# GPT-6.1 Sol・6 Sol・Astra比較：移行の判断

> GPT-6 Solからは同じ単価で性能が上がる6.1 Solへ移るのが基本で、none設定だけ要注意です。Astraは同点で比べると3〜5倍高く、最上位の精度が要る仕事に絞ります。

- URL: https://blog.laozhang.ai/ja/posts/gpt-6-1-sol-vs-gpt-6-astra-vs-gpt-6-sol
- Published: 2026-09-30
- Updated: 2026-09-30
- Author: LaoZhang AI Team (https://blog.laozhang.ai/ja/about)
- Category: AI Models
- Tags: GPT-6.1 Sol, GPT-6 Sol, GPT-6 Astra, OpenAI API, API料金, モデル比較

---
**GPT-6 Solを使っているなら、GPT-6.1 Solへの切り替えを前提に準備して構いません**。単価はキャッシュ入力が半額になった以外は同じで、第三者機関Artificial Analysisの総合指数では、どの推論強度でも4〜8ポイント上がっています。ただし`reasoning.effort`の`none`が使えないなど、モデル名を書き換えるだけでは動かない設定があります。

**GPT-6 Astraを使っているなら、大半の仕事は6.1 Solで試す価値があります**。同じ指数の点数になる推論強度同士で比べると、6.1 Solのタスク当たりコストはAstraの約3〜5分の1です。Astraを残すのは、最高点そのものが必要な仕事、OpenAI自身がAstraを勧める最難関の科学タスク、そして自分の受け入れテストで6.1 Solの失敗が目立つ仕事です。

料金はOpenAI APIを直接使う場合のStandard単価で、内容は2026年9月30日時点の公式資料と公開ベンチマークに基づきます。GPT-6 Solは提供終了になったわけではなく、APIで引き続き指定できます。

## 3つのモデルの関係と公式単価

GPT-6 Astraは2026年9月3日、GPT-6 Solは9月22日、GPT-6.1 Solは9月29日に公開されました（[OpenAIの変更履歴](https://developers.openai.com/api/docs/changelog)）。6.1 SolはGPT-6 Solの改良版です。OpenAIの[GPT-6利用ガイド](https://developers.openai.com/api/docs/guides/latest-model)は、Astraを「最も要求の厳しい推論・コーディング・専門業務向け」、6.1 Solを「Astraに近い性能を、より低いコストで」と位置づけています。

GPT-6 SolはAPI料金表の主要モデル欄から外れましたが、[廃止予定の一覧](https://developers.openai.com/api/docs/deprecations)には載っていません。[GPT-6 Solのモデルページ](https://developers.openai.com/api/docs/models/gpt-6-sol)も残っており、「新しいSolはGPT-6.1 Sol」と案内しているだけです。「6.1 SolがGPT-6 Solを置き換えた」という言い方は、OpenAIが勧めるSolが替わったという意味で、6 Solの提供終了を指すものではありません。

| 項目 | GPT-6.1 Sol | GPT-6 Sol | GPT-6 Astra |
|---|---|---|---|
| モデルID | `gpt-6.1-sol` | `gpt-6-sol` | `gpt-6-astra` |
| 入力 | $2.00 | $2.00 | $10.00 |
| キャッシュ入力 | $0.10 | $0.20 | $1.00 |
| キャッシュ書き込み | $2.50 | $2.50 | $12.50 |
| 出力 | $10.00 | $10.00 | $50.00 |
| 推論強度 | low、medium、high、xhigh、max | none、low、medium、high、xhigh、max | low、medium、high、xhigh、max |
| Chat Completionsでの関数呼び出し | 不可（Responses APIを使う） | `none`のときだけ可 | 不可（Responses APIを使う） |
| 知識のカットオフ | 2026年4月30日 | 2026年4月20日 | 2026年4月30日 |

単価は100万トークンあたりのStandard料金で、入力が272Kトークン以下のリクエストに適用されます（[GPT-6.1 Solのモデルページ](https://developers.openai.com/api/docs/models/gpt-6.1-sol)、[GPT-6 Astraのモデルページ](https://developers.openai.com/api/docs/models/gpt-6-astra)、[API料金表](https://developers.openai.com/api/docs/pricing)）。コンテキストウィンドウ1,050,000トークン、最大出力128,000トークンは3モデルとも同じです。

6 Solから6.1 Solへの単価の変化はキャッシュ入力だけで、割引率が90%から95%に広がりました。Astraとの比較では、入力・キャッシュ書き込み・出力がちょうど5倍、キャッシュ入力は10倍の差です。

## 「5分の1」は単価の話で、タスク当たりでは約3〜5倍

発表で目立つ「Astraの5分の1」は、Standardの通常入力と出力の単価を比べた数字です。実際の支払額は、キャッシュの使い方、出力トークン数、推論強度で変わります。

処理区分を揃えれば差は変わりません。入力が272Kトークンを超えるとリクエスト全体が入力・キャッシュ2倍、出力1.5倍になり、6.1 Solは入力$4／出力$15、Astraは入力$20／出力$75です。BatchとFlexはどちらもStandardの半額、Fastは2倍です。つまりAstraをBatchで回しても入力$5／出力$25で、6.1 SolのStandard（$2／$10）より2.5倍高いままです。

最速の処理区分であるUltrafastについては、2026年9月30日時点でAPI料金が公開されているのはAstraだけです（入力$60／出力$300、Standardの6倍）。OpenAIの発表記事は6.1 Sol Ultrafastの提供にも触れていますが、[ChatGPTとCodexのモデル案内](https://learn.chatgpt.com/docs/models)は「GPT-6.1 SolのUltrafast対応は後日」としており、料金表にも6.1 Solの行はありません。

### 1リクエストで計算してみる

エージェント処理のようにキャッシュが多い呼び出しを想定します。入力200,000トークン（うちキャッシュ150,000、非キャッシュ50,000）、出力20,000トークン、Standard、キャッシュ書き込みは除外という仮定です。単価は100万トークンあたりなので、トークン数を100万で割って掛けます。

| モデル | 非キャッシュ入力 | キャッシュ入力 | 出力 | 合計 |
|---|---|---|---|---|
| GPT-6.1 Sol | 0.05×$2＝$0.100 | 0.15×$0.10＝$0.015 | 0.02×$10＝$0.200 | $0.315 |
| GPT-6 Sol | 0.05×$2＝$0.100 | 0.15×$0.20＝$0.030 | 0.02×$10＝$0.200 | $0.330 |
| GPT-6 Astra | 0.05×$10＝$0.500 | 0.15×$1＝$0.150 | 0.02×$50＝$1.000 | $1.650 |

トークン数が同じならAstraは6.1 Solの約5.2倍です。一方で、Artificial Analysisの計測では6.1 SolはGPT-6 Solより出力トークンが約10〜30%多くなっています。上の例で出力が20%増えて24,000トークンになると6.1 Solは$0.355となり、$0.330のGPT-6 Solをわずかに上回ります。出力の多い処理では、キャッシュ入力の値下げ分が出力の増加で相殺されることがあります。

## 性能差の根拠：第三者の数字とOpenAIの発表を分けて読む

性能については、独立した第三者の総合評価と、OpenAI自身が選んだベンチマークの2種類の数字が出回っています。前者は3モデルを同じ条件で測っており、後者は個別分野の差を示しますが評価の選び方はOpenAIによるものです。

### Artificial Analysisの総合指数

[Artificial Analysis](https://artificialanalysis.ai/models/releases/gpt-6-1-sol)のIntelligence Index v4.3.2は、エージェント型の業務、端末操作、科学コード、知識問題など10種類の評価をまとめた総合点です。下の表は推論強度ごとの点数と、指数のタスク1件あたりのコスト（Artificial Analysisが各評価の入出力トークンに単価を掛けて加重平均したもの）です。

| 推論強度 | GPT-6 Sol | GPT-6.1 Sol | GPT-6 Astra |
|---|---|---|---|
| none | 28点／$0.33 | 非対応 | 非対応 |
| low | 34点／$0.13 | 42点／$0.13 | 46点／$0.82 |
| medium | 40点／$0.25 | 48点／$0.21 | 50点／$1.54 |
| high | 43点／$0.38 | 50点／$0.32 | 51点／$1.73 |
| xhigh | 44点／$0.52 | 51点／$0.39 | 52点／$2.31 |
| max | 48点／$1.05 | 52点／$0.72 | 53点／$3.26 |

値は2026年9月30日時点のもので、Astraと6 Solの数字はそれぞれ[GPT-6 Astra](https://artificialanalysis.ai/models/releases/gpt-6-astra)、[GPT-6 Sol](https://artificialanalysis.ai/models/releases/gpt-6-sol)のページに載っています。指数タスク当たりのコストは評価用の加重平均で、あなたの請求額ではありません。

この表から読み取れることは3つあります。

- **6.1 Solは同じ推論強度のGPT-6 Solより4〜8点高く、コストは同じか低い**。6.1 Solのmedium（48点、$0.21）はGPT-6 Solのmax（48点、$1.05）と同点で、コストは約5分の1です。
- **同じ推論強度ならAstraが1〜4点上**。差はlowで4点、mediumで2点、high以上では1点です。
- **点数を揃えると6.1 Solが大幅に安い**。6.1 Sol high（50点、$0.32）とAstra medium（50点、$1.54）は約4.8倍、6.1 Sol xhigh（51点、$0.39）とAstra high（51点、$1.73）は約4.4倍、6.1 Sol max（52点、$0.72）とAstra xhigh（52点、$2.31）は約3.2倍の差です。Astra maxの53点に届く6.1 Solの設定はありません。

![総合指数が50点、51点、52点で並ぶ6.1 SolとAstraの推論強度の組を指数タスク当たりのコストで比べ、約4.8倍、4.4倍、3.2倍の差と、53点はAstra maxだけであることを示した図](https://blog.laozhang.ai/posts/ja/gpt-6-1-sol-vs-gpt-6-astra-vs-gpt-6-sol/img/score-matched-cost.webp)

Artificial Analysisの[解説記事](https://artificialanalysis.ai/articles/gpt-6-1-sol-replaces-gpt-6-sol-after-just-7-days-with-near-astra-intelligence)によると、コーディングエージェント向けの指数では6.1 Solのxhighが、Astraより1点高い結果をAstraの15%未満のコストで出しています。しかも6.1 Sol自身のmaxよりxhighのほうが3点高く、推論強度を上げれば必ず良くなるわけではありません。知識問題での誤答（ハルシネーション）率も、GPT-6 Solの60%から54%に下がっています。

出力速度は6.1 Solが毎秒59〜66トークン、Astraが44〜51トークンです。

### OpenAIが発表した比較

[OpenAIの発表記事](https://openai.com/index/introducing-gpt-6-1-sol/)の主な数字は次のとおりです。評価はOpenAIの研究環境またはAPIで行われ、ChatGPTの本番環境とは結果が異なる場合があると注記されています。

- **DeepSWE v1.1**（コーディング）：6.1 SolはAstraと同等の水準を約5分の1のコストで達成。GPT-6 Solの最高点を、より低い推論強度とコストで6.4ポイント上回る。
- **OSWorld 2.0**（コンピューター操作）：max設定でGPT-6 Solより7ポイント高く、コストは半分未満。Astraとの差は2.1ポイント以内、タスク当たりコストは約7分の1。
- **Terminal-Bench Science 0.1**（科学研究）：6.1 SolはGPT-6 Solの2倍を超えるスコア。平均タスクコストは6.1 Sol $5.47、Astra $23.80。ただし首位は68.1%のAstraで、OpenAIは「最も難しい科学研究タスクにはAstraを使うべき」としています。
- **事実誤り率**（xhigh、意図的に難しくしたプロンプト）：6.1 Sol 4.1%、GPT-6 Sol 4.5%、Astra 4.0%。
- **検索ツールの故障を伝えずに回答した割合**（max）：6.1 Sol 2.1%、GPT-6 Sol 4.9%、Astra 1.5%。

どの数字も「GPT-6 Solより明確に良く、Astraにはわずかに届かない」という同じ傾向を示しています。ただし差の大きさは分野によって違い、科学研究では差が大きく残ります。

## GPT-6 Solを使っている場合：切り替えてよい条件

単価が同じで、第三者評価でも同じ推論強度で上回っているため、次の条件に当てはまらなければ6.1 Solに切り替えて問題ありません。

- `none`で低遅延の応答を得ている。6.1 Solの最低はlowなので、応答までの時間とトークンが増えます。`none`のまま使いたいならGPT-6 Solにとどまるか、`none`に対応するGPT-6 Lunaを検討します（Lunaとの違いは[GPT-6 Sol・Luna・AstraとTerraの違い：API料金と用途から選ぶ](https://blog.laozhang.ai/ja/posts/gpt-6-sol-vs-terra-vs-luna-vs-astra)を参照）。
- Chat Completionsで、`none`にしたうえで関数呼び出しをしている。6.1 SolはChat Completionsでツールを呼べないため、Responses APIへの移行が先に必要です。
- 出力が長く、キャッシュ入力が少ない処理。出力トークンが増える分、1リクエストの費用がGPT-6 Solより上がることがあります。

推論強度は、まず今と同じ設定で比べ、次に一段下げた設定も試す価値があります。総合指数では6.1 Solのmediumが6 Solのmaxと同点、6.1 Solのhighは6 Solのxhighを6点上回っています。一段下げて品質が保てれば、出力増による費用増を打ち消せます。

もう一点、GPT-6 Solには画像のエンコードの不具合があり、9月25日に修正されています（[変更履歴](https://developers.openai.com/api/docs/changelog)）。それ以前に画像入力を含む評価でGPT-6 Solを測っていた場合は、比較の前に取り直してください。

Solの他社代替も含めて検討するなら、GPT-6 Sol時点の比較として[Opus 5.5とGPT-6 Sol比較：料金2倍はどこに効くか](https://blog.laozhang.ai/ja/posts/claude-opus-5-5-vs-gpt-6-sol)があります。

## GPT-6 Astraを使っている場合：6.1 Solに移す仕事と残す仕事

Astraから6.1 Solへの移行は「全部か、ゼロか」ではなく、仕事の種類ごとに分けて考えます。

| 状況 | おすすめ | 理由 |
|---|---|---|
| 件数が多く、同じ種類の仕事を繰り返す | 6.1 Solに移す | 点数を揃えたタスク当たりコストが約3〜5分の1 |
| コーディングエージェント | 6.1 Solのxhighから試す | 第三者のコーディングエージェント指数でAstraを1点上回り、maxよりxhighが高い |
| Astra medium〜xhighで運用している | 6.1 Solを一段上の強度で比べる | Astra medium≒6.1 Sol high、high≒xhigh、xhigh≒maxが総合指数で同点 |
| Astra maxの性能に依存している | Astraを残す | 53点に並ぶ6.1 Solの設定がない |
| 最難関の科学研究・長い多段階作業 | Astraを残す | OpenAIが最難関の科学タスクと、判断を持続させる一連の作業にAstraを勧めている |
| 最速の応答が必要 | Astra Ultrafast | 6.1 SolのUltrafastは料金未公開・対応は後日 |

Astraの請求額を長文・Batch・Fastまで含めて見積もる方法は、[GPT-6 Astra API料金：8つの単価と長文・Batch・Fastの計算方法](https://blog.laozhang.ai/ja/posts/gpt-6-astra-api-pricing)で確認できます。

安全面の扱いは両者で同じです。OpenAIは6.1 Solをサイバーセキュリティで「Critical」、生物・化学で「High」の能力と分類し、Astraと同じ安全対策を適用しています（[6.1 Solのシステムカード補遺](https://deploymentsafety.openai.com/gpt-6-1-sol)）。セキュリティ関連の作業で、Astraから移れば制限が緩くなるとは考えないほうが安全です。

Astraの代わりにOpenAI以外のモデルも比べたい場合は[Sonnet 5.5とGPT-6 Astra比較：費用と使い分け](https://blog.laozhang.ai/ja/posts/claude-sonnet-5-5-vs-gpt-6-astra)、Astraを初めてAPIで使う場合の手順は[GPT-6 Astra APIの始め方：利用権限の確認から最初の応答まで](https://blog.laozhang.ai/ja/posts/gpt-6-astra-api-access)が参考になります。

## 切り替え前に確認するリクエスト設定

`gpt-6-sol`やAstraの設定を6.1 Solに向ける前に、[GPT-6利用ガイドの移行手順](https://developers.openai.com/api/docs/guides/latest-model)に沿って次を確かめます。

1. **モデルIDはドット入りの`gpt-6.1-sol`**。`gpt-6-1-sol`のようにハイフンにすると別の文字列になります。
2. **`reasoning.effort`の`none`と`minimal`は使えない**。OpenAIは代わりに`low`から始めるよう勧めています。Chat Completionsでは`reasoning_effort`です。
3. **ツール呼び出しはResponses APIで行う**。Chat Completionsはツールなしのリクエストだけに対応します。
4. **推論強度が`none`以外なら`temperature`、`top_p`、`top_logprobs`を外す**。Chat Completionsでは`logprobs`も外し、Responses APIでは`include`から`message.output_text.logprobs`を除きます。`none`で温度を指定していた設定は、lowに変える時点でこれらを削る必要があります。
5. **EUデータレジデンシーではFastモードが使えない**。6.1 Sol自体はUSとEUのデータレジデンシーに対応していますが、EUでFastを前提にした構成は組み直しが必要です。
6. **出力トークンの上限と予算を見直す**。出力がGPT-6 Solより約10〜30%増えるため、上限ぎりぎりの設定では途中で切れることがあります。
7. **画像入力を含む評価は取り直す**。9月25日の修正前に取ったGPT-6 Solの画像入力の結果は、そのまま比較に使わないでください。OpenAIも画像入力の評価の再実行を勧めています。

`gpt-6-sol`から実際にリクエストを書き換えるときの具体的な変更点は、[GPT-6.1 Sol：GPT-6 Solとの違いと移行の注意点](https://blog.laozhang.ai/ja/posts/gpt-6-1-sol)で順に確認できます。

Microsoft FoundryやAmazon Bedrockでも6.1 Solが案内されていますが、クラウド経由の料金や設定項目は各社の資料で別途確認が必要です。

## 合格した成果1件あたりのコストで決める

単価や総合指数は判断の出発点にすぎません。最終的には、自分の代表的なタスクを同じ条件で両モデルに実行し、**合格した成果1件あたりのコスト**で比べます。

計算式は「総コスト÷合格件数」です。失敗した分を人が直す手間も含めるなら、API費用に「失敗件数×1件の手直し費用」を足した総費用で比べます。

仮に50件のタスクを流し、1件あたりのトークン量は先ほどの計算例と同じ（6.1 Sol $0.315、Astra $1.650）とします。合格数はAstra 45件、6.1 Sol 40件と置きます。

- Astra：$1.650×50＝$82.50、合格1件あたり$82.50÷45≒$1.83
- 6.1 Sol：$0.315×50＝$15.75、合格1件あたり$15.75÷40≒$0.39

API費用だけなら6.1 Solが大幅に安くなります。ところが失敗1件を直す手間をR（ドル）とすると、総費用はAstraが$82.50＋5R、6.1 Solが$15.75＋10Rです。両者が等しくなるのはR＝$66.75÷5≒$13.35のときで、失敗1件の手直しにこれ以上かかる仕事ではAstraのほうが安くつきます。

![50件の仮定例で、Astraの総費用82.50ドル＋5Rと6.1 Solの総費用15.75ドル＋10Rを手直し費用Rに対して描き、Rが約13.35ドルで逆転することを示したグラフ](https://blog.laozhang.ai/posts/ja/gpt-6-1-sol-vs-gpt-6-astra-vs-gpt-6-sol/img/rework-break-even.webp)

一般には「（AstraのAPI費用−6.1 SolのAPI費用）÷（6.1 Solの失敗件数−Astraの失敗件数）」が分岐点です。失敗件数が同じか6.1 Solのほうが少なければ分岐点はなく、6.1 Solが常に安くなります。

この例はトークン量を揃えた仮定の計算で、実際にはモデルごとに出力量も合格率も変わります。それでも、**合格率の差が小さい仕事では6.1 Solが勝ち、失敗の後始末が高くつく仕事ではわずかな合格率の差がAPI単価の差を上回る**という構図は変わりません。受け入れテストは次の点を揃えて行います。

- 比べる推論強度は、総合指数で点数が並ぶ組（Astra mediumと6.1 Sol highなど）を含める
- プロンプトとツール設定、キャッシュの条件を同じにする
- 合否の基準をテスト前に決め、人の判定が要るなら判定者を固定する
- トークン使用量はAPIの使用量記録から実数で取る

## ChatGPTのWorkとCodexで選ぶ場合

ChatGPTのWorkとCodexでは、APIのトークン単価ではなくプランの使用量（ChatGPTクレジット）で消費が決まるため、上の料金表はそのまま当てはまりません。モデルごとのクレジット消費はプランの料金ページで確認してください。

[ChatGPTとCodexのモデル案内](https://learn.chatgpt.com/docs/models)によると、6.1 SolはPlus、Pro、Business、Enterprise、Eduの各プランで、Codex（デスクトップアプリとCLI）とChatGPTのWork（Webとモバイル）に順次提供されています。EnterpriseとEduは管理者が有効にするまで使えず、FreeとGoは提供開始時点で対象外です。6.1 SolとGPT-6 SolはWorkとCodexのモデルで、通常のチャット画面では選べません。

CLIでは`codex -m gpt-6.1-sol`、Astraなら`codex -m gpt-6-astra`で指定します。推論強度の表示はLightからUltraまでで、APIの`reasoning.effort`とは名前が異なります（AstraのLightは設定上low）。OpenAIの案内も、繰り返しや長時間の作業には6.1 Sol、最も要求の厳しい作業にはAstraという分け方です。

## よくある質問

### GPT-6 Solはもう使えなくなりますか？

2026年9月30日時点で、APIの廃止予定一覧にGPT-6 Solは載っておらず、`gpt-6-sol`は引き続き指定できます。ただしOpenAIが勧めるSolは6.1 Solに替わったため、新しく組む処理は6.1 Solを基準にするのが自然です。

### 6.1 Solに替えるとAPIの費用は下がりますか？

単価ではキャッシュ入力が$0.20から$0.10に下がるだけで、ほかは同じです。キャッシュの多い処理ではわずかに安くなりますが、出力トークンが約10〜30%増えるため、出力の多い処理ではかえって上がることがあります。一段低い推論強度で同じ品質が出れば、費用は下がります。

### Astraと比べるときは、どの推論強度同士を並べればよいですか？

同じ名前の強度同士ではなく、総合指数で点数が並ぶ組を比べます。Artificial Analysisの値では、Astra mediumと6.1 Sol high、Astra highと6.1 Sol xhigh、Astra xhighと6.1 Sol maxが同点です。コーディングエージェントでは6.1 Solのxhighがmaxを上回っているため、xhighから試すのが近道です。

### Ultrafastは6.1 Solでも使えますか？

OpenAIの発表では6.1 Sol Ultrafastにも触れていますが、2026年9月30日時点のAPI料金表でUltrafastの料金があるのはAstraだけで、ChatGPTとCodexの案内も6.1 Solの対応は後日としています。今すぐ最速の応答が必要ならAstra Ultrafastが選択肢です。
