# AI API 料金比較：主要5社の単価と最安モデルの選び方

> 2026年9月26日時点の公式単価で最安は GPT-6 Luna。標準クラスは入出力比率、長文割増、DeepSeek の時間帯、Gemini の年明け改定で順位が変わります。

- URL: https://blog.laozhang.ai/ja/posts/cheapest-llm-models
- Published: 2026-07-02
- Updated: 2026-09-26
- Author: LaoZhang AI Team (https://blog.laozhang.ai/ja/about)
- Category: API料金
- Tags: AI API 料金, LLM API, OpenAI API, Claude API, Gemini API, DeepSeek API, Grok API

---
2026年9月26日時点の各社公式料金（100万トークンあたり、米ドル）で比べると、表示単価がいちばん安いのは OpenAI の GPT-6 Luna（入力 $0.10／出力 $0.50）です。次に安いのは DeepSeek の `deepseek-flash` をオフピーク時間帯に使う場合（入力 $0.15／出力 $0.60）で、日本時間の平日10:00〜13:00と15:00〜19:00はその2倍になります。

日常の本番処理に使う標準クラスでは、GPT-6 Sol と Claude Sonnet 5 がどちらも入力 $2／出力 $10 で並びます。出力の多い処理なら出力 $6 の Grok 4.7 が安く、2026年中なら Gemini 3.8 Flash（$0.75／$3.75）がさらに安くなります。ただし Gemini 3.8 Flash は2027年1月1日から2倍、GPT-6 は入力27万2,000トークン超でリクエスト全体の単価が上がるため、表の数字だけでは順位は決まりません。

## 主要5社の API 料金一覧（2026年9月26日時点）

価格はすべてモデル提供元の公式ページに載っている通常処理（Standard）の単価で、単位は100万トークンあたりの米ドルです。出典は [OpenAI](https://developers.openai.com/api/docs/pricing)、[Anthropic](https://platform.claude.com/docs/en/about-claude/pricing)、[Google Gemini API](https://ai.google.dev/gemini-api/docs/pricing)、[xAI](https://docs.x.ai/docs/models)、[DeepSeek](https://api-docs.deepseek.com/quick_start/pricing) の料金ページです。請求は米ドル建ての単価で計算されるため、円換算はカード会社や請求時の為替で変わります。ここではドルのまま示します。

階層は各社のラインアップ上の位置づけと価格帯でまとめたもので、品質の順位ではありません。

### 軽量モデル：分類・抽出・短い回答の大量処理

| モデル（提供元） | 入力 | 出力 | キャッシュ入力 | 単価が変わる条件 |
|---|---|---|---|---|
| GPT-6 Luna（OpenAI） | $0.10 | $0.50 | $0.01 | 入力27万2,000トークン超はリクエスト全体が $0.20／$0.75。Batch と Flex は半額 |
| `deepseek-flash`（DeepSeek） | $0.15〜$0.30 | $0.60〜$1.20 | $0.003〜$0.006 | 低い方がオフピーク、高い方がピーク（日本時間の平日10:00〜13:00と15:00〜19:00） |
| Gemini 3.1 Flash-Lite（Google） | $0.25 | $1.50 | $0.025 | 音声入力は $0.50。Batch は半額。無料枠あり |
| Gemini 3.5 Flash-Lite（Google） | $0.30 | $2.50 | ― | Batch は半額 |
| Claude Haiku 4.5（Anthropic） | $1 | $5 | $0.10 | Batch は半額 |

### 標準モデル：日常の本番処理

| モデル（提供元） | 入力 | 出力 | キャッシュ入力 | 単価が変わる条件 |
|---|---|---|---|---|
| Gemini 3.8 Flash（Google） | $0.75 | $3.75 | $0.075 | 2026年12月31日までの価格。2027年1月1日から $1.50／$7.50。出力は思考トークンを含む。無料枠あり |
| `deepseek-v4-pro`（DeepSeek） | $0.66〜$1.32 | $1.98〜$3.96 | $0.022〜$0.044 | 低い方がオフピーク、高い方がピーク |
| Grok 4.7（xAI） | $2 | $6 | $0.50 | コンテキストは50万トークン。プロンプトが20万トークン以上になるとリクエスト全体が $4／$12（キャッシュ入力 $1）。Batch 非対応、Priority は2倍 |
| GPT-6 Sol（OpenAI） | $2 | $10 | $0.20 | 入力27万2,000トークン超はリクエスト全体が $4／$15。Batch と Flex は半額、Fast mode は2倍 |
| Claude Sonnet 5（Anthropic） | $2 | $10 | $0.20 | 100万トークンまで同じ単価。Batch は半額 |
| Gemini 3.1 Pro Preview（Google） | $2 | $12 | ― | 20万トークンを超えるプロンプトは $4／$18。Batch は半額 |

Grok 4.7 は xAI が主力（フラッグシップ）と位置づける汎用モデルですが、単価はこの階層と同じ水準なので、ここに並べています。

### 上位モデル：重い推論や長時間のエージェント処理

| モデル（提供元） | 入力 | 出力 | キャッシュ入力 | 単価が変わる条件 |
|---|---|---|---|---|
| Claude Opus 5.5（Anthropic） | $4 | $20 | $0.20 | Fast mode は $8／$40。Batch は半額 |
| GPT-6 Astra（OpenAI） | $10 | $50 | $1 | 入力27万2,000トークン超はリクエスト全体が $20／$75。Batch と Flex は半額、Fast mode は2倍 |
| Claude Fable 5.1（Anthropic） | $10 | $50 | $0.25 | Batch は半額 |

上位モデルの中では Opus 5.5 が入出力とも Astra と Fable 5.1 の4割の単価です。Claude の各モデルの細かい条件は [Claude Fable 5.1のAPI料金](https://blog.laozhang.ai/ja/posts/claude-fable-5-1-api-pricing)、[Claude Opus 5.5の料金と上限リセット権](https://blog.laozhang.ai/ja/posts/claude-opus-5-5-pricing-limit-reset)、[Claude Sonnet 5の現在のAPI料金](https://blog.laozhang.ai/ja/posts/claude-sonnet-5-pricing) で、GPT-6 の3モデルの違いは [GPT-6 Sol・Luna・Astraの違い](https://blog.laozhang.ai/ja/posts/gpt-6-sol-vs-terra-vs-luna-vs-astra) で詳しく扱っています。

## 表の単価を変える6つの条件

同じ単価表を見ていても、次の条件で実際の請求額は大きく変わります。

![期間限定価格、長文の割増、DeepSeek の時間帯、キャッシュ、処理モード、トークン数と地域指定の6つの条件で API 単価が上下する仕組みをまとめた図](https://blog.laozhang.ai/posts/ja/cheapest-llm-models/img/price-change-conditions.webp)

### 期間限定価格：Gemini 3.8 Flash は年明けに2倍

Gemini 3.8 Flash の $0.75／$3.75 は、Google の料金ページで「2026年12月31日まで」と明記された価格です。2027年1月1日からは入力 $1.50／出力 $7.50、キャッシュは $0.075 から $0.15、キャッシュの保存料も100万トークン・1時間あたり $0.50 から $1.00 に上がります。年をまたいで使う予算は、2027年の単価で組んでおくのが安全です。

### 長文コンテキストの割増：27万2,000トークンと20万トークンが境目

長い資料をまとめて渡す処理では、各社の扱いがはっきり分かれます。

- **OpenAI の GPT-6**：入力が27万2,000トークンを超えると、超えた分だけでなくリクエスト全体の入力とキャッシュが2倍、出力が1.5倍になります。
- **Google の Gemini 3.1 Pro Preview**：20万トークンを超えるプロンプトは $4／$18 になります。
- **xAI の Grok 4.7**：プロンプトが20万トークンに達すると、リクエスト全体が入力 $4／出力 $12（キャッシュ入力 $1）になります。
- **Anthropic の Claude 4.6 以降**：Fable 5.1、Opus 5.5、Sonnet 5 は100万トークンのコンテキスト全体を通常の単価で使えます。

40万トークン入力・5,000トークン出力のリクエスト1件で計算すると、差がよく分かります。

| モデル | 計算式 | 1件あたり |
|---|---|---|
| Claude Sonnet 5 | 0.4 × $2 + 0.005 × $10 | $0.85 |
| GPT-6 Sol | 0.4 × $4 + 0.005 × $15 | $1.675 |
| Gemini 3.1 Pro Preview | 0.4 × $4 + 0.005 × $18 | $1.69 |

Sol と Sonnet 5 は通常の単価がまったく同じですが、この長さでは Sol が約2倍になります。Sol を通常単価のまま計算すると $0.85 になり、請求額を半分に見積もってしまいます。

### DeepSeek の時間帯：日本時間の平日昼間はピーク料金

DeepSeek はピーク時間帯とオフピーク時間帯で単価が異なり、オフピークはピークの半額です。公式ページのピーク時間は UTC の平日01:00〜04:00と06:00〜10:00（中国の祝日を除く）で、日本時間では平日の10:00〜13:00と15:00〜19:00にあたります。週末と中国の祝日は終日オフピークです。

日本の業務時間に処理が集中するなら、表の高い方の単価で見積もる必要があります。夜間バッチなど時間をずらせる処理は、低い方の単価に近づけられます。ピーク時間の細かい換算は [DeepSeek V4のAPI料金](https://blog.laozhang.ai/ja/posts/deepseek-v4) にまとめています。なお、旧モデル名 `deepseek-v4-flash` は現在も受け付けられますが、処理は DeepSeek-V4.1-Flash が行い、`deepseek-flash` の料金で課金されます。

### キャッシュ：同じ前置きを何度も送るなら単価が1桁下がる

システム指示や参照資料など、毎回同じ前半部分を送る処理では、キャッシュ入力の単価が効きます。DeepSeek Flash のキャッシュヒットはオフピーク $0.003、GPT-6 Luna のキャッシュ入力は $0.01 で、通常の入力単価の1割以下です。

ただし、キャッシュの課金方法は各社で異なります。OpenAI の GPT-6 はキャッシュ書き込みにも単価があり（Luna $0.125、Sol $2.50、Astra $12.50）、Claude は5分キャッシュの書き込みが通常入力の1.25倍です。Gemini 3.8 Flash はキャッシュ入力とは別に保存時間に応じた料金がかかります。キャッシュヒット率が低い処理では、書き込みの分だけ高くなることもあります。

### Batch・Flex・Fast mode：待てるかどうかで半額にも2倍にもなる

OpenAI、Anthropic、Google はいずれも非同期の Batch 処理を通常の半額で提供しています。xAI の Grok 4.7 は Batch に対応していないため、この割引は使えません。OpenAI の Flex も半額ですが、応答時間や可用性と引き換えの価格です。夜間の一括分類や記事の下書き生成のように、すぐ結果が要らない処理は半額の単価で見積もれます。

逆に、OpenAI の Fast mode（2026年7月30日に Priority から名称変更）は通常の2倍、Claude Opus 5.5 の Fast mode は $8／$40 です。応答速度のために上位の処理モードを選ぶと、表の単価の2倍前後になります。

### トークンの数え方と地域指定の上乗せ

単価が同じでも、同じ文章が何トークンになるかはモデルごとに違います。Anthropic によると、Claude 4.7 以降のモデルは新しいトークナイザーを使い、同じテキストでも以前の Claude より約30%多くトークン化されます（増え方は内容次第）。GPT-6 Sol と Claude Sonnet 5 のように単価が同じでも、日本語の文書で請求額が同じになるとは限りません。自分の実際のテキストを数件送り、課金対象のトークン数を比べるのが確実です。

データの処理地域を指定する場合は上乗せがあります。OpenAI は2026年3月5日以降に公開された対象モデルの地域指定エンドポイントで10%、Anthropic は Claude 4.6 以降で米国内の推論を指定すると全単価が1.1倍、xAI は米国リージョンのエンドポイントに送ると1.1倍です。

## 月額はいくら？入出力比率で変わる2つの試算

月額の基本式は次のとおりです。

**月額** = 月間入力トークン（100万単位） × 入力単価 + 月間出力トークン（100万単位） × 出力単価

月間トークン数は「月間リクエスト数 × 1件あたりのトークン数」で出せます。下の2つの試算は、キャッシュ、再試行、ツール利用料、Batch を含まない通常単価での計算です。

- **入力中心**：問い合わせ対応や社内文書検索の回答など。1日1万件 × 30日、1件あたり入力1,000トークン・出力100トークンで、月3億入力・3,000万出力。
- **出力中心**：記事やコードの生成など。月2万件、1件あたり入力1,000トークン・出力2,000トークンで、月2,000万入力・4,000万出力。

| モデル | 入力中心（月3億入力・3,000万出力） | 出力中心（月2,000万入力・4,000万出力） |
|---|---|---|
| GPT-6 Luna | $45 | $22 |
| DeepSeek Flash（オフピーク／ピーク） | $63／$126 | $27／$54 |
| Gemini 3.1 Flash-Lite | $120 | $65 |
| Gemini 3.5 Flash-Lite | $165 | $106 |
| DeepSeek V4-Pro（オフピーク／ピーク） | $257.40／$514.80 | $92.40／$184.80 |
| Gemini 3.8 Flash（2026年／2027年以降） | $337.50／$675 | $165／$330 |
| Claude Haiku 4.5 | $450 | $220 |
| Grok 4.7 | $780 | $280 |
| GPT-6 Sol | $900 | $440 |
| Claude Sonnet 5 | $900 | $440 |
| Gemini 3.1 Pro Preview | $960 | $520 |
| Claude Opus 5.5 | $1,800 | $880 |
| GPT-6 Astra | $4,500 | $2,200 |
| Claude Fable 5.1 | $4,500 | $2,200 |

どちらの試算でも GPT-6 Luna が最安で、DeepSeek Flash のオフピークが続きます。一方、その下では順位が入れ替わります。

- 入力中心では Gemini 3.1 Flash-Lite（$120）が DeepSeek Flash のピーク（$126）より安いのに、出力中心では DeepSeek Flash がピークでも $54 で、Flash-Lite の $65 を下回ります。
- DeepSeek V4-Pro はオフピークでも入力中心では Gemini 3.5 Flash-Lite より高いのに、出力中心では $92.40 と逆転します。ピークでも Claude Haiku 4.5 より安くなります。
- Gemini 3.8 Flash の2027年の単価（$675）は入力中心なら Grok 4.7（$780）より安いものの、出力中心では Grok 4.7（$280）が $330 を下回ります。

![入力中心と出力中心の月額試算で、Gemini 3.1 Flash-Lite と DeepSeek Flash のピーク、Gemini 3.8 Flash の2027年の単価と Grok 4.7 の順位が入れ替わることを示す棒グラフ](https://blog.laozhang.ai/posts/ja/cheapest-llm-models/img/monthly-ranking-swap.webp)

理由は出力単価と入力単価の比です。Gemini 3.5 Flash-Lite は出力が入力の約8.3倍、3.1 Flash-Lite は6倍なのに対し、Grok 4.7 と DeepSeek V4-Pro は3倍、DeepSeek Flash は4倍です。出力の多い処理ほど、この比が小さいモデルが有利になります。

自分の用途で見積もるときは、実際のリクエストを数十件記録して1件あたりの入力と出力の平均を出し、月間件数を掛けて上の式に入れてください。見積もりの考え方は [Claude API と OpenAI API の料金比較](https://blog.laozhang.ai/ja/posts/claude-api-vs-openai-api-pricing) でも2社を例に説明しています（価格は2026年5月時点のものです）。

## 用途別に、まず試す1〜2モデル

単価表から分かるのは費用だけで、出力の品質は分かりません。候補を1〜2個に絞り、同じ実データで結果と費用を比べるのが最短です。

| 用途 | まず試すモデル | 選ぶ理由と注意点 |
|---|---|---|
| 大量の分類・抽出・短い回答 | GPT-6 Luna、DeepSeek Flash | 入力中心・出力中心どちらでも最安と次点。DeepSeek は処理が日本時間の平日の日中（ピーク時間帯）に集中すると2倍 |
| Gemini API で安く始めたい | Gemini 3.1 Flash-Lite | 軽量モデルでは Google 内で最安。出力が長い処理では DeepSeek Flash のほうが安い |
| 記事・コードなど出力の多い生成 | DeepSeek V4-Pro、Grok 4.7 | 出力単価が低い。同じ標準クラスの Sol・Sonnet 5 は出力 $10 |
| 2026年中の検証や試作 | Gemini 3.8 Flash | 標準クラスで年内は安いが、2027年1月1日から2倍になる前提で本番予算を組む |
| 27万トークンを超える長い資料 | Claude Sonnet 5 | 100万トークンまで同じ単価。GPT-6 Sol は同じ条件でリクエスト全体が割増 |
| 品質を最優先する難しいタスク | Claude Opus 5.5 | 上位モデルでは単価が最も低い。Astra・Fable 5.1 との差が品質に見合うかは実データで判断 |

安いモデルで不合格が多い場合は、再試行や人の手直しの費用が増え、1段上のモデルのほうが結果的に安くなることがあります。比べるときは単価ではなく「使える出力1件あたりの費用」で見てください。

## 無料枠・比較サイト・中継サービスの価格の扱い

Gemini API は料金ページに Free tier の列があり、Gemini 3.8 Flash と 3.1 Flash-Lite は入出力とも無料です。ただし Free tier で送った内容は Google の製品改善に使われ、有料の Paid tier では使われません。顧客データや社内文書を扱うなら、試作の段階から有料枠で検証するほうが安全です。レート制限など無料枠の詳しい条件は [無料AI APIのおすすめ：上限・学習利用・カード要否で選ぶ](https://blog.laozhang.ai/ja/posts/free-ai-api-tiers-compared) を、Gemini の API キーと課金の設定は [Gemini APIキーは購入する？料金・課金・安全な選び方](https://blog.laozhang.ai/ja/posts/gemini-api-pricing) を参照してください。

料金比較サイトや計算ツールは候補を探すには便利ですが、旧世代のモデルの行が残っていたり、再販業者の価格や終了日のない期間限定価格が載っていたりすることがあります。支払う前には、上に挙げた各社の公式料金ページで同じモデル ID の行を確かめてください。

OpenAI 互換の中継サービスや再販サービスの価格は、モデル提供元の公式価格とは別の契約です。単価だけでなく、課金単位、失敗したリクエストの扱い、レート制限、返金、データの取り扱いを個別に確認する必要があります。比べ方は [最安の LLM API プロバイダー](https://blog.laozhang.ai/ja/posts/cheapest-llm-api-provider) で扱っています。

## API キーを作る前の確認リスト

1. 使うモデル ID が公式料金ページの行と一致しているか（`deepseek-flash`、`gpt-6-luna` など）。
2. 見積もりの単価が通常処理か、Batch・Flex・Fast mode か。
3. Gemini 3.8 Flash の期間限定価格のように終了日がある単価ではないか。
4. 1件あたりの入力が27万2,000トークン（GPT-6）や20万トークン（Gemini 3.1 Pro、Grok 4.7）の割増ラインに届かないか。
5. DeepSeek を使う場合、処理が日本時間の平日10:00〜13:00、15:00〜19:00に集中しないか。
6. 無料枠のデータ利用条件と、地域指定による上乗せが自分の要件に合うか。
7. 月額の上限や利用額のアラートを設定したか。

## よくある質問

### DeepSeek の API 料金はいくらですか？

2026年9月26日時点で、`deepseek-flash` は100万トークンあたり入力 $0.15／出力 $0.60（オフピーク）、$0.30／$1.20（ピーク）です。上位の `deepseek-v4-pro` は入力 $0.66／出力 $1.98（オフピーク）、$1.32／$3.96（ピーク）です。ピークは日本時間の平日10:00〜13:00と15:00〜19:00で、キャッシュヒットした入力は Flash で $0.003〜$0.006 まで下がります。料金は入金済みの残高から差し引かれます。

### 生成 AI API の利用料は月いくらくらいが目安ですか？

用途とモデルで100倍ほど変わります。1日1万件の問い合わせ対応（1件あたり入力1,000・出力100トークン）なら、GPT-6 Luna で月 $45、GPT-6 Sol や Claude Sonnet 5 で月 $900、GPT-6 Astra や Claude Fable 5.1 で月 $4,500 です。自分の件数と1件あたりのトークン数を上の式に入れると目安が出せます。

### OpenAI API の料金はいくらくらいですか？

GPT-6 の3モデルは、100万トークンあたり Luna が入力 $0.10／出力 $0.50、Sol が $2／$10、Astra が $10／$50 です。Batch と Flex は半額、Fast mode は2倍、入力27万2,000トークン超はリクエスト全体が割増になります。Astra の細かい計算は [GPT-6 Astra API料金](https://blog.laozhang.ai/ja/posts/gpt-6-astra-api-pricing) で扱っています。

### GPT-6 Sol と Claude Sonnet 5 は同じ料金ですか？

通常の単価はどちらも入力 $2／出力 $10、キャッシュ入力 $0.20 で同じです。違いが出るのは長い入力で、27万2,000トークンを超えると Sol はリクエスト全体が $4／$15 になり、Sonnet 5 は100万トークンまで $2／$10 のままです。また Claude は同じ文章でもトークン数が多めに数えられるため、実際のテキストで比べる必要があります。

### Grok API は高いですか？

Grok 4.7 は入力 $2／出力 $6 で、入力は Sol や Sonnet 5 と同じですが、出力が4割安い水準です。出力の多い処理ほど有利になり、月2,000万入力・4,000万出力の試算では $280 と、Sol・Sonnet 5 の $440 を下回ります。キャッシュ入力は $0.50 ですが、プロンプトが20万トークン以上になるとリクエスト全体が $4／$12 に上がり、Batch 割引もありません。詳しくは [Grok API 料金ガイド 2026](https://blog.laozhang.ai/ja/posts/xai-grok-api-pricing) を参照してください。
