メインコンテンツへスキップ

Gemini 3.8 Flash 導入ガイド:料金、モデル ID、3.7 からの移行

Gemini 3.8 Flash は本番候補として試せますが、3.7 と同じ単価でも請求額が同じとは限りません。合格率、token、遅延、tool call を測り、Cyber は Fairwind の別枠として判断します。

LaoZhang AI Team公開更新 8 分で読めます
目次
Gemini 3.8 Flash の料金確認から 3.7 の段階移行、Flash Cyber の利用条件までを示す判断図

Gemini 3.8 Flash は 2026 年 9 月 2 日に公開され、Gemini Developer API では gemini-3.8-flash という安定版 ID で利用できます。新規システムなら最初の本番候補にできます。すでに 3.7 を運用している場合は、一斉切り替えではなく、いつでも戻せる比較対象として導入するのが安全です。

3.8 と 3.7 は 2026 年末まで同じ token 単価です。しかし Google は、3.8 が難しい仕事で推論を細かく進め、tool call を重ねるため、より多くの token を使う場合があると説明しています。同じ単価でも、1 件の処理に必要な token、待ち時間、再試行回数は同じとは限りません。

同時に発表された Gemini 3.8 Flash Cyber も区別が必要です。これは通常の API カタログに追加された一般公開モデルではなく、Fairwind Program で承認された防御組織向けです。

まず固定すべき公開モデルの仕様

2026 年 9 月 3日時点のモデル仕様では、3.8 Flash は GA で、入力上限 1,048,576 tokens、出力上限 65,536 tokens です。テキスト、画像、動画、音声、PDF を入力でき、出力はテキストです。

Thinking は low、medium、high に対応し、既定値は medium。minimal を渡すとエラーになります。function calling、code execution、caching、file search、structured outputs、Search/Maps grounding、URL context などに対応します。一方、computer use は Preview で、画像生成、音声生成、Live API には対応しません。

「画像を読める」と「画像を生成できる」は別の能力です。画像出力やリアルタイム音声が必要なら、その用途を持つ別モデルを選びます。

廃止予定一覧には、gemini-3.8-flash と gemini-3.7-flash の shutdown date がまだありません。永続保証ではありませんが、3.7 は現在も効率重視の処理と切り戻しに使える正式な選択肢です。

料金表は同じでも、処理単価は測り直す

Gemini Developer API の公式料金は次の通りです。

処理方式2026 年 12 月 31 日まで2027 年 1 月 1 日以降
Standard 入力$0.75 / 100 万 tokens$1.50 / 100 万
Standard 出力$3.75 / 100 万$7.50 / 100 万
Batch/Flex 入力$0.375 / 100 万$0.75 / 100 万
Batch/Flex 出力$1.875 / 100 万$3.75 / 100 万

出力料金には thinking tokens も含まれます。context caching の保存、Priority、Search grounding、Maps grounding には別の料金があります。これは Developer API の USD 価格であり、Vertex AI、企業契約、税金、為替、第三者経由の料金ではありません。

入力 50,000 tokens、thinking を含む出力 8,000 tokens の Standard リクエストなら、2026 年末までは約 $0.0675 です。

(50,000 × $0.75 + 8,000 × $3.75) / 1,000,000

3.8 の出力と thinking が 14,000 tokens になれば $0.09 です。ただし 3.7 で 2 回必要だった処理が 1 回で合格するなら、総額は下がる可能性があります。比較すべき指標は「全リクエスト費用 ÷ 修正なしで採用できた件数」です。

3.7 の実装を壊さずに切り替える

現行の Gemini 3 要件を守っている 3.7 アプリなら、実際の変更はモデル名だけで済む場合があります。

bash
GEMINI_MODEL=gemini-3.8-flash

ただし、canary の前に公式の移行 checklistを確認します。temperature、top_p、top_k、candidate_count を generation config から外し、thinking_budget は文字列の thinking_level に置き換えます。多ターン処理はサーバー側の previous_interaction_id を使い、model turn を事前に埋めません。

Function calling では payload と thought signature を確認します。generateContent API を使う場合、各 FunctionResponse に call_id と name が必要です。tool 実行前の文が Malformed_Function_Call を起こすなら、形式を直し、単純な再試行で隠さないようにします。

これらはすべて 3.8 で新しく壊れた項目ではありません。整備された 3.7 実装なら、すでに満たしているものが多いはずです。それでも古い互換処理や gateway が廃止済み field を追加していないか確認する価値があります。

設定には gemini-3.7-flash も切り戻し値として残します。受け入れテストでは gemini-flash-latest のような自動更新 alias を使わず、結果を再現できる正確な ID を固定します。

正確なモデル ID、同一タスク比較、少量 canary、切り戻しをつなぐ Gemini 3.8 Flash 移行図

移行の可否を決める小さな検証

普段の成功例だけでなく、最近失敗した処理と、失敗時の影響が大きい境界例を選びます。両モデルで prompt、入力、tool schema、timeout、retry、thinking level をそろえ、次を記録します。

  • 人の修正なしで採用できた割合
  • tool の選択と引数が正しい割合
  • 入力、出力、thinking の token 数
  • 最初の token までの時間と処理全体の時間
  • 形式エラー、安全上の拒否、再試行
  • 採用できた結果 1 件あたりの総費用

オフライン比較か shadow 実行に合格したら、条件に合う本番トラフィックの一部だけを 3.8 に送ります。合格率が現行を下回らず、tool error が増えず、P95 遅延と費用が予算内に収まる場合だけ割合を広げます。

長期間のソフトウェア開発、多段階の自律 agent、複雑な専門業務は 3.8 の利点を検証しやすい用途です。短い分類や大量の抽出で 3.7 が基準を満たすなら、そのまま残して構いません。必要なら 3.8 を thinking_level: "low" で再評価します。

一般公開の Gemini 3.8 Flash と Fairwind 限定の Flash Cyber を分ける利用条件図

Flash Cyber は申請資格から考える

Google の Fairwind Program は、政府・国家レベルの cyber 当局、重要インフラ運営者、広く使われる技術基盤、守りを目的とする academic lab などを優先する限定プログラムです。組織の security history と倫理的な運用実績が審査され、承認や回答時期は保証されません。

承認された組織は Gemini 3.8 Flash Cyber を単体、または CodeMender とともに使えます。ただしアクセスを与えられるのは社内の cybersecurity、incident response、penetration testing team に限られます。個人単位の認証、phishing-resistant MFA、access control、利用記録も必要です。

許可された threat simulation、reverse engineering、malware analysis は、防御または学術研究が目的の場合に限られます。malware 作成などの悪意ある用途は許可されません。またアクセスの共有、転売、再配布は禁止されています。

したがって、gemini-3.8-flash-cyber を一般公開 API の確認済み ID として扱うことはできません。通常の 3.8 料金表を Cyber に当てはめることもできません。対象外の組織には、Google は公開モデルと CodeMender、AI Threat Defense 製品を案内していますが、それぞれの地域、契約、価格は別途確認が必要です。

導入判断を一文でまとめると

新規システムは gemini-3.8-flash を最初に評価し、既存 3.7 は設定監査、同一タスク比較、shadow、少量 canary の順で移します。採用できる成果、tool の信頼性、遅延、総費用が基準に達したときだけ広げます。

簡単で費用に敏感な処理を 3.7 に残すのは、現在も有効な設計です。Gemini 3.8 Flash Cyber が必要なら、探すべきものは隠し ID ではなく、組織が Fairwind の防御目的と管理要件を満たすかどうかです。

Gemini 3.5 Flashの判断ボード。model ID、公式ステータス、得意な用途、避ける用途、価格注意点を示す
Gemini と Google AI

Gemini 3.5 Flashの性能評価:公式API ID、得意分野、制限、移行判断

Gemini 3.5 Flashは`gemini-3.5-flash`として公式に呼び出せる。エージェント型コーディング、長いツールワークフロー、マルチモーダル入力理解に強い一方、画像生成、音声生成、Live API、Computer Use、最安バッチ処理には向かない。

12 分
現行モデル経路、料金帯、AI Studio を中心に整理した Gemini 3.1 Pro API ガイド
Gemini と Google AI

Gemini 3.1 Pro API ガイド: 導入、料金、制限、移行ポイント (2026)

Gemini 3.1 Pro API は、長いコンテキスト、マルチモーダル入力、ツールを使う開発ワークフロー向けの有料 preview モデルです。このガイドでは、今使うべき model ID、最短の導入手順、実際の料金と制限、そして `gemini-3-pro-preview` 停止後に何が変わったかを整理します。

20 分