無料AI APIのおすすめ:上限・学習利用・カード要否で選ぶ
継続して使える無料枠の第一候補はGemini APIとGroqです。Geminiの無料枠は入出力が製品改善に使われるため、機密データはGroqか課金済みプロジェクトで扱います。
目次

2026年9月26日時点で、クレジットカードを登録せずに継続して使える無料のLLM APIを1社だけ選ぶなら、Google AI Studioで発行するGemini APIキーが第一候補です。課金アカウントを紐づけていないプロジェクトでもgemini-3.8-flashなどのFlash系モデルや2.5 Proを無料で呼び出せ、OpenAI互換のエンドポイントも用意されています。日本も利用可能地域に含まれます。
ただし、Gemini APIの無料枠で送った入力と生成結果はGoogleの製品改善に使われ、人が読む可能性があります。顧客情報や社外秘のコードを送るなら、規約上、入力と出力を学習に使わないとしているGroqの無料プランか、課金を有効にしたGeminiのプロジェクトを選んでください。複数のモデルを1つのキーで試したい場合はOpenRouterの:freeモデル(1日50回まで)が手軽です。
「ずっと無料」「無制限」のAPIは、自分のマシンで動かすローカル実行を除けばありません。どの無料枠にも回数やトークンの上限があり、提供元の判断で変わります。また、GitHub Modelsは2026年7月30日に完全終了し、Cerebrasには恒久的な無料枠がありません。少し前の情報をもとに設定すると、そもそも動かない点に注意してください。
「無料」には4つの種類がある
同じ「無料API」でも、続く期間と条件がまったく違います。どれを求めているかで、おすすめの提供元も変わります。
| 種類 | 主な例 | 続く期間 | 向いている使い方 |
|---|---|---|---|
| 継続的な無料枠 | Gemini API、Groq、Cloudflare Workers AI、Mistral | 1日・1か月ごとに上限がリセットされる | 学習、個人開発、毎日動かす小さなボット |
| 一度きりのトライアルクレジット | Cerebras、Claude API | 使い切るか期限が来たら終わり | 特定モデルの短期評価 |
| ルーターの無料モデル枠 | OpenRouterの:freeモデル | ルーター側の上限でリセット | 複数モデルの比較、予備の接続先 |
| ローカル実行 | Ollamaなどで公開モデルを動かす | API料金も回数制限もない | 機密データ、量の多い処理(手元のGPUとメモリ次第) |
継続的な無料枠はプロトタイプを毎日動かせますが、量には天井があります。トライアルクレジットは性能の確認には十分でも、使い終われば有料です。ルーターの無料枠は入り口として便利な一方、実際に応答を返すのは上流の提供元で、その提供元自身の無料枠とは別物です。ローカル実行だけは外部の上限がありませんが、動かせるモデルの大きさは手元のハードウェアで決まります。
主な無料AI APIの比較(2026年9月26日時点で確認)
まず、継続して使える無料枠です。上限の数値は、いずれも各社の公式ページで公開されているものです。
| 提供元 | 無料で使えるもの | カード登録 | 公開されている上限 | 入力データの扱い |
|---|---|---|---|---|
| Gemini API | Flash/Flash-Lite系(gemini-3.8-flashなど)、2.5 Pro/Flash/Flash-Lite、Gemma 4、Gemini Embedding 2。3.1 Pro Preview、画像生成(Nano Banana)、Veoは対象外 | 不要。課金アカウントを紐づけないプロジェクトが無料枠になる | モデル別の数値はドキュメントに載っておらず、AI Studioで確認。上限はプロジェクト単位 | 無料枠では製品改善に使われ、人によるレビューもある。課金済みプロジェクトでは使われない |
| Groq 無料プラン | openai/gpt-oss-120b、openai/gpt-oss-20b、qwen/qwen3.8-27bなど | — | 上記3モデルは30 RPM・1,000 RPD・8K TPM・200K TPD。上限は組織単位 | サービス規約で、明示の許可がない限り学習に使わないと定めている |
OpenRouter :free | IDの末尾が:freeのモデル(顔ぶれはよく入れ替わる) | 不要(1日50回まで) | 20 RPM・1日50回。累計10クレジット以上購入していれば1日1,000回 | 実際に処理する上流の提供元ごとに異なる |
| Cloudflare Workers AI | Workers Freeプランに含まれる | — | 1日10,000 Neurons(UTC 0時リセット)。Kimi、GLM、DeepSeekの新しいモデルの一部は有料のみ | — |
| Mistral 無料モード | APIキーの作成と、毎月の利用枠 | — | 数値はアカウントのLimitsページにだけ表示される | — |
| SambaNova Cloud | 支払い方法を登録していないアカウント向けの無料枠 | 不要(未登録のときに適用) | DeepSeek-V3.1、Llama 3.3 70B、gpt-oss-120bで20 RPM・20 RPD・200,000 TPD | — |
| NVIDIA APIカタログ | Developer Programの会員はプロトタイプ用にNIM APIを無料で利用可 | — | 公式FAQに数値の記載なし。本番利用にはNVIDIA AI Enterpriseのライセンスが必要 | — |
| Hugging Face Inference Providers | 無料ユーザーに毎月$0.10分のクレジット | — | 月$0.10(変更の可能性あり) | — |
| Cohere トライアルキー | 評価用のキー | — | 月1,000コール。チャットは1モデルあたり毎分20回 | — |
「—」は、上限や料金の公式ページに記載がない項目です。カード登録やデータの扱いが気になる場合は、登録画面と各社の利用規約で確認してください。
RPMは1分あたり、RPDは1日あたりのリクエスト数、TPM・TPDは1分・1日あたりのトークン数です。いずれか1つでも超えると429エラーが返ります。Cloudflareの「Neurons」はトークンとは別の単位で、モデルごとに1トークンあたりの消費量が違います。
次は、無料だと思われやすいものの、2026年9月時点では条件が異なるものです。
| 提供元 | 実際の条件 |
|---|---|
| Cerebras | 恒久的な無料枠はありません。支払い方法を登録すると$5のクレジットが付与され、30日で失効します。登録しないとAPIが有効になりません |
| GitHub Models | 2026年7月30日に完全終了。Playground、モデルカタログ、推論API、BYOKのいずれも使えません |
| Groqの旧数値 | 無料プランの表に現在Llamaのチャットモデルはなく、「Llama 3.1 8Bで1日14,400回」という数値は今の表にありません |
| DeepSeek | 公開の無料枠はなく、安価な有料APIです(後述) |
| Claude API | 新規ユーザーに少額の無料クレジットがあるだけで、継続的な無料枠はありません |
| OpenAI API | 一律の登録クレジットはありません。条件を満たす組織に、OpenAIとのデータ共有を条件とした毎日の無料トークンがあります |
条件別:最初の1社の決め方
迷ったら、次の4つの条件を上から順に当てはめてください。送るデータの機密性、1日に必要な量、カード登録の可否、必要なモデルの性能です。
| あなたの状況 | 最初の1社 | 理由 |
|---|---|---|
| 学習や個人の検証で、機密性のないデータしか送らない | Gemini API | 無料で使えるモデルの範囲が最も広く、カード不要 |
| 顧客データ、個人情報、社内コードを含む | Groq 無料プラン、または課金済みのGemini | 規約上、学習に使われない |
| 毎日まとまった量を回したい | Groq(公開上限で計画できる)、Geminiは自分のプロジェクトの上限を確認 | 上限が数値で読めないと設計できない |
| 複数のモデルを比べたい | OpenRouterの:freeモデル | 1つのキーで切り替えられる |
| 最上位モデルが必要 | 無料枠では足りない | Gemini 3.1 Pro Previewは無料対象外 |

機密データを送るなら
Gemini APIの追加利用規約では、無料枠を含む「無償サービス」に送った内容と生成結果が、Googleの製品の提供・改善・開発に使われます。人間のレビュー担当者が入力と出力を読む場合があり、機密情報や個人情報を送らないよう明記されています。有償サービス扱いになるのは、有効な課金アカウントに紐づいたCloudプロジェクト経由でAPIを使う場合だけです。同じGeminiでも、課金を有効にすれば条件が変わります。
Groqのサービス規約は、顧客の明示的な許可や指示がない限り、入力と出力を学習やファインチューニングに使わないと定めています。OpenRouterの:freeモデルは、実際にどの提供元が処理するかでデータの扱いが変わるため、モデルごとに確認が必要です。外部に一切出せないデータなら、ローカル実行が唯一の選択肢になります。
量で選ぶなら、回数よりトークン数を計算する
Groqの無料プランはgpt-oss-120bなどで1日1,000リクエストまで送れますが、同時に1日200,000トークン(TPD)と毎分8,000トークン(TPM)の上限もあります。1回あたり入力と出力の合計で2,000トークン使うと仮定すると、次のようになります。
- 1日の上限:200,000 ÷ 2,000 = 100回で、1,000回より先にTPDに達する
- 1分あたり:8,000 ÷ 2,000 = 4回で、30 RPMより先にTPMに達する
1日1,000回を使い切れるのは、1回あたり平均200トークン以下の短いやり取りの場合だけです。長いコンテキストを何度も送るコーディングエージェントやn8nのワークフローは、無料枠を想像以上の速さで使い切ります。Claude CodeからOpenRouterやDeepSeekにつなぐ設定はClaude CodeでOpenRouterとDeepSeekを使う:経路、設定、初回エラー対応で扱っています。
Geminiの無料枠はモデル別の数値が公開されておらず、Google自身も記載の上限は保証されず実際の容量は変わりうるとしています。量を見積もるときは、AI Studioで自分のプロジェクトに表示される値を基準にしてください。詳しくはGemini API無料枠の利用上限 2026:何がまだ無料で、実上限はどこで確認し、キー追加で増えない理由にまとめています。
カードを登録したくないなら
カード登録なしで始められることが公式に確認できるのは、課金アカウントを紐づけないGemini APIのプロジェクト、1日50回までのOpenRouter :free、支払い方法未登録時に適用されるSambaNovaの無料枠です。SambaNovaは1日20回なので、接続確認以上の用途には向きません。Cerebrasは支払い方法の登録が前提なので、カードなしでは使えません。
最初のリクエストを通して、429に備える
Gemini、Groq、OpenRouterはいずれもOpenAI互換のエンドポイントを持っているので、OpenAIの公式Python SDK(pip install openai)だけで3社を呼び分けられます。キーはGoogle AI Studio、GroqCloudのコンソール、OpenRouterの設定画面でそれぞれ発行し、コードには書かず環境変数に入れます。
export GEMINI_API_KEY="..."
export GROQ_API_KEY="..."
export OPENROUTER_API_KEY="..."
# OpenRouterのモデル一覧で、IDの末尾が :free のものを選んで設定
export OPENROUTER_FREE_MODEL="..."次のコードは、上から順に呼び出し、429(レート制限)が返ったら次の提供元に切り替えます。キーが設定されていない提供元は飛ばします。
import os
from openai import OpenAI, RateLimitError
PROVIDERS = [
{
"name": "gemini",
"base_url": "https://generativelanguage.googleapis.com/v1beta/openai/",
"key_env": "GEMINI_API_KEY",
"model": "gemini-3.8-flash",
},
{
"name": "groq",
"base_url": "https://api.groq.com/openai/v1",
"key_env": "GROQ_API_KEY",
"model": "openai/gpt-oss-20b",
},
{
"name": "openrouter",
"base_url": "https://openrouter.ai/api/v1",
"key_env": "OPENROUTER_API_KEY",
"model": os.environ.get("OPENROUTER_FREE_MODEL", ""),
},
]
def ask(prompt: str) -> str:
last_error = None
for p in PROVIDERS:
api_key = os.environ.get(p["key_env"])
if not api_key or not p["model"]:
continue
# SDKの自動リトライを止め、429ならすぐ次の提供元へ
client = OpenAI(base_url=p["base_url"], api_key=api_key, max_retries=0)
try:
resp = client.chat.completions.create(
model=p["model"],
messages=[{"role": "user", "content": prompt}],
)
return f'{p["name"]}: {resp.choices[0].message.content}'
except RateLimitError as e:
print(f'{p["name"]} で429。次の提供元に切り替えます')
last_error = e
raise RuntimeError("すべての提供元で上限に達しました") from last_error
if __name__ == "__main__":
print(ask("無料APIの接続テストです。一言で返事をしてください。"))OpenAI SDKは既定で429を自動的に再試行するため、max_retries=0を指定しないと切り替えまでに待ち時間が生じます。機密データを扱う場合は、リストからGeminiを外すか、課金済みプロジェクトのキーを使ってください。この順番のままだと、最初のリクエストがGeminiの無料枠に送られます。
上限の確認場所とリセット時刻
| 提供元 | 残りの上限を見る場所 | 429のときの手がかり | リセット(日本時間) |
|---|---|---|---|
| Gemini API | Google AI Studioのレート制限ページ(プロジェクトごと) | RPM・TPM・RPDのどれか1つでも超えると発生 | RPDは太平洋時間の0時。夏時間中は16時、冬時間は17時 |
| Groq | レスポンスヘッダーのx-ratelimit-remaining-requests(RPD)とx-ratelimit-remaining-tokens(TPM) | retry-afterヘッダーに待つ秒数が入る | x-ratelimit-reset-requestsヘッダーに残り時間 |
| OpenRouter | GET https://openrouter.ai/api/v1/keyのfree_model_daily_requests | OpenRouter自身か、上流の提供元が返す | UTCの日付が変わる9時 |

OpenRouterでは、次のコマンドで当日の使用回数と上限を確認できます。毎分の上限はここには出ません。
curl https://openrouter.ai/api/v1/key \
-H "Authorization: Bearer $OPENROUTER_API_KEY"APIキーやアカウントを増やしても、無料の上限は増えません。Geminiの上限はプロジェクト単位、Groqは組織単位で、OpenRouterは容量を全体で管理しているため、追加のアカウントやキーは上限に影響しないと明記しています。また、OpenRouterでクレジット残高がマイナスになると、無料モデルでもエラーが返ることがあります。
無料枠をやめるタイミングと次の選択肢
無料枠は、使い方を固めるまでの試作期間のためにあります。次のどれかに当てはまったら、有料への移行を検討する時期です。
- 個人情報や顧客のデータを送る必要が出てきた
- 429の待ち時間が、利用者から見える遅延になっている
- 無料対象外のモデル(Gemini 3.1 Pro Previewや画像生成モデルなど)が必要になった
- 社外の利用者に公開するサービスになった
移行先は大きく3つあります。
- 同じ提供元の有料枠:Geminiなら、プロジェクトに課金アカウントを紐づけるとTier 1になり、入出力が製品改善に使われなくなります。
gemini-3.8-flashの標準料金は、2026年12月31日までは100万トークンあたり入力$0.75・出力$3.75、2027年1月1日からは入力$1.50・出力$7.50です。無料枠で書いたコードをそのまま使えるのが利点です。 - 安価な有料API:DeepSeekは無料枠こそありませんが、
deepseek-flashはオフピーク時に100万トークンあたり入力$0.15(キャッシュミス)・出力$0.6です。ピーク時間帯はUTCの平日1〜4時と6〜10時(中国の祝日を除く)、日本時間では平日の10〜13時と15〜19時にあたり、料金は入力$0.3・出力$1.2に上がります。日本の業務時間と重なるので、夜間のバッチ処理に回すと安く抑えられます。価格と品質の比べ方は最安の LLM API プロバイダー:価格、品質、遅延、Gateway リスクで選ぶで詳しく扱っています。 - APIゲートウェイ:複数社のモデルを1つのOpenAI互換APIとキーでまとめて使う方法です。たとえばlaozhang.aiはベースURL
https://api.laozhang.ai/v1の前払い従量課金で、無料ではなく、公式サイトに登録時クレジットの記載もありません。上流各社の無料枠を引き継ぐものではないので、「提供元ごとにキーと請求を管理したくない」という理由がある場合の選択肢です。
よくある質問
ずっと無料で使える、無制限のAI APIはありますか?
ありません。Gemini APIやGroqのように毎日リセットされる無料枠はありますが、どれも回数やトークン数に上限があり、対象モデルや数値は予告なく変わります。回数の制限を受けないのは、Ollamaなどで公開モデルを自分のマシンで動かす場合だけで、その代わりモデルの大きさと速度は手元のGPUやメモリで決まります。
DeepSeek APIは無料ですか?
公開の無料枠はありません。料金ページには有料の単価だけが載っていて、deepseek-flashはオフピーク時に100万トークンあたり入力$0.15・出力$0.6です。料金は付与された残高から優先して差し引かれる仕組みですが、新規ユーザーへの付与額は公開されていません。
Claude APIやOpenAI APIに無料枠はありますか?
Claude APIは新規ユーザー向けに少額の無料クレジットがあるだけで、継続的な無料枠はありません。購入の流れはClaude APIキーの購入方法:買うのはキーではなく利用クレジットで説明しています。OpenAI APIには一律の登録クレジットがなく、条件を満たす組織がOpenAIとのデータ共有に同意した場合に毎日の無料トークンが付きます。条件と上限はOpenAI APIの無料枠:毎日の無料トークンの条件と上限にまとめています。
画像生成APIも無料で使えますか?
Gemini APIの無料枠では、Nano Bananaを含む画像生成モデルは対象外です。画像生成で無料枠が残っているサービスと条件は、2026年版 無料AI画像生成API: 本当に無料なのはどれかで比較しています。





