# OpenRouter 替代和免费模型：限额、费用与国内怎么换

> OpenRouter 免费模型每天 50 次，充 $10 后 1,000 次，但要境外卡加手续费；替代按触发条件分三类：托管中转、直连有免费层的厂商、自建 LiteLLM。

- URL: https://blog.laozhang.ai/zh/posts/openrouter-alternatives-free-models
- Published: 2026-09-27
- Updated: 2026-09-27
- Author: LaoZhang AI Team (https://blog.laozhang.ai/zh/about)
- Category: API 指南
- Tags: OpenRouter, 免费模型 API, AI API 聚合平台, LiteLLM, Vercel AI Gateway

---
OpenRouter 的免费模型能不能继续用，取决于你撞上的是哪一条限制。截至 2026 年 9 月 27 日，模型 ID 带 `:free` 后缀的免费变体对所有账户限每分钟 20 次请求；累计充值不到 $10 的账户每天 50 次，累计充值达到 $10 后每天 1,000 次。这个 $10 是一次性的累计购买门槛，不是订阅，但充值只接受境外信用卡和加密货币，并按 5.5%（最低 $0.80）收手续费。

如果你只是每天 50 次不够，最省事的办法是充一次 $10（实付约 $10.80）；如果卡住你的是支付方式、直连稳定性、免费端点可能拿你的数据训练，或者你想自己控制路由和预算，那就不是充值能解决的，需要换成另外三类方案之一：托管中转（Vercel AI Gateway、Requesty、Cloudflare AI Gateway）、直连有免费层的厂商（Gemini、Groq、智谱、硅基流动），或自建 LiteLLM 网关。这三类的"免费"含义完全不同，下面按触发条件逐一对应。

## OpenRouter 的免费到底受哪几条规则限制

OpenRouter 的免费有两种入口，规则相同但用法不同。

**指定模型的 `:free` 变体**：比如截至 2026 年 9 月 26 日仍存在的 `openai/gpt-oss-120b:free`。哪些模型带 `:free` 每周都在变，以官方免费合集页（openrouter.ai/collections/free-models）当天显示为准。

**免费模型路由 `openrouter/free`**：把 model 写成这个 ID，OpenRouter 会从当前可用的免费模型里随机挑一个，并按你请求需要的能力（图像理解、工具调用、结构化输出）先过滤；响应元数据里会写明实际是哪个模型回答的。官方文档同时提醒：免费模型的速率限制可能更低、可用性会波动、高峰期延迟更高，而且你无法控制选中哪一个。需要固定某个模型时，用它的 `:free` 后缀，而不是这个路由。

两种入口共用同一套限额，官方限额页（openrouter.ai/docs/api-reference/limits）的规则是：

| 累计充值 | 每分钟 | 每天 | 说明 |
|---|---|---|---|
| 不到 $10 | 20 次 | 50 次 | 新账户默认档 |
| 达到 $10 | 20 次 | 1,000 次 | 文档注明从 9 积分起就给这一档，用来吸收手续费和取整 |

三条容易被忽略的附带规则：

- **多账号、多 key 没用**。文档原话是额外账户或 API key 不会改变你的速率限制，因为容量是全局治理的。
- **余额为负会拿到 402，包括调用免费模型时**。402 是余额问题，不是限额问题，充值到非负即可。
- **计数可以自己查**。`GET https://openrouter.ai/api/v1/key` 返回的 `free_model_daily_requests` 字段里有 `used`、`limit`、`remaining` 三个值，就是你今天的免费请求计数和上限；每分钟那一档不在这里报告。自带厂商 key 的请求和被豁免的账户不受这个计数约束。

429 和 402 要分开处理。429 有两个来源：OpenRouter 自己的平台限制（免费模型的每分钟或每天上限、DDoS 防护），这时错误响应带 `X-RateLimit-Limit`、`X-RateLimit-Remaining`、`X-RateLimit-Reset` 头；或者上游厂商在限流或满载，这时 `error.metadata.provider_code` 会带厂商原始错误码，OpenRouter 会先自动尝试同一模型的其他厂商。官方给免费变体的解法只有两条：累计充到 $10 提高每天上限，或者切到同模型的付费变体，付费变体没有平台级的请求次数上限。

## 费用出在哪一步：充 $10 实际付多少

OpenRouter 的费用在充值那一刻收，不按 token 加价。用信用卡（Stripe）充值收 5.5%，最低 $0.80；用加密货币（Coinbase）充值收 5%。按最低收费反推，充值金额低于 $0.80 ÷ 5.5% ≈ $14.55 时，实际付的都是 $0.80 这个下限：

- 充 $10：手续费 max(10 × 5.5%, 0.80) = $0.80，实付约 $10.80
- 充 $20：手续费 20 × 5.5% = $1.10，实付约 $21.10

充进去的积分官方保留一年后过期的权利；未使用的积分只能在交易后 24 小时内申请退款，平台手续费不退，加密货币充值永不退款。新用户注册会得到一笔"少量免费额度"用于试用，官方没有公布金额。

国内读者还有三项额外条件。CSDN 一篇 2026 年 8 月 20 日发布的四平台横评把 OpenRouter 的支付方式记为"仅境外信用卡、加密货币"，发票一栏是"不支持国内发票、对公结算"，网络一栏是"国内直连延迟 800ms 以上，频繁超时"；800 ms 是该作者单次测量，当作一位测评者的观察而不是常数。如果你需要国内发票或对公结算，OpenRouter 本身就不满足，直接看下面的国内路线。

比较替代方案的费用时，先把口径对齐，"5%"在不同平台指的是不同的事：

| 方案 | 费用发生在哪一步 | 口径 |
|---|---|---|
| OpenRouter | 充值时 | 5.5%（最低 $0.80）或加密货币 5%；token 按厂商标价，不另加价 |
| Requesty | 每次调用 | 在厂商价格上加 5%（官方例子：OpenAI 标价 $10 / 百万 token 的模型经 Requesty 为 $10.50） |
| Vercel AI Gateway | 无网关费 | token 零加价、无平台费，包括自带 key；支付处理费由用户承担 |
| Cloudflare AI Gateway | 只在用统一计费时 | 通过它购买的积分收 5%；自带各厂商 key 时网关本身免费 |
| LiteLLM 自建 | 无网关费 | 服务器、维护和各厂商的 key 都是你自己的成本 |

![OpenRouter、Requesty、Vercel AI Gateway、Cloudflare AI Gateway 与自建 LiteLLM 的费用发生点对比：充值时 5.5%、每次调用加 5%、零加价、统一计费 5%、自担服务器](https://blog.laozhang.ai/posts/zh/openrouter-alternatives-free-models/img/fee-point-compare.webp)

## 免费模型的数据去了哪

OpenRouter 上每个模型端点都标有厂商的日志与训练政策。账户设置里可以关闭"路由到可能拿数据训练的厂商"，而且付费模型和免费模型是两个独立的开关。官方还写明：当无法确认某个厂商或端点的政策时，采取保守立场，假设该端点既保留也训练你的数据。免费合集页上的提示就是例子，比如 Laguna S 2.1 的免费端点旁写着免费使用时可能用你的输入输出来训练和改进模型。

关掉免费模型的训练开关后，有第三方使用指南报告过会遇到 "No endpoints found matching your data policy"，意思是符合你数据政策的免费端点一个都不剩。这个报错是可预期的：很多免费端点之所以免费，就是以数据换算力。

要区分的是，这个开关只管厂商侧，官方明确说它对 OpenRouter 自己怎么处理你的 prompt 没有影响；OpenRouter 自身的 prompt 日志是另一个设置。两个层面都要看，方法见 [大模型 API 数据保留 vs 零数据保留：上线前怎么核验](https://blog.laozhang.ai/zh/posts/llm-api-data-retention-vs-zero-data-retention)。

## 替代分三类，先对触发条件

"OpenRouter 替代"这个说法把三种不同的东西混在了一起：托管中转是别人运营的统一接口，直连是你直接拿厂商的 key，自建网关是你自己运营统一接口。哪一类适合你，看你是被哪个问题触发的：

| 触发条件 | 先做什么 | 对应路线 |
|---|---|---|
| 每天 50 次不够，愿意一次性付 $10 | 充值，实付约 $10.80，每天变 1,000 次 | 留在 OpenRouter |
| 每天 50 次不够，不想付钱 | 换一个还有免费额度的地方 | Requesty 免费层（200 次/天）；直连 Gemini、Groq、智谱、硅基流动 |
| 没有境外卡，或要国内发票、对公 | 换成人民币结算的平台 | 直连智谱、硅基流动、百炼；需要海外闭源模型时用付费中转 |
| 不接受免费端点训练 | 停用免费端点 | OpenRouter 付费变体，或直连有明确数据条款的厂商（Groq、Gemini 付费层） |
| 直连不稳、频繁超时 | 换有国内可达节点的服务 | 国内平台，或有备用域名的付费中转 |
| 想自己控制路由、预算、多 key | 自建 | LiteLLM；或 Cloudflare AI Gateway、Portkey 这类自带 key 的网关 |

![六种触发条件分别对应的替代路线：充值留在 OpenRouter、Requesty 免费层、直连国产平台、付费变体、国内平台、自建 LiteLLM](https://blog.laozhang.ai/posts/zh/openrouter-alternatives-free-models/img/trigger-route-map.webp)

一个常见误解是把 Cloudflare AI Gateway、Portkey 当成"免费模型来源"。它们免费的是网关功能（日志、缓存、限流、预算），模型仍然要你自己拿各厂商的 key 去调，付各厂商的钱；托管中转里真正自带免费模型或免费额度的，是 OpenRouter、Requesty、Vercel，以及 Cloudflare 网关背后 Workers AI 的每日免费额度。

## 托管中转：Vercel、Requesty、Cloudflare 各自免费什么

| 平台 | 免费的是什么 | 门槛 | 接口地址 | 模型 ID 格式 |
|---|---|---|---|---|
| Vercel AI Gateway | 每月含 $5 额度，只覆盖一部分模型，且这部分模型限额更低 | 必须先绑定有效支付方式，否则 403 `customer_verification_required` | `https://ai-gateway.vercel.sh/v1` | `厂商/模型`，实际列表用 `GET /v1/models` 取 |
| Requesty | 免费层每天 200 次请求，可用全部免费模型，不需要信用卡 | 注册即用 | `https://router.requesty.ai/v1` | `厂商/模型` |
| Cloudflare AI Gateway | 网关本身免费（分析、缓存、限流）；Workers AI 每天 10,000 Neurons 免费 | Cloudflare 账户；Workers Free 计划日志总量上限 100,000 条 | `https://gateway.ai.cloudflare.com/v1/账户ID/网关ID/compat` | `厂商/模型`，如 `workers-ai/@cf/meta/llama-3.3-70b-instruct-fp8-fast` |
| Portkey | 开发者版永久免费，每月记录 1 万条日志，超出后请求照常通过但不记录 | 自带各厂商 key | 见其文档 | 不提供免费模型 |

**Vercel AI Gateway** 的免费层是每月固定包含的 $5 额度（官方定价页 2026 年 9 月 8 日更新的表格），不是会过期的试用；文档明确它只覆盖模型目录的一个子集，并对这些模型施加更低的限额，具体哪些模型在目录里按免费层筛选查看。它最容易踩的地方是 403：团队必须先添加有效的支付方式才能动用免费额度。另一个要知道的规则是，一旦购买积分，团队就转到付费层，每月免费额度不再适用；付费层网关侧不再限速，只剩厂商自己的限制；购买的积分一年后过期。零加价这一点对免费层、付费层和自带 key 都成立。

**Requesty** 的免费层是目前门槛最低的一家：200 次/天、不要信用卡、包含路由、缓存、回退和欧盟数据驻留。哪些模型算它的"免费模型"，定价页没有列出，注册后在模型列表里看。它的付费口径是按 token 在厂商价格上加 5%、无最低消费，和 OpenRouter 充值时收费是两回事。按手续费占比算，OpenRouter 充 $10 时的 $0.80 相当于 8%，充得越多越接近 5.5%，但始终高于 Requesty 的 5%；真正的差别在于 OpenRouter 的钱要预付进去、一年后可能过期，Requesty 是用多少付多少。

**Cloudflare AI Gateway** 适合已经在用 Cloudflare 的人。它的 OpenAI 兼容端点用 `厂商/模型` 格式指定模型，用你存在网关里的厂商 key 或自己的 Cloudflare API token 认证，第一次请求时会自动创建名为 `default` 的网关。注意官方已把这个 `compat` 端点标为"单模型调用已弃用"：只调一个固定模型时，官方建议改用 Cloudflare REST API 里的 OpenAI 兼容地址（`api.cloudflare.com/client/v4/accounts/账户ID/ai/v1/chat/completions`）；`compat` 地址对已有集成继续可用，动态路由也仍然走它。免费模型只有一处：Workers AI 在 Free 和 Paid 计划下每天 10,000 Neurons 免费额度，每天 00:00 UTC 重置，超出后需要 Workers Paid，按每 1,000 Neurons $0.011 计费。Neurons 是 Cloudflare 自己的计量单位，不等于 token，每个模型换算不同；部分较新的模型要求绑定付费账单方式才能用。

国内还有一批叫"聚合平台"或"中转"的服务。上面提到的 CSDN 横评把 New.bi、CatRouter 和 OpenRouter、硅基流动放在一起比，前两家的资质、限额和数据政策目前只有该测评一个来源，还不足以作为选型依据；硅基流动作为国产平台的免费模型见下一节。

## 直连厂商：免费额度真实存在的地方

直连没有中转那一层，也没有 $10 门槛，代价是每家一把 key、一套限额、一份数据条款。第一把免费 key 按条件怎么选，[免费 AI API 推荐：国内外平台怎么选，额度用完会怎样](https://blog.laozhang.ai/zh/posts/free-ai-api-tiers-compared) 有完整的按平台比较，这里只列和 OpenRouter 免费模型直接对应的几家。

**Gemini API 免费层**：输入输出 token 免费，但条款写明免费层内容会用于改进 Google 的产品，付费层不会。限额按项目而不是按 key 计，具体数字只在 Google AI Studio 里看，每天的额度在太平洋时间零点重置。Gemini API 的可用地区列表不包含中国大陆，界面语言是中文不等于地区可用，可用性以该列表为准。哪些模型还免费、去哪看实时限额，见 [Gemini API 免费层速率限制 2026：哪些还免费、去哪看实时限额、为什么多个 Key 共享同一额度](https://blog.laozhang.ai/zh/posts/gemini-api-free-tier)。

**Groq Free Plan**：限额在组织层面，例如 `openai/gpt-oss-120b` 为 30 次/分钟、1,000 次/天、8K token/分钟、200K token/天，超出返回 429 并带 `retry-after` 头。服务协议写明 Groq 不会把你的输入输出用于提供服务之外的目的，这一点比 OpenRouter 上来源不明的免费端点清楚。它的地区可用性在公开文档里没有记载。

**国产平台**：智谱开放平台的 GLM-4.7-Flash 输入、输出、缓存全部免费，注意同样叫 Flash 的 GLM-5.3-Flash 是付费模型；硅基流动定价页标"免费"的是 Qwen3-8B、GLM-4-9B 这一档的小模型，旗舰模型都收费；阿里云百炼给新用户每个模型通常 100 万 token 的免费额度，只限华北 2（北京）地域，90 天内有效。三家都用人民币、微信或支付宝结算，是"没有境外卡"这个触发条件下最直接的答案。

**已经不免费或从未免费的几家**：GitHub Models 自 2026 年 7 月 30 日起完全退役，游乐场、模型目录、推理 API 全部下线；Cerebras 官方文档明确"没有永久免费层"，$5 试用积分要先绑定支付方式；DeepSeek 没有公开免费层，但 `deepseek-flash` 空闲时段 $0.15 / $0.60 每百万 token 的价格是免费额度用完后成本最低的补充之一，几点便宜见 [DeepSeek API 峰谷价格：几点调用更省、账单怎么算](https://blog.laozhang.ai/zh/posts/deepseek-v4)。

## 自建 LiteLLM：什么时候值得

LiteLLM 是 MIT 许可的开源项目（仓库里 `enterprise/` 目录除外），它的 Proxy Server 用一个 OpenAI 格式的接口统一调用上百家模型，并能按虚拟 key、按用户设预算和统计花费。它的"免费"是没有网关费，不是免费 token：你仍然需要各厂商的 key，仍然为服务器和维护时间付钱。

值得自建的情形有三种：团队要给多个人或多个应用发独立的 key 和预算；你手里已经有多家厂商的免费层或付费 key，想在一个地址后面轮换和回退；你不想在自己和厂商之间再多一个经手 prompt 的中间方。只是个人每天调几十次，自建不划算。

官方 Docker 快速开始用 `docker-compose.quickstart.yml` 启动，必须设置 `LITELLM_MASTER_KEY`，默认监听 4000 端口，模型在 `config.yaml` 的 `model_list` 里声明，key 用 `os.environ/变量名` 的写法从环境变量读取：

```yaml
model_list:
  - model_name: gpt-oss-120b
    litellm_params:
      model: groq/openai/gpt-oss-120b
      api_key: os.environ/GROQ_API_KEY
  - model_name: glm-4.7-flash
    litellm_params:
      model: openai/glm-4.7-flash
      api_base: https://open.bigmodel.cn/api/paas/v4
      api_key: os.environ/ZHIPU_API_KEY
```

启动后客户端把接口地址指到本机即可：

```python
import os
from openai import OpenAI

client = OpenAI(base_url="http://0.0.0.0:4000", api_key=os.environ["LITELLM_MASTER_KEY"])
```

## 改接口地址和模型 ID：同一个客户端切换

所有上面提到的服务都提供 OpenAI 兼容接口，切换只涉及两个值：`base_url` 和 `model`。区别在模型 ID 的写法：OpenRouter 是 `厂商/模型`，免费变体再加 `:free`；Vercel、Requesty、Cloudflare 也是 `厂商/模型`；直连 Gemini、Groq、智谱用厂商自己文档里的 ID（Groq 的 `openai/gpt-oss-120b` 本身就带斜杠，不是中转加的前缀）。下面这段用同一个 OpenAI SDK 客户端切目标，key 全部从环境变量读取：

```python
import os
from openai import OpenAI

TARGETS = {
    # 名称: (接口地址, 存放 key 的环境变量, 模型 ID)
    "openrouter": ("https://openrouter.ai/api/v1", "OPENROUTER_API_KEY", "openai/gpt-oss-120b:free"),
    "openrouter-random": ("https://openrouter.ai/api/v1", "OPENROUTER_API_KEY", "openrouter/free"),
    "vercel": ("https://ai-gateway.vercel.sh/v1", "AI_GATEWAY_API_KEY", "provider/model"),  # 实际 ID 用 GET /v1/models 取
    "requesty": ("https://router.requesty.ai/v1", "REQUESTY_API_KEY", "provider/model"),
    "cloudflare": (  # 单模型调用官方建议改用 REST API 地址，compat 仍可用
        f"https://gateway.ai.cloudflare.com/v1/{os.environ['CF_ACCOUNT_ID']}/default/compat",
        "CF_API_TOKEN",
        "workers-ai/@cf/meta/llama-3.3-70b-instruct-fp8-fast",
    ),
    "litellm": ("http://0.0.0.0:4000", "LITELLM_MASTER_KEY", "gpt-oss-120b"),
    "gemini": ("https://generativelanguage.googleapis.com/v1beta/openai/", "GEMINI_API_KEY", "gemini-3.8-flash"),
    "groq": ("https://api.groq.com/openai/v1", "GROQ_API_KEY", "openai/gpt-oss-120b"),
    "zhipu": ("https://open.bigmodel.cn/api/paas/v4", "ZHIPU_API_KEY", "glm-4.7-flash"),
}

def ask(target: str, prompt: str) -> str:
    base_url, key_var, model = TARGETS[target]
    client = OpenAI(base_url=base_url, api_key=os.environ[key_var])
    resp = client.chat.completions.create(
        model=model,
        messages=[{"role": "user", "content": prompt}],
    )
    print(target, "->", getattr(resp, "model", model))  # openrouter/free 会在这里显示实际选中的模型
    return resp.choices[0].message.content

print(ask("openrouter", "用一句话解释什么是速率限制。"))
```

跑通第一次请求后再看错误：OpenRouter 的 429 看 `X-RateLimit-Reset` 头判断是免费限额还是上游满载，402 去看余额；Vercel 的 403 `customer_verification_required` 是没绑支付方式；Groq 的 429 按 `retry-after` 等待。`base_url` 要写到哪一级、SDK 里参数和环境变量谁优先，见 [OpenAI base_url 怎么改：/v1、优先级与排错](https://blog.laozhang.ai/zh/posts/openai-base-url-override)。在 Claude Code 里切 OpenRouter 或 DeepSeek 的配置项不同，见 [Claude Code 连接 OpenRouter 和 DeepSeek：路线选择、配置与首错排查](https://blog.laozhang.ai/zh/posts/claude-code-openrouter-deepseek)。

## 免费路线什么时候该停

免费路线有四个明确的停止信号：

1. **每天都撞免费上限，又不愿意为 OpenRouter 充 $10**。换到 Requesty 或直连厂商最多再延一段时间，每家的免费层同样有天花板；这时该算的是付费单价，而不是继续找下一家免费的。
2. **数据政策把免费端点全部过滤掉了**。关掉训练开关后看到 "No endpoints found matching your data policy"，就说明免费和你的数据要求不兼容，付费变体或有明确条款的直连是唯一出路。
3. **`openrouter/free` 随机换模型导致输出不稳定**。需要可重复的结果就要固定模型，固定的免费模型可能随时下架，生产环境应当用付费 ID。
4. **需要国内发票、对公结算或稳定的国内访问**。OpenRouter 不提供前两项，第三项也没有国内节点。人民币结算的国产平台是首选；确实需要 GPT、Claude、Gemini 这类海外闭源模型时，可以考虑付费中转，例如 laozhang.ai：OpenAI 兼容接口地址 `https://api.laozhang.ai/v1`，按余额付费，连接失败时有备用域名 `api2.laozhang.ai`，运营方是新加坡的 YingTu Technology Pte. Ltd.，注册和服务可用性采用白名单制（allowlist），需先申请通过，公开页面没有任何注册赠金或"无限量"的承诺。它是付费选项，不属于免费路线。

转付费之后的问题就变成了哪家的单价合适，按任务比价见 [AI API 价格对比：国内外大模型谁最便宜、月费怎么算](https://blog.laozhang.ai/zh/posts/cheapest-llm-models)。

## 常见问题

**OpenRouter 有免费的模型吗？**

有。模型 ID 以 `:free` 结尾的都是免费变体，也可以用 `openrouter/free` 让平台随机选一个。免费变体对所有人限每分钟 20 次；累计充值不到 $10 每天 50 次，达到 $10 后每天 1,000 次。哪些模型带 `:free` 每周都在变，以官方免费合集页当天显示为准。

**充 $10 解锁 1,000 次/天值不值？**

如果你每天稳定超过 50 次又不想换平台，值：这是一次性累计门槛，不是月费，实付约 $10.80。要接受两个条件：积分一年后可能过期；充值后 24 小时内才能退未用部分，且手续费不退。如果你没有境外信用卡或加密货币钱包，这条路走不通，直接看国产平台。

**`openrouter/free` 和 `:free` 有什么区别？**

`:free` 指定某一个免费模型，比如 `openai/gpt-oss-120b:free`；`openrouter/free` 让 OpenRouter 从可用免费模型里随机挑一个，并按你的请求能力过滤，响应里会写明实际用的模型。限额相同。要固定模型用前者，只想有回复用后者。

**国内直连 OpenRouter 稳不稳？**

OpenRouter 没有国内节点，有测评称直连延迟 800 ms 以上、频繁超时，充值也只接受境外信用卡和加密货币。直连不稳时，可用的路线是人民币结算的国产平台，或有国内可达节点的付费中转。

**免费模型会拿我的数据训练吗？**

看端点。OpenRouter 对无法确认政策的端点默认假设"既保留也训练"，免费合集页上不少端点直接标注可能用于训练。账户设置里免费模型的训练开关和付费模型是分开的，关掉后可能没有免费端点可用。想完全避开，就用付费变体或数据条款明确的直连厂商。
