# Бесплатный AI API: какой выбрать и что доступно из России

> Из России официально доступен GigaChat API с 365 млн бесплатных токенов; Gemini, OpenAI и Claude Россию не поддерживают. Groq и OpenRouter дают дневные лимиты.

- URL: https://blog.laozhang.ai/ru/posts/free-ai-api-tiers-compared
- Published: 2026-07-02
- Updated: 2026-09-26
- Author: LaoZhang AI Team (https://blog.laozhang.ai/ru/about)
- Category: API Guides
- Tags: Бесплатный AI API, GigaChat API, Gemini API, Groq, OpenRouter, Лимиты запросов

---
Короткий ответ по состоянию на 26 сентября 2026 года зависит от того, где находитесь вы и ваши пользователи:

- **Вы в России и делаете сервис для российских пользователей.** Начните с GigaChat API от Сбера: во Freemium-режиме физлицу выдают 365 млн токенов на 12 месяцев, но генерация идёт в один поток. С 1 сентября 2026 года новых клиентов Сбер направляет оплачивать работу с моделями на cloud.ru, поэтому доступность Freemium проверьте при регистрации.
- **Вы работаете из страны, где доступен Gemini API** (среди них Казахстан, Армения, Грузия, Кыргызстан и Узбекистан), и пользователи тоже там. Бесплатный тариф Gemini даёт самые сильные модели среди бесплатных вариантов, но ваши запросы Google использует для улучшения своих продуктов.
- **Нужно быстро попробовать открытые модели вроде gpt-oss или Qwen.** Groq даёт 1 000 запросов в день на модель, OpenRouter — 50 запросов в день на моделях с `:free`, а после разовой покупки кредитов на $10 — 1 000. Можно ли пользоваться ими из России, выясняйте по их условиям использования до того, как строить на них проект.
- **DeepSeek** бесплатного тарифа не имеет, но стоит от $0,15 за 1 млн входных токенов.
- **Бесплатно и без лимитов** работает только открытая модель, запущенная на своём компьютере или сервере (например, через Ollama). Потолок в этом случае — ваше железо.

Cerebras и GitHub Models бесплатными вариантами больше не являются: у Cerebras остался только пробный кредит после привязки карты, а GitHub Models полностью закрыт 30 июля 2026 года.

## Что на самом деле означает «бесплатно»

Слово «free» на странице тарифов может означать пять разных договорённостей. От этого зависит, выдержит ли бесплатный вариант ваш проект через месяц.

| Вид | Как устроен | Примеры | Для чего годится |
|---|---|---|---|
| Постоянный бесплатный тариф | Лимиты в минуту и в день обновляются, денег не списывают | Gemini API, Groq, SambaNova, Cloudflare Workers AI, Mistral | Прототип, бот для себя, учёба |
| Пакет токенов на срок | Объём выдают один раз, остаток сгорает по сроку | GigaChat API Freemium (12 месяцев) | Долгий пет-проект, если хватает одного потока |
| Пробный кредит или пробный ключ | Небольшая сумма или квота на знакомство, дальше платно; иногда только с картой | Cerebras ($5 на 30 дней после привязки карты), Anthropic, Cohere | Проверить качество модели, но не держать на этом сервис |
| Бесплатные модели у агрегатора | Лимиты задаёт агрегатор, модель обслуживает сторонний провайдер | OpenRouter (`:free`), Hugging Face | Сравнить несколько моделей одним кодом |
| Своя модель | Платите железом и электричеством | Ollama и аналоги | Приватные данные, работа без сети, неограниченное число запросов |

Дешёвый платный API вроде DeepSeek в эту таблицу не попадает, но на практике именно он становится следующим шагом, когда бесплатного перестаёт хватать.

Первое правило выбора отсюда: смотрите не на слово «бесплатно», а на два вопроса. Обновляется ли лимит сам? И что произойдёт, когда он закончится: запрос вернёт ошибку, начнут списываться деньги или аккаунт просто остановится?

## Бесплатные тарифы: сводная таблица

Лимиты указаны по состоянию на 26 сентября 2026 года по официальной документации каждого сервиса. RPM — запросов в минуту, RPD — запросов в день, TPM и TPD — токенов в минуту и в день.

| Сервис | Что бесплатно | Опубликованный лимит | Главные оговорки |
|---|---|---|---|
| GigaChat API (Сбер), физлица | Freemium-режим: модели Lite, Pro, Max, Ultra | 365 млн токенов на 12 месяцев: 250 млн Lite, 40 млн Pro, 25 млн Max, 50 млн Ultra | Один поток генерации; новых клиентов с 1 сентября 2026 года направляют на cloud.ru |
| Gemini API (Google AI Studio) | Модели Flash и Flash-Lite, Gemini 2.5 Pro, Gemma 4 | По моделям публикуется только в AI Studio; лимит считается на проект, а не на ключ | Россия не поддерживается; запросы идут на улучшение продуктов Google; 3.1 Pro Preview, картинки и видео только платно |
| Groq | `openai/gpt-oss-120b`, `openai/gpt-oss-20b`, `qwen/qwen3.8-27b` | На каждую модель: 30 RPM, 1 000 RPD, 8 000 TPM, 200 000 TPD | Лимиты на всю организацию; бесплатных моделей для чата всего три |
| OpenRouter | Модели с суффиксом `:free` | 20 RPM и 50 RPD; 1 000 RPD, если за всё время куплено от 10 кредитов | Новые ключи и аккаунты лимит не увеличивают; набор `:free`-моделей часто меняется |
| SambaNova Cloud | DeepSeek-V3.1, Llama 3.3 70B, gpt-oss-120b | 20 RPM, 20 RPD, 200 000 токенов в день | Действует, пока к аккаунту не привязан способ оплаты; хватает только на проверку |
| Cloudflare Workers AI | Модели каталога Workers AI | 10 000 Neurons в день | Neurons — не токены, расход зависит от модели; Kimi, GLM и DeepSeek V4 требуют платного способа оплаты |
| Mistral | Бесплатный режим с месячной квотой | Цифры не публикуются, квота видна на странице Limits в аккаунте | Сверх квоты — оплата по факту использования |
| Cohere | Пробный ключ | 1 000 вызовов в месяц, чат — 20 запросов в минуту | Ключ для рабочего сервиса платный |
| Hugging Face Inference Providers | Ежемесячный кредит | $0,10 в месяц, сумма может меняться | Песочница для пары проб, а не для нагрузки |
| NVIDIA API Catalog | Доступ к NIM для участников NVIDIA Developer Program | На странице описания лимиты не указаны | Только для прототипов |

Цифры в таблице — это потолок, а не обещание. Google прямо пишет, что указанные лимиты не гарантированы и реальная пропускная способность может отличаться. У остальных сервисов лимиты тоже меняются без предупреждения, поэтому перед запуском сверяйте их в своём кабинете.

## Что доступно из России официально

Здесь решает не язык интерфейса и не то, удалось ли зарегистрироваться, а условия сервиса.

**Не поддерживают Россию:**

- **Gemini API и Google AI Studio.** В списке доступных регионов (обновлён 28 апреля 2026 года) нет России, Беларуси, материкового Китая и Гонконга. Условия Google требуют и пользоваться сервисом, и открывать построенное на нём приложение пользователям только в доступных регионах.
- **OpenAI API.** Россия не входит в список поддерживаемых стран. Подробности о том, что остаётся бесплатным у OpenAI, — в статье «[Бесплатный OpenAI API: что означает Free и где проверить лимиты](https://blog.laozhang.ai/ru/posts/openai-api-free-tier)», о получении ключа — в «[Как получить API-ключ ChatGPT в 2026 году: официальный путь и ограничения для России](https://blog.laozhang.ai/ru/posts/openai-api-key-free-trial)».
- **Claude API (Anthropic).** Россия не входит в список поддерживаемых стран. Почему ключ Claude нельзя просто купить у продавца, разобрано в статье «[Как купить доступ к Claude API: ключ отдельно не продаётся](https://blog.laozhang.ai/ru/posts/claude-api-key-free-tier)».

**Отечественный вариант:** GigaChat API. Это единственный российский сервис в таблице, и бесплатный объём у него крупный.

**Остальные** (Groq, OpenRouter, SambaNova, Cloudflare, Mistral, Cohere) прочитайте раздел о странах и допустимом использовании в условиях сервиса, прежде чем строить на них что-то дольше вечернего эксперимента.

Отдельно о переезде. Если вы работаете, например, из Алматы или Тбилиси, Gemini API вам доступен. Но если бот обслуживает пользователей в России, условия Google такое использование не допускают, даже когда сам разработчик находится в разрешённой стране.

![Три группы AI API по доступности из России: Gemini, OpenAI и Claude Россию не поддерживают, GigaChat API даёт 365 млн токенов на 12 месяцев в один поток, Groq, OpenRouter и другие нужно проверять по условиям](https://blog.laozhang.ai/posts/ru/free-ai-api-tiers-compared/img/russia-official-access.webp)

Сервисы, которые продают доступ к зарубежным моделям «без VPN, с оплатой российскими картами», — платные посредники, а не бесплатные тарифы провайдеров. Перед оплатой выясните, чью модель они перепродают и на каких условиях.

## GigaChat API: большой объём, но один поток

Freemium-режим для физлиц — самый крупный бесплатный пакет из доступных в России официально. На странице тарифов Сбера (обновлена 16 сентября 2026 года) он расписан так:

| Модели | Бесплатно токенов | Срок | ID модели в запросе |
|---|---|---|---|
| Lite | 250 млн | 12 месяцев | `GigaChat` или `GigaChat-2` |
| Pro | 40 млн | 12 месяцев | `GigaChat-Pro` или `GigaChat-2-Pro` |
| Max | 25 млн | 12 месяцев | `GigaChat-Max` или `GigaChat-2-Max` |
| Ultra | 50 млн | 12 месяцев | `GigaChat-3-Ultra` |

Чтобы понять масштаб, сравните с платными пакетами того же Сбера: 20 млн токенов Lite стоят 1 300 ₽ на месяц. Бесплатные 250 млн токенов Lite — это 250 ÷ 20 = 12,5 таких пакетов, то есть около 16 250 ₽ по цене пакетов.

Главное ограничение — фраза «генерация текста выполняется в одном потоке». Параллельных запросов нет: если бот одновременно получает сообщения от пяти человек, они встанут в очередь. Для личного бота, учебного проекта или ночной пакетной обработки это терпимо, для публичного сервиса с пиковой нагрузкой — нет.

Вторая оговорка — переходный период. Страница описывает тарифы для действующих клиентов, а для новых клиентов с 1 сентября 2026 года оплата работы с моделями возможна на платформе cloud.ru, где свой каталог и цены. Выдадут ли новому аккаунту Freemium, видно только в личном кабинете при регистрации.

Пример кода ниже рассчитан на OpenAI-совместимые API. Для GigaChat используйте официальную документацию и GigaChat SDK Сбера.

## Gemini API: сильные модели бесплатно, но с платой данными

Для тех, кто работает из доступного региона, бесплатный тариф Gemini — самый сильный по качеству. Бесплатно доступны Gemini 3.8 Flash и остальные модели Flash и Flash-Lite, Gemini 2.5 Pro, 2.5 Flash, открытая Gemma 4 и модели эмбеддингов. Карта не нужна: для бесплатного тарифа достаточно активного проекта, а привязка платёжного аккаунта переводит проект на следующий, платный уровень.

Бесплатно не работают Gemini 3.1 Pro Preview, все модели генерации изображений Nano Banana, видео Veo 3.1, а также пакетная обработка (Batch и Flex). Если вам нужны картинки, условия там другие — см. «[Бесплатный API для генерации изображений ИИ в 2026: что действительно бесплатно](https://blog.laozhang.ai/ru/posts/free-ai-image-generation-api)».

Три вещи, о которых стоит знать заранее:

1. **Лимиты по моделям Google больше не публикует в документации.** Их видно только в AI Studio, на странице лимитов проекта. Цифры вида «60 запросов в минуту» из сторонних подборок официального подтверждения не имеют.
2. **Лимит считается на проект, а не на ключ.** Пять ключей в одном проекте делят одну квоту. Дневной счётчик обнуляется в полночь по тихоокеанскому времени — это 10:00 по Москве летом в США и 11:00 после перехода на зимнее время.
3. **Бесплатные запросы — не приватные.** По условиям Google содержимое запросов и ответов на бесплатной квоте используется для улучшения продуктов, и его могут читать люди-рецензенты. Google прямо просит не отправлять туда конфиденциальные и персональные данные. Условия платных сервисов начинают действовать, только когда проект привязан к активному платёжному аккаунту.

Подробнее о том, где смотреть квоту и почему ключи делят один лимит: «[Gemini API Free Tier Rate Limits 2026: что еще бесплатно, где смотреть live quotas и почему keys делят один limit](https://blog.laozhang.ai/ru/posts/gemini-api-free-tier)».

## Groq и OpenRouter: быстрые пробы открытых моделей

**Groq** даёт на бесплатном тарифе три модели для чата: `openai/gpt-oss-120b`, `openai/gpt-oss-20b` и `qwen/qwen3.8-27b`. На каждую — 30 RPM, 1 000 RPD, 8 000 TPM и 200 000 TPD, причём лимиты действуют на всю организацию, а не на отдельного участника. Закэшированные токены в лимит не засчитываются.

На практике первым кончается не число запросов, а токены. Если запрос вместе с ответом занимает 2 000 токенов, дневной потолок 200 000 токенов даёт 200 000 ÷ 2 000 = 100 запросов, а не 1 000. Тысячу запросов в день получится сделать, только если в среднем укладываться в 200 токенов на запрос.

**OpenRouter** — агрегатор, который открывает часть моделей бесплатно под суффиксом `:free`. Лимиты зависят от того, сколько кредитов вы купили за всё время:

- меньше 10 кредитов — 20 запросов в минуту и 50 в день;
- от 10 кредитов — 20 запросов в минуту и 1 000 в день (порог фактически начинается с 9 кредитов, чтобы покрыть комиссии при пополнении).

Разовая покупка кредитов на $10 — реальные расходы, но она увеличивает бесплатный дневной лимит в 20 раз. Дополнительные аккаунты и ключи лимит не увеличивают: OpenRouter распределяет мощности на уровне всей платформы. При отрицательном балансе ошибки могут приходить и на бесплатных моделях. Счётчик сбрасывается по UTC, то есть в 03:00 по Москве.

Модель за суффиксом `:free` обслуживает сторонний провайдер, поэтому ошибка 429 может прийти как от OpenRouter, так и от него. Правила хранения данных тоже определяет тот, кто обслуживает конкретную модель, поэтому уточняйте их до того, как отправлять что-то чувствительное.

Если вы хотите подключить OpenRouter или DeepSeek к Claude Code, пошаговая настройка — в статье «[Claude Code с OpenRouter и DeepSeek: маршруты, настройка и первые ошибки](https://blog.laozhang.ai/ru/posts/claude-code-openrouter-deepseek)».

## Кто не даёт бесплатного тарифа

- **Cerebras.** В документации на вопрос о постоянном бесплатном тарифе прямо дан ответ «нет». Есть пробный кредит $5, который выдают после привязки проверенного способа оплаты и который сгорает через 30 дней. Без карты не работают ни песочница, ни API.
- **GitHub Models.** С 30 июля 2026 года сервис полностью закрыт: каталог моделей, песочница и API недоступны никому. GitHub предлагает переходить на Azure AI Foundry или GitHub Copilot.
- **DeepSeek.** Публичного бесплатного тарифа нет и не было, на странице цен только платные ставки. Если в кабинете есть подарочный баланс, он списывается первым, но размер таких подарков публично не объявляется.
- **OpenAI API.** Универсального стартового кредита для новых аккаунтов в документации нет.
- **Claude API.** Новые пользователи получают небольшой бесплатный кредит на пробу, сумма не называется. Постоянного бесплатного тарифа нет.

## Как выбрать под свою задачу

Отбирайте варианты в таком порядке — каждый следующий фильтр важен, только если пройден предыдущий:

1. **Где вы и ваши пользователи.** Если хотя бы одно из двух — Россия, Gemini, OpenAI и Claude отпадают.
2. **Какие данные уйдут в запросы.** Персональные данные клиентов и закрытый код не отправляйте на бесплатную квоту Gemini; для приватных данных подходит только своя модель или платный договор.
3. **Сколько запросов и нужна ли параллельность.** Один поток GigaChat не выдержит публичный бот, а 50 запросов в день у OpenRouter не хватит агенту, который делает десяток вызовов на одну задачу.
4. **Готовы ли вы привязать карту.** Без карты работают Gemini, SambaNova и базовый лимит OpenRouter; Cerebras без неё не запустится.
5. **Качество модели.** Сравнивайте только то, что прошло первые четыре фильтра.

![Пять фильтров выбора бесплатного AI API по порядку: регион, данные в запросах, объём и параллельность, привязка карты и только затем качество модели](https://blog.laozhang.ai/posts/ru/free-ai-api-tiers-compared/img/five-step-filter.webp)

| Задача | С чего начать | Почему | Когда уходить |
|---|---|---|---|
| Telegram-бот для себя или друзей, вы в России | GigaChat API, Lite или Pro | Большой объём на год, очередь в один поток незаметна при паре пользователей | Когда пользователи начинают ждать ответа |
| Учёба и эксперименты с запросами, вы вне России | Gemini API, модели Flash | Сильные модели без карты | Когда в запросы попадают чужие или личные данные |
| Агент в n8n с частыми вызовами | Groq | 30 запросов в минуту и 1 000 в день на модель | Когда упираетесь в 200 000 токенов в день |
| Сравнить несколько моделей одним кодом | OpenRouter `:free` | Смена модели — это смена ID | Когда 50 запросов в день мало, а $10 на кредиты тратить не хочется |
| Приватные данные или работа без сети | Своя модель через Ollama | Данные не покидают ваш компьютер | Когда не хватает качества или железа |
| Сервис с платящими пользователями | Платный API | Бесплатные лимиты никто не гарантирует | Сразу |

## Первый запрос и переключение при ошибке 429

Gemini, Groq и OpenRouter поддерживают OpenAI-совместимый API, поэтому один и тот же код работает со всеми тремя: меняются только `base_url`, ключ и ID модели. Пример ниже по очереди пробует провайдеров и при ошибке 429 (слишком много запросов) переходит к следующему. Ключи берутся только из переменных окружения, в коде их нет.

```bash
pip install openai
export GROQ_API_KEY="ваш_ключ_groq"
export OPENROUTER_API_KEY="ваш_ключ_openrouter"
# ID бесплатной модели из каталога OpenRouter, заканчивается на :free
export OPENROUTER_FREE_MODEL="id_модели:free"
```

```python
import os
from openai import OpenAI, RateLimitError

PROVIDERS = [
    {
        "name": "groq",
        "base_url": "https://api.groq.com/openai/v1",
        "api_key": os.environ.get("GROQ_API_KEY"),
        "model": "openai/gpt-oss-120b",
    },
    {
        "name": "openrouter",
        "base_url": "https://openrouter.ai/api/v1",
        "api_key": os.environ.get("OPENROUTER_API_KEY"),
        "model": os.environ.get("OPENROUTER_FREE_MODEL"),
    },
    # Только если и вы, и ваши пользователи в регионе, где доступен Gemini API:
    # {
    #     "name": "gemini",
    #     "base_url": "https://generativelanguage.googleapis.com/v1beta/openai/",
    #     "api_key": os.environ.get("GEMINI_API_KEY"),
    #     "model": "gemini-3.8-flash",
    # },
]


def ask(prompt: str) -> str:
    for p in PROVIDERS:
        if not p["api_key"] or not p["model"]:
            continue
        # max_retries=0: не повторять запрос к тому же провайдеру, а сразу идти к следующему
        client = OpenAI(base_url=p["base_url"], api_key=p["api_key"], max_retries=0)
        try:
            resp = client.chat.completions.create(
                model=p["model"],
                messages=[{"role": "user", "content": prompt}],
            )
            print(f"Ответил {p['name']}")
            return resp.choices[0].message.content
        except RateLimitError as err:
            wait = err.response.headers.get("retry-after")
            print(f"{p['name']}: 429, retry-after={wait}, пробую следующего")
    raise RuntimeError("Бесплатные лимиты у всех провайдеров исчерпаны")


print(ask("Объясни в двух предложениях, чем RPM отличается от RPD."))
```

По умолчанию SDK OpenAI сам повторяет запрос после 429. Параметр `max_retries=0` отключает это, чтобы при исчерпанном лимите код не ждал впустую, а переходил к другому провайдеру.

Где смотреть, сколько осталось:

- **Groq** в заголовках каждого ответа сообщает текущие лимиты, а заголовок `retry-after` (в секундах) добавляет только вместе с ошибкой 429.
- **OpenRouter** показывает дневной счётчик бесплатных запросов по отдельному запросу; поле `free_model_daily_requests` содержит `used`, `limit` и `remaining`. Минутный лимит там не отображается.
- **Gemini** — только на странице лимитов проекта в AI Studio.

```bash
curl -s https://openrouter.ai/api/v1/key \
  -H "Authorization: Bearer $OPENROUTER_API_KEY"
```

Помните, что лимит привязан к проекту (Gemini), организации (Groq) или аккаунту (OpenRouter), а не к ключу. Если вы получили 429 по дневному лимиту, новый ключ не поможет, а OpenRouter прямо пишет, что и новые аккаунты лимит не увеличивают. Остаётся — подождать сброса счётчика, переключиться на другого провайдера, как в коде выше, или перейти на платный тариф.

## Когда пора переходить на платный API

Бесплатный тариф свою задачу выполнил, если вы убедились, что модель подходит, и увидели реальный расход токенов. Переходить пора, когда случается хотя бы одно из этого:

- ошибки 429 появляются каждый день, а не изредка;
- в запросы попадают данные клиентов, которые нельзя отдавать на обучение чужих моделей;
- нескольким пользователям приходится ждать друг друга (один поток GigaChat);
- у сервиса появились платящие пользователи, и отказ из-за чужого лимита стоит вам денег.

Следующий шаг не обязательно дорогой. У DeepSeek модель `deepseek-flash` вне пиковых часов стоит $0,15 за 1 млн входных токенов (без кэша) и $0,6 за 1 млн выходных, в пиковые часы — вдвое дороже. Пик — с 01:00 до 04:00 и с 06:00 до 10:00 UTC по будням, то есть с 04:00 до 07:00 и с 09:00 до 13:00 по Москве. Для ориентира: 1 000 запросов по 1 000 входных и 500 выходных токенов вне пика обойдутся в 1 × 0,15 + 0,5 × 0,6 = $0,45.

Если вы уже на GigaChat, сверх Freemium можно докупить пакеты: те же 20 млн токенов Lite за 1 300 ₽ на месяц. Сравнение платных провайдеров по цене, качеству и задержкам — в статье «[Самый дешевый LLM API провайдер: цена, качество, задержка и риск gateway](https://blog.laozhang.ai/ru/posts/cheapest-llm-api-provider)».

## Частые вопросы

### Есть ли у DeepSeek бесплатный API?

Нет. На официальной странице цен DeepSeek только платные тарифы, самый дешёвый — `deepseek-flash` от $0,15 за 1 млн входных токенов вне пиковых часов. Подарочный баланс иногда встречается в кабинете, но его размер публично не объявляется.

### Можно ли получить Gemini API бесплатно?

Да, если вы и ваши пользователи находитесь в доступном регионе: бесплатны модели Flash, Flash-Lite и Gemini 2.5 Pro, карта не нужна. Россия и Беларусь в список регионов не входят. За бесплатную квоту вы платите данными: Google использует запросы для улучшения продуктов.

### Есть ли бесплатный API GPT?

Бесплатного API от OpenAI для России нет: страна не входит в список поддерживаемых. Открытые модели OpenAI `gpt-oss-120b` и `gpt-oss-20b` бесплатно доступны через Groq и SambaNova в пределах их дневных лимитов.

### Есть ли бесплатный AI API без лимитов?

Нет. У каждого облачного сервиса есть дневной, месячный или общий потолок. Без лимитов работает только открытая модель, запущенная на вашем железе, и её предел — мощность компьютера.

### Используются ли бесплатные запросы для обучения моделей?

У Gemini — да, это прямо записано в условиях, и запросы могут читать люди-рецензенты. У агрегаторов вроде OpenRouter правила хранения данных зависят от провайдера, который обслуживает конкретную модель. Если данные чувствительные, используйте платный договор или свою модель.
