Бесплатный AI API: какой выбрать и что доступно из России
Из России официально доступен GigaChat API с 365 млн бесплатных токенов; Gemini, OpenAI и Claude Россию не поддерживают. Groq и OpenRouter дают дневные лимиты.
Содержание

Короткий ответ по состоянию на 26 сентября 2026 года зависит от того, где находитесь вы и ваши пользователи:
- Вы в России и делаете сервис для российских пользователей. Начните с GigaChat API от Сбера: во Freemium-режиме физлицу выдают 365 млн токенов на 12 месяцев, но генерация идёт в один поток. С 1 сентября 2026 года новых клиентов Сбер направляет оплачивать работу с моделями на cloud.ru, поэтому доступность Freemium проверьте при регистрации.
- Вы работаете из страны, где доступен Gemini API (среди них Казахстан, Армения, Грузия, Кыргызстан и Узбекистан), и пользователи тоже там. Бесплатный тариф Gemini даёт самые сильные модели среди бесплатных вариантов, но ваши запросы Google использует для улучшения своих продуктов.
- Нужно быстро попробовать открытые модели вроде gpt-oss или Qwen. Groq даёт 1 000 запросов в день на модель, OpenRouter — 50 запросов в день на моделях с
:free, а после разовой покупки кредитов на $10 — 1 000. Можно ли пользоваться ими из России, выясняйте по их условиям использования до того, как строить на них проект. - DeepSeek бесплатного тарифа не имеет, но стоит от $0,15 за 1 млн входных токенов.
- Бесплатно и без лимитов работает только открытая модель, запущенная на своём компьютере или сервере (например, через Ollama). Потолок в этом случае — ваше железо.
Cerebras и GitHub Models бесплатными вариантами больше не являются: у Cerebras остался только пробный кредит после привязки карты, а GitHub Models полностью закрыт 30 июля 2026 года.
Что на самом деле означает «бесплатно»
Слово «free» на странице тарифов может означать пять разных договорённостей. От этого зависит, выдержит ли бесплатный вариант ваш проект через месяц.
| Вид | Как устроен | Примеры | Для чего годится |
|---|---|---|---|
| Постоянный бесплатный тариф | Лимиты в минуту и в день обновляются, денег не списывают | Gemini API, Groq, SambaNova, Cloudflare Workers AI, Mistral | Прототип, бот для себя, учёба |
| Пакет токенов на срок | Объём выдают один раз, остаток сгорает по сроку | GigaChat API Freemium (12 месяцев) | Долгий пет-проект, если хватает одного потока |
| Пробный кредит или пробный ключ | Небольшая сумма или квота на знакомство, дальше платно; иногда только с картой | Cerebras ($5 на 30 дней после привязки карты), Anthropic, Cohere | Проверить качество модели, но не держать на этом сервис |
| Бесплатные модели у агрегатора | Лимиты задаёт агрегатор, модель обслуживает сторонний провайдер | OpenRouter (:free), Hugging Face | Сравнить несколько моделей одним кодом |
| Своя модель | Платите железом и электричеством | Ollama и аналоги | Приватные данные, работа без сети, неограниченное число запросов |
Дешёвый платный API вроде DeepSeek в эту таблицу не попадает, но на практике именно он становится следующим шагом, когда бесплатного перестаёт хватать.
Первое правило выбора отсюда: смотрите не на слово «бесплатно», а на два вопроса. Обновляется ли лимит сам? И что произойдёт, когда он закончится: запрос вернёт ошибку, начнут списываться деньги или аккаунт просто остановится?
Бесплатные тарифы: сводная таблица
Лимиты указаны по состоянию на 26 сентября 2026 года по официальной документации каждого сервиса. RPM — запросов в минуту, RPD — запросов в день, TPM и TPD — токенов в минуту и в день.
| Сервис | Что бесплатно | Опубликованный лимит | Главные оговорки |
|---|---|---|---|
| GigaChat API (Сбер), физлица | Freemium-режим: модели Lite, Pro, Max, Ultra | 365 млн токенов на 12 месяцев: 250 млн Lite, 40 млн Pro, 25 млн Max, 50 млн Ultra | Один поток генерации; новых клиентов с 1 сентября 2026 года направляют на cloud.ru |
| Gemini API (Google AI Studio) | Модели Flash и Flash-Lite, Gemini 2.5 Pro, Gemma 4 | По моделям публикуется только в AI Studio; лимит считается на проект, а не на ключ | Россия не поддерживается; запросы идут на улучшение продуктов Google; 3.1 Pro Preview, картинки и видео только платно |
| Groq | openai/gpt-oss-120b, openai/gpt-oss-20b, qwen/qwen3.8-27b | На каждую модель: 30 RPM, 1 000 RPD, 8 000 TPM, 200 000 TPD | Лимиты на всю организацию; бесплатных моделей для чата всего три |
| OpenRouter | Модели с суффиксом :free | 20 RPM и 50 RPD; 1 000 RPD, если за всё время куплено от 10 кредитов | Новые ключи и аккаунты лимит не увеличивают; набор :free-моделей часто меняется |
| SambaNova Cloud | DeepSeek-V3.1, Llama 3.3 70B, gpt-oss-120b | 20 RPM, 20 RPD, 200 000 токенов в день | Действует, пока к аккаунту не привязан способ оплаты; хватает только на проверку |
| Cloudflare Workers AI | Модели каталога Workers AI | 10 000 Neurons в день | Neurons — не токены, расход зависит от модели; Kimi, GLM и DeepSeek V4 требуют платного способа оплаты |
| Mistral | Бесплатный режим с месячной квотой | Цифры не публикуются, квота видна на странице Limits в аккаунте | Сверх квоты — оплата по факту использования |
| Cohere | Пробный ключ | 1 000 вызовов в месяц, чат — 20 запросов в минуту | Ключ для рабочего сервиса платный |
| Hugging Face Inference Providers | Ежемесячный кредит | $0,10 в месяц, сумма может меняться | Песочница для пары проб, а не для нагрузки |
| NVIDIA API Catalog | Доступ к NIM для участников NVIDIA Developer Program | На странице описания лимиты не указаны | Только для прототипов |
Цифры в таблице — это потолок, а не обещание. Google прямо пишет, что указанные лимиты не гарантированы и реальная пропускная способность может отличаться. У остальных сервисов лимиты тоже меняются без предупреждения, поэтому перед запуском сверяйте их в своём кабинете.
Что доступно из России официально
Здесь решает не язык интерфейса и не то, удалось ли зарегистрироваться, а условия сервиса.
Не поддерживают Россию:
- Gemini API и Google AI Studio. В списке доступных регионов (обновлён 28 апреля 2026 года) нет России, Беларуси, материкового Китая и Гонконга. Условия Google требуют и пользоваться сервисом, и открывать построенное на нём приложение пользователям только в доступных регионах.
- OpenAI API. Россия не входит в список поддерживаемых стран. Подробности о том, что остаётся бесплатным у OpenAI, — в статье «Бесплатный OpenAI API: что означает Free и где проверить лимиты», о получении ключа — в «Как получить API-ключ ChatGPT в 2026 году: официальный путь и ограничения для России».
- Claude API (Anthropic). Россия не входит в список поддерживаемых стран. Почему ключ Claude нельзя просто купить у продавца, разобрано в статье «Как купить доступ к Claude API: ключ отдельно не продаётся».
Отечественный вариант: GigaChat API. Это единственный российский сервис в таблице, и бесплатный объём у него крупный.
Остальные (Groq, OpenRouter, SambaNova, Cloudflare, Mistral, Cohere) прочитайте раздел о странах и допустимом использовании в условиях сервиса, прежде чем строить на них что-то дольше вечернего эксперимента.
Отдельно о переезде. Если вы работаете, например, из Алматы или Тбилиси, Gemini API вам доступен. Но если бот обслуживает пользователей в России, условия Google такое использование не допускают, даже когда сам разработчик находится в разрешённой стране.

Сервисы, которые продают доступ к зарубежным моделям «без VPN, с оплатой российскими картами», — платные посредники, а не бесплатные тарифы провайдеров. Перед оплатой выясните, чью модель они перепродают и на каких условиях.
GigaChat API: большой объём, но один поток
Freemium-режим для физлиц — самый крупный бесплатный пакет из доступных в России официально. На странице тарифов Сбера (обновлена 16 сентября 2026 года) он расписан так:
| Модели | Бесплатно токенов | Срок | ID модели в запросе |
|---|---|---|---|
| Lite | 250 млн | 12 месяцев | GigaChat или GigaChat-2 |
| Pro | 40 млн | 12 месяцев | GigaChat-Pro или GigaChat-2-Pro |
| Max | 25 млн | 12 месяцев | GigaChat-Max или GigaChat-2-Max |
| Ultra | 50 млн | 12 месяцев | GigaChat-3-Ultra |
Чтобы понять масштаб, сравните с платными пакетами того же Сбера: 20 млн токенов Lite стоят 1 300 ₽ на месяц. Бесплатные 250 млн токенов Lite — это 250 ÷ 20 = 12,5 таких пакетов, то есть около 16 250 ₽ по цене пакетов.
Главное ограничение — фраза «генерация текста выполняется в одном потоке». Параллельных запросов нет: если бот одновременно получает сообщения от пяти человек, они встанут в очередь. Для личного бота, учебного проекта или ночной пакетной обработки это терпимо, для публичного сервиса с пиковой нагрузкой — нет.
Вторая оговорка — переходный период. Страница описывает тарифы для действующих клиентов, а для новых клиентов с 1 сентября 2026 года оплата работы с моделями возможна на платформе cloud.ru, где свой каталог и цены. Выдадут ли новому аккаунту Freemium, видно только в личном кабинете при регистрации.
Пример кода ниже рассчитан на OpenAI-совместимые API. Для GigaChat используйте официальную документацию и GigaChat SDK Сбера.
Gemini API: сильные модели бесплатно, но с платой данными
Для тех, кто работает из доступного региона, бесплатный тариф Gemini — самый сильный по качеству. Бесплатно доступны Gemini 3.8 Flash и остальные модели Flash и Flash-Lite, Gemini 2.5 Pro, 2.5 Flash, открытая Gemma 4 и модели эмбеддингов. Карта не нужна: для бесплатного тарифа достаточно активного проекта, а привязка платёжного аккаунта переводит проект на следующий, платный уровень.
Бесплатно не работают Gemini 3.1 Pro Preview, все модели генерации изображений Nano Banana, видео Veo 3.1, а также пакетная обработка (Batch и Flex). Если вам нужны картинки, условия там другие — см. «Бесплатный API для генерации изображений ИИ в 2026: что действительно бесплатно».
Три вещи, о которых стоит знать заранее:
- Лимиты по моделям Google больше не публикует в документации. Их видно только в AI Studio, на странице лимитов проекта. Цифры вида «60 запросов в минуту» из сторонних подборок официального подтверждения не имеют.
- Лимит считается на проект, а не на ключ. Пять ключей в одном проекте делят одну квоту. Дневной счётчик обнуляется в полночь по тихоокеанскому времени — это 10:00 по Москве летом в США и 11:00 после перехода на зимнее время.
- Бесплатные запросы — не приватные. По условиям Google содержимое запросов и ответов на бесплатной квоте используется для улучшения продуктов, и его могут читать люди-рецензенты. Google прямо просит не отправлять туда конфиденциальные и персональные данные. Условия платных сервисов начинают действовать, только когда проект привязан к активному платёжному аккаунту.
Подробнее о том, где смотреть квоту и почему ключи делят один лимит: «Gemini API Free Tier Rate Limits 2026: что еще бесплатно, где смотреть live quotas и почему keys делят один limit».
Groq и OpenRouter: быстрые пробы открытых моделей
Groq даёт на бесплатном тарифе три модели для чата: openai/gpt-oss-120b, openai/gpt-oss-20b и qwen/qwen3.8-27b. На каждую — 30 RPM, 1 000 RPD, 8 000 TPM и 200 000 TPD, причём лимиты действуют на всю организацию, а не на отдельного участника. Закэшированные токены в лимит не засчитываются.
На практике первым кончается не число запросов, а токены. Если запрос вместе с ответом занимает 2 000 токенов, дневной потолок 200 000 токенов даёт 200 000 ÷ 2 000 = 100 запросов, а не 1 000. Тысячу запросов в день получится сделать, только если в среднем укладываться в 200 токенов на запрос.
OpenRouter — агрегатор, который открывает часть моделей бесплатно под суффиксом :free. Лимиты зависят от того, сколько кредитов вы купили за всё время:
- меньше 10 кредитов — 20 запросов в минуту и 50 в день;
- от 10 кредитов — 20 запросов в минуту и 1 000 в день (порог фактически начинается с 9 кредитов, чтобы покрыть комиссии при пополнении).
Разовая покупка кредитов на $10 — реальные расходы, но она увеличивает бесплатный дневной лимит в 20 раз. Дополнительные аккаунты и ключи лимит не увеличивают: OpenRouter распределяет мощности на уровне всей платформы. При отрицательном балансе ошибки могут приходить и на бесплатных моделях. Счётчик сбрасывается по UTC, то есть в 03:00 по Москве.
Модель за суффиксом :free обслуживает сторонний провайдер, поэтому ошибка 429 может прийти как от OpenRouter, так и от него. Правила хранения данных тоже определяет тот, кто обслуживает конкретную модель, поэтому уточняйте их до того, как отправлять что-то чувствительное.
Если вы хотите подключить OpenRouter или DeepSeek к Claude Code, пошаговая настройка — в статье «Claude Code с OpenRouter и DeepSeek: маршруты, настройка и первые ошибки».
Кто не даёт бесплатного тарифа
- Cerebras. В документации на вопрос о постоянном бесплатном тарифе прямо дан ответ «нет». Есть пробный кредит $5, который выдают после привязки проверенного способа оплаты и который сгорает через 30 дней. Без карты не работают ни песочница, ни API.
- GitHub Models. С 30 июля 2026 года сервис полностью закрыт: каталог моделей, песочница и API недоступны никому. GitHub предлагает переходить на Azure AI Foundry или GitHub Copilot.
- DeepSeek. Публичного бесплатного тарифа нет и не было, на странице цен только платные ставки. Если в кабинете есть подарочный баланс, он списывается первым, но размер таких подарков публично не объявляется.
- OpenAI API. Универсального стартового кредита для новых аккаунтов в документации нет.
- Claude API. Новые пользователи получают небольшой бесплатный кредит на пробу, сумма не называется. Постоянного бесплатного тарифа нет.
Как выбрать под свою задачу
Отбирайте варианты в таком порядке — каждый следующий фильтр важен, только если пройден предыдущий:
- Где вы и ваши пользователи. Если хотя бы одно из двух — Россия, Gemini, OpenAI и Claude отпадают.
- Какие данные уйдут в запросы. Персональные данные клиентов и закрытый код не отправляйте на бесплатную квоту Gemini; для приватных данных подходит только своя модель или платный договор.
- Сколько запросов и нужна ли параллельность. Один поток GigaChat не выдержит публичный бот, а 50 запросов в день у OpenRouter не хватит агенту, который делает десяток вызовов на одну задачу.
- Готовы ли вы привязать карту. Без карты работают Gemini, SambaNova и базовый лимит OpenRouter; Cerebras без неё не запустится.
- Качество модели. Сравнивайте только то, что прошло первые четыре фильтра.

| Задача | С чего начать | Почему | Когда уходить |
|---|---|---|---|
| Telegram-бот для себя или друзей, вы в России | GigaChat API, Lite или Pro | Большой объём на год, очередь в один поток незаметна при паре пользователей | Когда пользователи начинают ждать ответа |
| Учёба и эксперименты с запросами, вы вне России | Gemini API, модели Flash | Сильные модели без карты | Когда в запросы попадают чужие или личные данные |
| Агент в n8n с частыми вызовами | Groq | 30 запросов в минуту и 1 000 в день на модель | Когда упираетесь в 200 000 токенов в день |
| Сравнить несколько моделей одним кодом | OpenRouter :free | Смена модели — это смена ID | Когда 50 запросов в день мало, а $10 на кредиты тратить не хочется |
| Приватные данные или работа без сети | Своя модель через Ollama | Данные не покидают ваш компьютер | Когда не хватает качества или железа |
| Сервис с платящими пользователями | Платный API | Бесплатные лимиты никто не гарантирует | Сразу |
Первый запрос и переключение при ошибке 429
Gemini, Groq и OpenRouter поддерживают OpenAI-совместимый API, поэтому один и тот же код работает со всеми тремя: меняются только base_url, ключ и ID модели. Пример ниже по очереди пробует провайдеров и при ошибке 429 (слишком много запросов) переходит к следующему. Ключи берутся только из переменных окружения, в коде их нет.
pip install openai
export GROQ_API_KEY="ваш_ключ_groq"
export OPENROUTER_API_KEY="ваш_ключ_openrouter"
# ID бесплатной модели из каталога OpenRouter, заканчивается на :free
export OPENROUTER_FREE_MODEL="id_модели:free"import os
from openai import OpenAI, RateLimitError
PROVIDERS = [
{
"name": "groq",
"base_url": "https://api.groq.com/openai/v1",
"api_key": os.environ.get("GROQ_API_KEY"),
"model": "openai/gpt-oss-120b",
},
{
"name": "openrouter",
"base_url": "https://openrouter.ai/api/v1",
"api_key": os.environ.get("OPENROUTER_API_KEY"),
"model": os.environ.get("OPENROUTER_FREE_MODEL"),
},
# Только если и вы, и ваши пользователи в регионе, где доступен Gemini API:
# {
# "name": "gemini",
# "base_url": "https://generativelanguage.googleapis.com/v1beta/openai/",
# "api_key": os.environ.get("GEMINI_API_KEY"),
# "model": "gemini-3.8-flash",
# },
]
def ask(prompt: str) -> str:
for p in PROVIDERS:
if not p["api_key"] or not p["model"]:
continue
# max_retries=0: не повторять запрос к тому же провайдеру, а сразу идти к следующему
client = OpenAI(base_url=p["base_url"], api_key=p["api_key"], max_retries=0)
try:
resp = client.chat.completions.create(
model=p["model"],
messages=[{"role": "user", "content": prompt}],
)
print(f"Ответил {p['name']}")
return resp.choices[0].message.content
except RateLimitError as err:
wait = err.response.headers.get("retry-after")
print(f"{p['name']}: 429, retry-after={wait}, пробую следующего")
raise RuntimeError("Бесплатные лимиты у всех провайдеров исчерпаны")
print(ask("Объясни в двух предложениях, чем RPM отличается от RPD."))По умолчанию SDK OpenAI сам повторяет запрос после 429. Параметр max_retries=0 отключает это, чтобы при исчерпанном лимите код не ждал впустую, а переходил к другому провайдеру.
Где смотреть, сколько осталось:
- Groq в заголовках каждого ответа сообщает текущие лимиты, а заголовок
retry-after(в секундах) добавляет только вместе с ошибкой 429. - OpenRouter показывает дневной счётчик бесплатных запросов по отдельному запросу; поле
free_model_daily_requestsсодержитused,limitиremaining. Минутный лимит там не отображается. - Gemini — только на странице лимитов проекта в AI Studio.
curl -s https://openrouter.ai/api/v1/key \
-H "Authorization: Bearer $OPENROUTER_API_KEY"Помните, что лимит привязан к проекту (Gemini), организации (Groq) или аккаунту (OpenRouter), а не к ключу. Если вы получили 429 по дневному лимиту, новый ключ не поможет, а OpenRouter прямо пишет, что и новые аккаунты лимит не увеличивают. Остаётся — подождать сброса счётчика, переключиться на другого провайдера, как в коде выше, или перейти на платный тариф.
Когда пора переходить на платный API
Бесплатный тариф свою задачу выполнил, если вы убедились, что модель подходит, и увидели реальный расход токенов. Переходить пора, когда случается хотя бы одно из этого:
- ошибки 429 появляются каждый день, а не изредка;
- в запросы попадают данные клиентов, которые нельзя отдавать на обучение чужих моделей;
- нескольким пользователям приходится ждать друг друга (один поток GigaChat);
- у сервиса появились платящие пользователи, и отказ из-за чужого лимита стоит вам денег.
Следующий шаг не обязательно дорогой. У DeepSeek модель deepseek-flash вне пиковых часов стоит $0,15 за 1 млн входных токенов (без кэша) и $0,6 за 1 млн выходных, в пиковые часы — вдвое дороже. Пик — с 01:00 до 04:00 и с 06:00 до 10:00 UTC по будням, то есть с 04:00 до 07:00 и с 09:00 до 13:00 по Москве. Для ориентира: 1 000 запросов по 1 000 входных и 500 выходных токенов вне пика обойдутся в 1 × 0,15 + 0,5 × 0,6 = $0,45.
Если вы уже на GigaChat, сверх Freemium можно докупить пакеты: те же 20 млн токенов Lite за 1 300 ₽ на месяц. Сравнение платных провайдеров по цене, качеству и задержкам — в статье «Самый дешевый LLM API провайдер: цена, качество, задержка и риск gateway».
Частые вопросы
Есть ли у DeepSeek бесплатный API?
Нет. На официальной странице цен DeepSeek только платные тарифы, самый дешёвый — deepseek-flash от $0,15 за 1 млн входных токенов вне пиковых часов. Подарочный баланс иногда встречается в кабинете, но его размер публично не объявляется.
Можно ли получить Gemini API бесплатно?
Да, если вы и ваши пользователи находитесь в доступном регионе: бесплатны модели Flash, Flash-Lite и Gemini 2.5 Pro, карта не нужна. Россия и Беларусь в список регионов не входят. За бесплатную квоту вы платите данными: Google использует запросы для улучшения продуктов.
Есть ли бесплатный API GPT?
Бесплатного API от OpenAI для России нет: страна не входит в список поддерживаемых. Открытые модели OpenAI gpt-oss-120b и gpt-oss-20b бесплатно доступны через Groq и SambaNova в пределах их дневных лимитов.
Есть ли бесплатный AI API без лимитов?
Нет. У каждого облачного сервиса есть дневной, месячный или общий потолок. Без лимитов работает только открытая модель, запущенная на вашем железе, и её предел — мощность компьютера.
Используются ли бесплатные запросы для обучения моделей?
У Gemini — да, это прямо записано в условиях, и запросы могут читать люди-рецензенты. У агрегаторов вроде OpenRouter правила хранения данных зависят от провайдера, который обслуживает конкретную модель. Если данные чувствительные, используйте платный договор или свою модель.





