Перейти к основному содержанию

Бесплатный AI API: какой выбрать и что доступно из России

Из России официально доступен GigaChat API с 365 млн бесплатных токенов; Gemini, OpenAI и Claude Россию не поддерживают. Groq и OpenRouter дают дневные лимиты.

LaoZhang AI TeamОпубликованоОбновлено 13 мин чтения
Содержание
Бесплатный AI API из России: GigaChat API — 365 млн токенов на 12 месяцев, Groq — 1 000 запросов в день на модель, OpenRouter — 50 запросов в день на моделях :free

Короткий ответ по состоянию на 26 сентября 2026 года зависит от того, где находитесь вы и ваши пользователи:

  • Вы в России и делаете сервис для российских пользователей. Начните с GigaChat API от Сбера: во Freemium-режиме физлицу выдают 365 млн токенов на 12 месяцев, но генерация идёт в один поток. С 1 сентября 2026 года новых клиентов Сбер направляет оплачивать работу с моделями на cloud.ru, поэтому доступность Freemium проверьте при регистрации.
  • Вы работаете из страны, где доступен Gemini API (среди них Казахстан, Армения, Грузия, Кыргызстан и Узбекистан), и пользователи тоже там. Бесплатный тариф Gemini даёт самые сильные модели среди бесплатных вариантов, но ваши запросы Google использует для улучшения своих продуктов.
  • Нужно быстро попробовать открытые модели вроде gpt-oss или Qwen. Groq даёт 1 000 запросов в день на модель, OpenRouter — 50 запросов в день на моделях с :free, а после разовой покупки кредитов на $10 — 1 000. Можно ли пользоваться ими из России, выясняйте по их условиям использования до того, как строить на них проект.
  • DeepSeek бесплатного тарифа не имеет, но стоит от $0,15 за 1 млн входных токенов.
  • Бесплатно и без лимитов работает только открытая модель, запущенная на своём компьютере или сервере (например, через Ollama). Потолок в этом случае — ваше железо.

Cerebras и GitHub Models бесплатными вариантами больше не являются: у Cerebras остался только пробный кредит после привязки карты, а GitHub Models полностью закрыт 30 июля 2026 года.

Что на самом деле означает «бесплатно»

Слово «free» на странице тарифов может означать пять разных договорённостей. От этого зависит, выдержит ли бесплатный вариант ваш проект через месяц.

ВидКак устроенПримерыДля чего годится
Постоянный бесплатный тарифЛимиты в минуту и в день обновляются, денег не списываютGemini API, Groq, SambaNova, Cloudflare Workers AI, MistralПрототип, бот для себя, учёба
Пакет токенов на срокОбъём выдают один раз, остаток сгорает по срокуGigaChat API Freemium (12 месяцев)Долгий пет-проект, если хватает одного потока
Пробный кредит или пробный ключНебольшая сумма или квота на знакомство, дальше платно; иногда только с картойCerebras ($5 на 30 дней после привязки карты), Anthropic, CohereПроверить качество модели, но не держать на этом сервис
Бесплатные модели у агрегатораЛимиты задаёт агрегатор, модель обслуживает сторонний провайдерOpenRouter (:free), Hugging FaceСравнить несколько моделей одним кодом
Своя модельПлатите железом и электричествомOllama и аналогиПриватные данные, работа без сети, неограниченное число запросов

Дешёвый платный API вроде DeepSeek в эту таблицу не попадает, но на практике именно он становится следующим шагом, когда бесплатного перестаёт хватать.

Первое правило выбора отсюда: смотрите не на слово «бесплатно», а на два вопроса. Обновляется ли лимит сам? И что произойдёт, когда он закончится: запрос вернёт ошибку, начнут списываться деньги или аккаунт просто остановится?

Бесплатные тарифы: сводная таблица

Лимиты указаны по состоянию на 26 сентября 2026 года по официальной документации каждого сервиса. RPM — запросов в минуту, RPD — запросов в день, TPM и TPD — токенов в минуту и в день.

СервисЧто бесплатноОпубликованный лимитГлавные оговорки
GigaChat API (Сбер), физлицаFreemium-режим: модели Lite, Pro, Max, Ultra365 млн токенов на 12 месяцев: 250 млн Lite, 40 млн Pro, 25 млн Max, 50 млн UltraОдин поток генерации; новых клиентов с 1 сентября 2026 года направляют на cloud.ru
Gemini API (Google AI Studio)Модели Flash и Flash-Lite, Gemini 2.5 Pro, Gemma 4По моделям публикуется только в AI Studio; лимит считается на проект, а не на ключРоссия не поддерживается; запросы идут на улучшение продуктов Google; 3.1 Pro Preview, картинки и видео только платно
Groqopenai/gpt-oss-120b, openai/gpt-oss-20b, qwen/qwen3.8-27bНа каждую модель: 30 RPM, 1 000 RPD, 8 000 TPM, 200 000 TPDЛимиты на всю организацию; бесплатных моделей для чата всего три
OpenRouterМодели с суффиксом :free20 RPM и 50 RPD; 1 000 RPD, если за всё время куплено от 10 кредитовНовые ключи и аккаунты лимит не увеличивают; набор :free-моделей часто меняется
SambaNova CloudDeepSeek-V3.1, Llama 3.3 70B, gpt-oss-120b20 RPM, 20 RPD, 200 000 токенов в деньДействует, пока к аккаунту не привязан способ оплаты; хватает только на проверку
Cloudflare Workers AIМодели каталога Workers AI10 000 Neurons в деньNeurons — не токены, расход зависит от модели; Kimi, GLM и DeepSeek V4 требуют платного способа оплаты
MistralБесплатный режим с месячной квотойЦифры не публикуются, квота видна на странице Limits в аккаунтеСверх квоты — оплата по факту использования
CohereПробный ключ1 000 вызовов в месяц, чат — 20 запросов в минутуКлюч для рабочего сервиса платный
Hugging Face Inference ProvidersЕжемесячный кредит$0,10 в месяц, сумма может менятьсяПесочница для пары проб, а не для нагрузки
NVIDIA API CatalogДоступ к NIM для участников NVIDIA Developer ProgramНа странице описания лимиты не указаныТолько для прототипов

Цифры в таблице — это потолок, а не обещание. Google прямо пишет, что указанные лимиты не гарантированы и реальная пропускная способность может отличаться. У остальных сервисов лимиты тоже меняются без предупреждения, поэтому перед запуском сверяйте их в своём кабинете.

Что доступно из России официально

Здесь решает не язык интерфейса и не то, удалось ли зарегистрироваться, а условия сервиса.

Не поддерживают Россию:

Отечественный вариант: GigaChat API. Это единственный российский сервис в таблице, и бесплатный объём у него крупный.

Остальные (Groq, OpenRouter, SambaNova, Cloudflare, Mistral, Cohere) прочитайте раздел о странах и допустимом использовании в условиях сервиса, прежде чем строить на них что-то дольше вечернего эксперимента.

Отдельно о переезде. Если вы работаете, например, из Алматы или Тбилиси, Gemini API вам доступен. Но если бот обслуживает пользователей в России, условия Google такое использование не допускают, даже когда сам разработчик находится в разрешённой стране.

Три группы AI API по доступности из России: Gemini, OpenAI и Claude Россию не поддерживают, GigaChat API даёт 365 млн токенов на 12 месяцев в один поток, Groq, OpenRouter и другие нужно проверять по условиям

Сервисы, которые продают доступ к зарубежным моделям «без VPN, с оплатой российскими картами», — платные посредники, а не бесплатные тарифы провайдеров. Перед оплатой выясните, чью модель они перепродают и на каких условиях.

GigaChat API: большой объём, но один поток

Freemium-режим для физлиц — самый крупный бесплатный пакет из доступных в России официально. На странице тарифов Сбера (обновлена 16 сентября 2026 года) он расписан так:

МоделиБесплатно токеновСрокID модели в запросе
Lite250 млн12 месяцевGigaChat или GigaChat-2
Pro40 млн12 месяцевGigaChat-Pro или GigaChat-2-Pro
Max25 млн12 месяцевGigaChat-Max или GigaChat-2-Max
Ultra50 млн12 месяцевGigaChat-3-Ultra

Чтобы понять масштаб, сравните с платными пакетами того же Сбера: 20 млн токенов Lite стоят 1 300 ₽ на месяц. Бесплатные 250 млн токенов Lite — это 250 ÷ 20 = 12,5 таких пакетов, то есть около 16 250 ₽ по цене пакетов.

Главное ограничение — фраза «генерация текста выполняется в одном потоке». Параллельных запросов нет: если бот одновременно получает сообщения от пяти человек, они встанут в очередь. Для личного бота, учебного проекта или ночной пакетной обработки это терпимо, для публичного сервиса с пиковой нагрузкой — нет.

Вторая оговорка — переходный период. Страница описывает тарифы для действующих клиентов, а для новых клиентов с 1 сентября 2026 года оплата работы с моделями возможна на платформе cloud.ru, где свой каталог и цены. Выдадут ли новому аккаунту Freemium, видно только в личном кабинете при регистрации.

Пример кода ниже рассчитан на OpenAI-совместимые API. Для GigaChat используйте официальную документацию и GigaChat SDK Сбера.

Gemini API: сильные модели бесплатно, но с платой данными

Для тех, кто работает из доступного региона, бесплатный тариф Gemini — самый сильный по качеству. Бесплатно доступны Gemini 3.8 Flash и остальные модели Flash и Flash-Lite, Gemini 2.5 Pro, 2.5 Flash, открытая Gemma 4 и модели эмбеддингов. Карта не нужна: для бесплатного тарифа достаточно активного проекта, а привязка платёжного аккаунта переводит проект на следующий, платный уровень.

Бесплатно не работают Gemini 3.1 Pro Preview, все модели генерации изображений Nano Banana, видео Veo 3.1, а также пакетная обработка (Batch и Flex). Если вам нужны картинки, условия там другие — см. «Бесплатный API для генерации изображений ИИ в 2026: что действительно бесплатно».

Три вещи, о которых стоит знать заранее:

  1. Лимиты по моделям Google больше не публикует в документации. Их видно только в AI Studio, на странице лимитов проекта. Цифры вида «60 запросов в минуту» из сторонних подборок официального подтверждения не имеют.
  2. Лимит считается на проект, а не на ключ. Пять ключей в одном проекте делят одну квоту. Дневной счётчик обнуляется в полночь по тихоокеанскому времени — это 10:00 по Москве летом в США и 11:00 после перехода на зимнее время.
  3. Бесплатные запросы — не приватные. По условиям Google содержимое запросов и ответов на бесплатной квоте используется для улучшения продуктов, и его могут читать люди-рецензенты. Google прямо просит не отправлять туда конфиденциальные и персональные данные. Условия платных сервисов начинают действовать, только когда проект привязан к активному платёжному аккаунту.

Подробнее о том, где смотреть квоту и почему ключи делят один лимит: «Gemini API Free Tier Rate Limits 2026: что еще бесплатно, где смотреть live quotas и почему keys делят один limit».

Groq и OpenRouter: быстрые пробы открытых моделей

Groq даёт на бесплатном тарифе три модели для чата: openai/gpt-oss-120b, openai/gpt-oss-20b и qwen/qwen3.8-27b. На каждую — 30 RPM, 1 000 RPD, 8 000 TPM и 200 000 TPD, причём лимиты действуют на всю организацию, а не на отдельного участника. Закэшированные токены в лимит не засчитываются.

На практике первым кончается не число запросов, а токены. Если запрос вместе с ответом занимает 2 000 токенов, дневной потолок 200 000 токенов даёт 200 000 ÷ 2 000 = 100 запросов, а не 1 000. Тысячу запросов в день получится сделать, только если в среднем укладываться в 200 токенов на запрос.

OpenRouter — агрегатор, который открывает часть моделей бесплатно под суффиксом :free. Лимиты зависят от того, сколько кредитов вы купили за всё время:

  • меньше 10 кредитов — 20 запросов в минуту и 50 в день;
  • от 10 кредитов — 20 запросов в минуту и 1 000 в день (порог фактически начинается с 9 кредитов, чтобы покрыть комиссии при пополнении).

Разовая покупка кредитов на $10 — реальные расходы, но она увеличивает бесплатный дневной лимит в 20 раз. Дополнительные аккаунты и ключи лимит не увеличивают: OpenRouter распределяет мощности на уровне всей платформы. При отрицательном балансе ошибки могут приходить и на бесплатных моделях. Счётчик сбрасывается по UTC, то есть в 03:00 по Москве.

Модель за суффиксом :free обслуживает сторонний провайдер, поэтому ошибка 429 может прийти как от OpenRouter, так и от него. Правила хранения данных тоже определяет тот, кто обслуживает конкретную модель, поэтому уточняйте их до того, как отправлять что-то чувствительное.

Если вы хотите подключить OpenRouter или DeepSeek к Claude Code, пошаговая настройка — в статье «Claude Code с OpenRouter и DeepSeek: маршруты, настройка и первые ошибки».

Кто не даёт бесплатного тарифа

  • Cerebras. В документации на вопрос о постоянном бесплатном тарифе прямо дан ответ «нет». Есть пробный кредит $5, который выдают после привязки проверенного способа оплаты и который сгорает через 30 дней. Без карты не работают ни песочница, ни API.
  • GitHub Models. С 30 июля 2026 года сервис полностью закрыт: каталог моделей, песочница и API недоступны никому. GitHub предлагает переходить на Azure AI Foundry или GitHub Copilot.
  • DeepSeek. Публичного бесплатного тарифа нет и не было, на странице цен только платные ставки. Если в кабинете есть подарочный баланс, он списывается первым, но размер таких подарков публично не объявляется.
  • OpenAI API. Универсального стартового кредита для новых аккаунтов в документации нет.
  • Claude API. Новые пользователи получают небольшой бесплатный кредит на пробу, сумма не называется. Постоянного бесплатного тарифа нет.

Как выбрать под свою задачу

Отбирайте варианты в таком порядке — каждый следующий фильтр важен, только если пройден предыдущий:

  1. Где вы и ваши пользователи. Если хотя бы одно из двух — Россия, Gemini, OpenAI и Claude отпадают.
  2. Какие данные уйдут в запросы. Персональные данные клиентов и закрытый код не отправляйте на бесплатную квоту Gemini; для приватных данных подходит только своя модель или платный договор.
  3. Сколько запросов и нужна ли параллельность. Один поток GigaChat не выдержит публичный бот, а 50 запросов в день у OpenRouter не хватит агенту, который делает десяток вызовов на одну задачу.
  4. Готовы ли вы привязать карту. Без карты работают Gemini, SambaNova и базовый лимит OpenRouter; Cerebras без неё не запустится.
  5. Качество модели. Сравнивайте только то, что прошло первые четыре фильтра.

Пять фильтров выбора бесплатного AI API по порядку: регион, данные в запросах, объём и параллельность, привязка карты и только затем качество модели

ЗадачаС чего начатьПочемуКогда уходить
Telegram-бот для себя или друзей, вы в РоссииGigaChat API, Lite или ProБольшой объём на год, очередь в один поток незаметна при паре пользователейКогда пользователи начинают ждать ответа
Учёба и эксперименты с запросами, вы вне РоссииGemini API, модели FlashСильные модели без картыКогда в запросы попадают чужие или личные данные
Агент в n8n с частыми вызовамиGroq30 запросов в минуту и 1 000 в день на модельКогда упираетесь в 200 000 токенов в день
Сравнить несколько моделей одним кодомOpenRouter :freeСмена модели — это смена IDКогда 50 запросов в день мало, а $10 на кредиты тратить не хочется
Приватные данные или работа без сетиСвоя модель через OllamaДанные не покидают ваш компьютерКогда не хватает качества или железа
Сервис с платящими пользователямиПлатный APIБесплатные лимиты никто не гарантируетСразу

Первый запрос и переключение при ошибке 429

Gemini, Groq и OpenRouter поддерживают OpenAI-совместимый API, поэтому один и тот же код работает со всеми тремя: меняются только base_url, ключ и ID модели. Пример ниже по очереди пробует провайдеров и при ошибке 429 (слишком много запросов) переходит к следующему. Ключи берутся только из переменных окружения, в коде их нет.

bash
pip install openai
export GROQ_API_KEY="ваш_ключ_groq"
export OPENROUTER_API_KEY="ваш_ключ_openrouter"
# ID бесплатной модели из каталога OpenRouter, заканчивается на :free
export OPENROUTER_FREE_MODEL="id_модели:free"
python
import os
from openai import OpenAI, RateLimitError

PROVIDERS = [
    {
        "name": "groq",
        "base_url": "https://api.groq.com/openai/v1",
        "api_key": os.environ.get("GROQ_API_KEY"),
        "model": "openai/gpt-oss-120b",
    },
    {
        "name": "openrouter",
        "base_url": "https://openrouter.ai/api/v1",
        "api_key": os.environ.get("OPENROUTER_API_KEY"),
        "model": os.environ.get("OPENROUTER_FREE_MODEL"),
    },
    # Только если и вы, и ваши пользователи в регионе, где доступен Gemini API:
    # {
    #     "name": "gemini",
    #     "base_url": "https://generativelanguage.googleapis.com/v1beta/openai/",
    #     "api_key": os.environ.get("GEMINI_API_KEY"),
    #     "model": "gemini-3.8-flash",
    # },
]


def ask(prompt: str) -> str:
    for p in PROVIDERS:
        if not p["api_key"] or not p["model"]:
            continue
        # max_retries=0: не повторять запрос к тому же провайдеру, а сразу идти к следующему
        client = OpenAI(base_url=p["base_url"], api_key=p["api_key"], max_retries=0)
        try:
            resp = client.chat.completions.create(
                model=p["model"],
                messages=[{"role": "user", "content": prompt}],
            )
            print(f"Ответил {p['name']}")
            return resp.choices[0].message.content
        except RateLimitError as err:
            wait = err.response.headers.get("retry-after")
            print(f"{p['name']}: 429, retry-after={wait}, пробую следующего")
    raise RuntimeError("Бесплатные лимиты у всех провайдеров исчерпаны")


print(ask("Объясни в двух предложениях, чем RPM отличается от RPD."))

По умолчанию SDK OpenAI сам повторяет запрос после 429. Параметр max_retries=0 отключает это, чтобы при исчерпанном лимите код не ждал впустую, а переходил к другому провайдеру.

Где смотреть, сколько осталось:

  • Groq в заголовках каждого ответа сообщает текущие лимиты, а заголовок retry-after (в секундах) добавляет только вместе с ошибкой 429.
  • OpenRouter показывает дневной счётчик бесплатных запросов по отдельному запросу; поле free_model_daily_requests содержит used, limit и remaining. Минутный лимит там не отображается.
  • Gemini — только на странице лимитов проекта в AI Studio.
bash
curl -s https://openrouter.ai/api/v1/key \
  -H "Authorization: Bearer $OPENROUTER_API_KEY"

Помните, что лимит привязан к проекту (Gemini), организации (Groq) или аккаунту (OpenRouter), а не к ключу. Если вы получили 429 по дневному лимиту, новый ключ не поможет, а OpenRouter прямо пишет, что и новые аккаунты лимит не увеличивают. Остаётся — подождать сброса счётчика, переключиться на другого провайдера, как в коде выше, или перейти на платный тариф.

Когда пора переходить на платный API

Бесплатный тариф свою задачу выполнил, если вы убедились, что модель подходит, и увидели реальный расход токенов. Переходить пора, когда случается хотя бы одно из этого:

  • ошибки 429 появляются каждый день, а не изредка;
  • в запросы попадают данные клиентов, которые нельзя отдавать на обучение чужих моделей;
  • нескольким пользователям приходится ждать друг друга (один поток GigaChat);
  • у сервиса появились платящие пользователи, и отказ из-за чужого лимита стоит вам денег.

Следующий шаг не обязательно дорогой. У DeepSeek модель deepseek-flash вне пиковых часов стоит $0,15 за 1 млн входных токенов (без кэша) и $0,6 за 1 млн выходных, в пиковые часы — вдвое дороже. Пик — с 01:00 до 04:00 и с 06:00 до 10:00 UTC по будням, то есть с 04:00 до 07:00 и с 09:00 до 13:00 по Москве. Для ориентира: 1 000 запросов по 1 000 входных и 500 выходных токенов вне пика обойдутся в 1 × 0,15 + 0,5 × 0,6 = $0,45.

Если вы уже на GigaChat, сверх Freemium можно докупить пакеты: те же 20 млн токенов Lite за 1 300 ₽ на месяц. Сравнение платных провайдеров по цене, качеству и задержкам — в статье «Самый дешевый LLM API провайдер: цена, качество, задержка и риск gateway».

Частые вопросы

Есть ли у DeepSeek бесплатный API?

Нет. На официальной странице цен DeepSeek только платные тарифы, самый дешёвый — deepseek-flash от $0,15 за 1 млн входных токенов вне пиковых часов. Подарочный баланс иногда встречается в кабинете, но его размер публично не объявляется.

Можно ли получить Gemini API бесплатно?

Да, если вы и ваши пользователи находитесь в доступном регионе: бесплатны модели Flash, Flash-Lite и Gemini 2.5 Pro, карта не нужна. Россия и Беларусь в список регионов не входят. За бесплатную квоту вы платите данными: Google использует запросы для улучшения продуктов.

Есть ли бесплатный API GPT?

Бесплатного API от OpenAI для России нет: страна не входит в список поддерживаемых. Открытые модели OpenAI gpt-oss-120b и gpt-oss-20b бесплатно доступны через Groq и SambaNova в пределах их дневных лимитов.

Есть ли бесплатный AI API без лимитов?

Нет. У каждого облачного сервиса есть дневной, месячный или общий потолок. Без лимитов работает только открытая модель, запущенная на вашем железе, и её предел — мощность компьютера.

Используются ли бесплатные запросы для обучения моделей?

У Gemini — да, это прямо записано в условиях, и запросы могут читать люди-рецензенты. У агрегаторов вроде OpenRouter правила хранения данных зависят от провайдера, который обслуживает конкретную модель. Если данные чувствительные, используйте платный договор или свою модель.

Диагностика лимитов Gemini API 2026 по продукту, проекту, метрике и режиму обработки
Руководства по API

Лимиты Gemini API в 2026 году: как найти причину 429 по проекту, уровню и режиму обработки

Сначала определите продукт, проект, метрику и режим обработки; затем проверьте владельца лимита и меняйте только тот рычаг, который действительно влияет на ошибку.

17 мин
Руководство по устранению ошибки paid tier getting free_tier_requests limit 0
Руководства по API

Paid Tier получает free_tier_requests limit 0 — полное руководство по исправлению (2026)

Получаете ошибку 429 RESOURCE_EXHAUSTED с free_tier_requests limit: 0 на платном аккаунте Gemini API? Это руководство поможет определить, вызвана ли проблема неправильной настройкой биллинга или известным багом Google, а затем проведёт вас через точное решение для каждого сценария — включая обходные пути для бага с генерацией изображений в феврале 2026 года.

25 мин
Исправление ошибки RESOURCE_EXHAUSTED в Nano Banana Pro — полное руководство
Руководства по API

Исправление ошибки RESOURCE_EXHAUSTED в Nano Banana Pro: полное руководство 2026 года с рабочим кодом

Ошибка RESOURCE_EXHAUSTED (HTTP 429) составляет 70% всех сбоев API Nano Banana Pro. В этом руководстве представлен готовый к продакшену код на Python и Node.js с экспоненциальным откатом, цепочками переключения моделей и стратегиями оптимизации затрат для окончательного устранения ошибок 429.

22 мин
Карта выбора доступа к Gemini API: свой проект Google, Cloud-маршрут, ключ провайдера и запрет на покупку чужого ключа.
Руководства по API

Как купить доступ к Gemini API в России: цены, ключ и безопасные маршруты

API-ключ Gemini — не товар и не подписка. Он привязан к проекту, а платите вы за использование. Для России сначала проверьте регион, владельца биллинга и условия выбранного маршрута.

10 мин