Перейти к основному содержанию
Для реальных инженерных решений

Руководства по AI-моделям и API

Руководства по AI-моделям, интеграции API и рабочим процессам разработчиков: источники, воспроизводимые шаги и четкие границы для быстро меняющихся цен, квот и возможностей.
  • Приоритет первичных источников
  • Воспроизводимые шаги и границы ошибок
  • Дата проверки изменяемых фактов
  • 467 статей
  • 6 языков
  • 12 тем
  • Обновлено 6 окт. 2026 г.

Проверка повторных вызовов перед выполнением инструмента и отдельные пути завершения, ошибки и восстановления.
НовоеРуководства по API

Как остановить цикл вызовов инструментов у ИИ‑агента

Зацикливание ИИ‑агента останавливают перед следующим вызовом инструмента. Сохраните причину остановки и состояние операций, затем разрешайте продолжение только после проверяемого изменения условий.

12 мин
Ошибка неподдерживаемой роли в API и выбор подходящего формата сообщений
Руководства по API

Как исправить API 400 с неподдерживаемой ролью и не сломать системные инструкции

Ошибка unsupported role требует проверки конечного запроса: начальные инструкции, правила в середине диалога и результаты инструментов передаются по-разному. Исправляйте формат для своего API, сохраняя приоритет правил и связи в истории.

10 мин
Варианты подключения Claude Code: подписка, API-ключ и шлюз или облачный провайдер
Claude Code

Настройка Claude Code API: ключи, settings.json, модели и шлюзы

Прямой API подключается через ANTHROPIC_API_KEY с подтверждением в интерактивном сеансе. Для шлюза нужны совместимый API, адрес и его ключ или bearer-токен. Затем проверьте, какие настройки применились и откуда пришёл ответ модели.

11 мин
Схема рабочего контекста, постоянных инструкций и внешних инструментов Claude Code.
Claude Code

Claude Code: контекст, память, MCP и Context7 - сначала чините слой

Начните с /context, чтобы проверить рабочее окно и загрузку инструкций. Через /memory исправьте сохранённые правила, а через /mcp — подключение Context7. Установленный сервер ещё не означает, что документация получена.

9 мин
Схема расхода контекста Claude Code при работе с MCP
Claude Code

Как сжать контекст в Claude Code: MCP, Tool Search и большие ответы

Сначала определите, когда расходуется контекст: до вызова MCP, после большого ответа или за время долгой сессии. Затем измените только этот источник нагрузки и повторите исходную задачу, сохранив нужный доступ и доказательства.

7 мин
Схема подключения Claude Code через OpenRouter, напрямую к DeepSeek и через сторонний прокси
Claude Code

Claude Code с OpenRouter и DeepSeek: маршруты, настройка и первые ошибки

Для DeepSeek через OpenRouter задайте адрес OpenRouter, его ключ и модель deepseek/deepseek-v4.1-flash. Для прямого подключения нужны адрес и ключ DeepSeek с моделью deepseek-flash. Проверьте также роли моделей, источник настроек и фактический запрос у провайдера.

11 мин
Схема проверки клиента, модели и параметров запроса при ошибке top_p deprecated
Claude Code

Claude Code показывает top_p deprecated? Не меняйте route слишком рано, сначала проверьте контракт Opus 4.7

Ошибка top_p deprecated на Opus 4.7 требует убрать параметры выборки там, где формируется конечный запрос. Для Native API и Bedrock Converse это разные поля; исправление проверяют на той же модели и исходной задаче.

9 мин
Диагностика ошибки обмена токена Codex: этап входа, сеть, рабочая область и сохранённые учётные данные
Инструменты разработчика

Codex token exchange failed 403: как восстановить вход

При token exchange failed сначала прочитайте текст после двоеточия: error sending request требует проверки сети процесса, а настоящий 403 — причины отказа. Исправление проверяют на том же хосте и с тем же способом входа.

9 мин
Gemini 3.5 Transcribe: расшифровка записанного аудио и отдельный поток для субтитров
Руководства по API

Gemini 3.5 Transcribe API: как расшифровать запись и запустить live-транскрипцию

Запись расшифровывается через Files и Interactions API, субтитры поступают из отдельной Live-модели. Пользовательский словарь и разметка по словам требуют разных конфигураций; предварительный текст потока нужно заменять, окончательный — сохранять.

9 мин
Пакетная генерация изображений Gemini 3 Pro Image со скидкой 50%
Цены на API и тарифы

Gemini 3 Pro Image Batch API: скидка 50%, расчет стоимости и получение изображений

В официальном Batch API выходное изображение Gemini 3 Pro Image стоит 0,067 USD для 1K/2K или 0,12 USD для 4K по округленной таблице Google. Полный бюджет также включает входные данные, текст и thinking; результаты нужно сопоставлять с запросами по ключам.

9 мин
Бюджетный шлюз останавливает платный запрос LLM-агента до обращения к провайдеру.
Руководства по API

Kill switch расходов API для LLM-агентов: остановите бюджет до вызова провайдера

Чтобы остановить следующий платный запрос LLM-агента, проверяйте расход вместе с незавершёнными резервами до отправки. Неизвестное списание сохраняйте до сверки, а бюджетный отказ передавайте всем подагентам.

11 мин
Ошибка 503 Model is Overloaded и способы обработки сбоев Nano Banana 2
Генерация изображений

Nano Banana 2: что делать при ошибке 503 «Model is Overloaded»

При 503 в Nano Banana 2 повторяйте запрос с задержкой и ограничением времени. Если бюджет исчерпан, отложите задачу; успех подтверждайте полученным изображением, а не кодом 200.

8 мин
Проверка доступа к Nano Banana Pro в приложении Gemini, AI Mode и API
Генерация изображений

Nano Banana Pro пишет `RESTRICTED by System Instructions`? Сначала проверьте маршрут

Сообщение RESTRICTED by System Instructions само по себе не объясняет отказ. Проверьте доступный путь Pro, повторите допустимую задачу и убедитесь, что вернулось изображение, а не только текст.

10 мин
Разбор ошибки Unsupported file URI type при передаче изображения в Nano Banana Pro
Устранение ошибок

Nano Banana Pro пишет «Unsupported file URI type»? Сначала исправьте файловый маршрут Gemini

При «Unsupported file URI type» сначала проверьте, что реально отправлено в поле ссылки: строка, массив, локальный путь или неподставленная переменная. Native Gemini теперь принимает подходящие HTTPS-ссылки; для локального изображения используйте inlineData или загрузку через Files API.

9 мин
Различие между ошибкой соединения с OpenAI API и полученным HTTP-ответом
Руководства по API

Ошибка подключения OpenAI API: сначала проверьте маршрут APIConnectionError

При openai.APIConnectionError: Connection error сначала сохраните исходное исключение и проверьте соединение из неработающего процесса. Отдельно разберите DNS, TLS, прокси и адрес API, а после исправления повторите исходный вызов с ограниченной нагрузкой.

9 мин
Разделение причин ошибки квоты OpenAI API: баланс, расходы, организация и проект
Руководства по API

Ошибка OpenAI API quota exceeded: как проверить баланс и лимиты

Если OpenAI API возвращает quota exceeded или insufficient_quota, начните с error.code: он отличает пустой баланс от месячного ограничения. После исправления проверяйте тот же проект и модель — квитанция об оплате сама по себе не подтверждает восстановление запросов.

7 мин
Переход от Assistant, Thread и Run к конфигурации приложения, Responses и явному циклу инструментов
Руководства по API

Миграция с OpenAI Assistants API на Responses API: история, функции и откат

После отключения Assistants перенос начинается с ваших резервных копий, а не с выгрузки Thread через API. Ниже — преобразование сохранённых сообщений, цикл функций для Responses и проверка состояния, поиска и отката.

11 мин
Выбор между голосовым диалогом, живой транскрибацией и обработкой аудиозаписи.
Руководства по API

OpenAI Realtime API или STT → LLM → TTS: как сравнить полную стоимость

Для расшифровки начните с транскрибации; для разговора сопоставьте Realtime, GPT-Live и всю цепочку STT → LLM → TTS. Недорогой Realtime mini может изменить выбор, а стоимость минуты звонка зависит от того, какой счётчик её измеряет.

12 мин