ДокументацияПоддержка
Решение ошибок и совместимость

max_tokens или max_completion_tokens

Как выбрать правильный лимит ответа для GPT, reasoning-моделей и OpenAI-compatible API.

Все руководства (.md)

Текст ошибки

Unsupported parameter: max_tokens

Не публикуйте API-ключ, полный request body с секретами или персональные данные. Для поддержки сохраните request ID и время запроса.

Почему это происходит

Новые reasoning-модели могут принимать max_completion_tokens или max_output_tokens вместо старого max_tokens.

КлиентыМодели
OpenAI SDK, Codex, CursorGPT, o-series, Reasoning models

Как проверить

  • Уточните endpoint: Chat Completions или Responses.
  • Проверьте документацию выбранной модели.
  • Удалите все лимиты и повторите минимальный запрос.

Как исправить

  • Для Chat Completions reasoning-моделей используйте max_completion_tokens.
  • Для Responses API используйте max_output_tokens.
  • Не отправляйте несколько эквивалентных лимитов одновременно.
После исправления сначала отправьте короткий тестовый запрос. Затем верните tools, streaming и дополнительные параметры по одному.
Термины на этой странице
ТерминЧто означает
Base URLБазовый адрес API, к которому клиент добавляет нужный маршрут.
API-ключСекрет для авторизации и списания запросов с вашего баланса.
Model IDТочное системное имя модели из каталога Elysium AI.
EndpointМаршрут конкретной операции после базового адреса API.
RequestОдин запрос клиента к API вместе с его заголовками и телом.
ResponseРезультат обработки запроса: статус, заголовки и данные.