Разделы wikimax_tokens или max_completion_tokens
WikiРешение ошибок и совместимостьmax_tokens или max_completion_tokens
OpenAI

max_tokens или max_completion_tokens

Как выбрать правильный лимит ответа для GPT, reasoning-моделей и OpenAI-compatible API.

Пошаговое объяснение без лишних деталей

Текст ошибки

Unsupported parameter: max_tokens

Не публикуйте API-ключ, полный request body с секретами или персональные данные. Для поддержки сохраните request ID и время запроса.

Почему это происходит

Новые reasoning-модели могут принимать max_completion_tokens или max_output_tokens вместо старого max_tokens.

КлиентыOpenAI SDK, Codex, Cursor
МоделиGPT, o-series, Reasoning models

Как проверить

  • Уточните endpoint: Chat Completions или Responses.
  • Проверьте документацию выбранной модели.
  • Удалите все лимиты и повторите минимальный запрос.

Как исправить

  • Для Chat Completions reasoning-моделей используйте max_completion_tokens.
  • Для Responses API используйте max_output_tokens.
  • Не отправляйте несколько эквивалентных лимитов одновременно.

После исправления сначала отправьте короткий тестовый запрос. Затем верните tools, streaming и дополнительные параметры по одному.

Термины на этой странице

Короткая расшифровка обозначений, которые встречаются в этом разделе.

ТерминBase URL
Что означаетБазовый адрес API, к которому клиент добавляет нужный маршрут.
ТерминAPI-ключ
Что означаетСекрет для авторизации и списания запросов с вашего баланса.
ТерминModel ID
Что означаетТочное системное имя модели из каталога Elysium AI.
ТерминEndpoint
Что означаетМаршрут конкретной операции после базового адреса API.
ТерминRequest
Что означаетОдин запрос клиента к API вместе с его заголовками и телом.
ТерминResponse
Что означаетРезультат обработки запроса: статус, заголовки и данные.