OpenAI
max_tokens или max_completion_tokens
Как выбрать правильный лимит ответа для GPT, reasoning-моделей и OpenAI-compatible API.
Пошаговое объяснение без лишних деталей
Текст ошибки
Unsupported parameter: max_tokens
Не публикуйте API-ключ, полный request body с секретами или персональные данные. Для поддержки сохраните request ID и время запроса.
Почему это происходит
Новые reasoning-модели могут принимать max_completion_tokens или max_output_tokens вместо старого max_tokens.
КлиентыOpenAI SDK, Codex, Cursor
МоделиGPT, o-series, Reasoning models
Как проверить
- Уточните endpoint: Chat Completions или Responses.
- Проверьте документацию выбранной модели.
- Удалите все лимиты и повторите минимальный запрос.
Как исправить
- Для Chat Completions reasoning-моделей используйте max_completion_tokens.
- Для Responses API используйте max_output_tokens.
- Не отправляйте несколько эквивалентных лимитов одновременно.
После исправления сначала отправьте короткий тестовый запрос. Затем верните tools, streaming и дополнительные параметры по одному.
Термины на этой странице
Короткая расшифровка обозначений, которые встречаются в этом разделе.
ТерминBase URL
Что означаетБазовый адрес API, к которому клиент добавляет нужный маршрут.
ТерминAPI-ключ
Что означаетСекрет для авторизации и списания запросов с вашего баланса.
ТерминModel ID
Что означаетТочное системное имя модели из каталога Elysium AI.
ТерминEndpoint
Что означаетМаршрут конкретной операции после базового адреса API.
ТерминRequest
Что означаетОдин запрос клиента к API вместе с его заголовками и телом.
ТерминResponse
Что означаетРезультат обработки запроса: статус, заголовки и данные.