GPT-6 Sol High или XHigh: когда нужно больше рассуждений?

Как выбрать high или xhigh для GPT-6 Sol: настройки API, стоимость принятых исправлений, задержка и условия сравнения. Примеры расчёта без выдуманных тестов.

Чёрный линейный рисунок метронома на светлой бумаге, приглушённый зелёный фон, концентрические круги и надпись GPT-6 Sol High vs XHigh.

Для сложного исправления можно начать с high, а xhigh оставлять там, где собственная проверка показывает полезное улучшение. Это два значения настройки одной модели gpt-6-sol, а не разные модели. Дополнительные рассуждения не гарантируют корректный патч.

Официальные документы проверены 25 сентября 2026 года. Мы не проводили сравнительный тест этих настроек. Ниже — конфигурация, условные расчёты и процедура оценки. Цены относятся к прямому API OpenAI, а не к Ofox или подписке ChatGPT.

Что меняет effort

Страница Sol перечисляет none, low, medium, high, xhigh, max; по умолчанию используется medium. Таким образом, high уже отличается от стандартной настройки. Руководство по рассуждениям предлагает сопоставлять улучшение результата с задержкой и стоимостью.

ПараметрHighXHigh
IDgpt-6-solgpt-6-sol
Responsesreasoning: {"effort":"high"}reasoning: {"effort":"xhigh"}
С чего начать оценкуОграниченное исправление с тестамиТрудная задача, не решённая high при ясных требованиях
Что проверятьКорректность, регрессии, расходТо же и влияние дополнительной работы на приёмку

Это гипотезы для оценки, а не рейтинг качества. Сначала опишите воспроизводимый сбой, ожидаемое поведение и ограничения. Если агент долго читает несвязанные файлы, более высокий effort сам по себе не делает такую работу полезной.

Зафиксируйте условия сравнения

Для рассуждений с вызовами инструментов используйте Responses. В Chat Completions вызовы функций у Sol работают только с none. Ошибку адаптера при high нельзя записывать как неспособность модели исправить код. См. миграцию вызовов инструментов.

{"model":"gpt-6-sol","reasoning":{"effort":"high"},"input":"Review the supplied patch against the stated acceptance tests."}

Это пример формы запроса, который здесь не выполнялся, а не готовый агент для репозитория. Во второй группе меняется только effort на xhigh. Также фиксируются commit, промпт, инструменты, права, лимит вывода и число повторов. reasoning.mode имеет отдельные режимы standard и pro, независимые от effort; в примере оставлен стандартный режим по умолчанию. Одновременное изменение режима и effort смешает два фактора. Сохраните точные запросы без секретных данных, ID запросов и записи расхода от провайдера.

Каждый запуск начинайте с чистой копии одного состояния. Не передавайте второй группе патч первой или ответы скрытых тестов. Чередуйте порядок на нескольких типичных задачах, сохраняйте тайм-ауты и неудачи. Дополнительные повторы только для проигравшей стороны исказят результат.

Одинаковый тариф не означает одинаковый счёт

При Standard и входе не более 272K токенов Sol стоит $2 за миллион обычных входных и $10 за миллион выходных токенов. Тариф API не разделяет high и xhigh, но рассуждения могут увеличить оплачиваемый вывод, а обращения к инструментам — вход следующих запросов.

Условный запрос с 50 тысячами некешированных входных и 5 тысячами оплачиваемых выходных токенов стоит $0,15. При 15 тысячах выходных токенов — $0,25. Это выбранные количества, не измеренный расход high и xhigh. Видимый текст ответа не заменяет данные usage.

Чтение и запись кеша, инструменты и режим обработки учитываются отдельно. Свыше 272K входных токенов ставки входа и кеша удваиваются, вывода — умножаются на 1,5 для всего запроса. Не приписывайте переход на длинный контекст изменению effort. Подробности — в разборе цены Sol.

Сравнивайте принятые исправления

Определите приёмку до чтения ответов: исходный сбой устранён, нужные тесты проходят, постороннее поведение не изменено, проверяющий понимает причину исправления. Отдельно фиксируйте минуты ручного ревью. Длинное объяснение не обязательно сокращает эту работу.

Сумму расходов всех попыток, включая неудачные, делите на число принятых задач. При нуле принятых задач показатель не определён. Смотрите и на общее время до принятого патча, а не только до первого токена. Дешёвая незавершённая попытка ещё не означает, что результат получен дёшево.

Если результаты равны, а high фактически дешевле или быстрее, оставьте high. Используйте xhigh избирательно, когда улучшение приёмки повторяется. Если не справляются обе настройки, сначала улучшите постановку и поиск файлов. Для выбора самой модели есть сравнение Sol, Luna и Astra. Сохранённые промпты, commit, команды тестов и неудачи позволят пересмотреть решение при изменении проекта.

Часто задаваемые вопросы

Всегда ли XHigh лучше пишет код?
В статье нет сравнительного прогона. Нужно проверить, увеличивает ли дополнительное рассуждение число принятых исправлений настолько, чтобы оправдать расход и ожидание.
Есть ли отдельная наценка за XHigh?
В стандартном API-тарифе Sol отдельной наценки за effort нет. Но настройка может менять расход токенов; режим обработки, длина входа и кеш также влияют на счёт.
Какой API нужен для рассуждений с инструментами?
Responses. В Chat Completions модель Sol поддерживает вызов функций только при reasoning_effort=none, поэтому этот путь не подходит для high/xhigh с инструментами.