Sonnet 5.5 или Opus 5.5: какую модель выбрать для исправлений и ревью

Сравните Sonnet 5.5 и Opus 5.5 для ошибок, ревью и сложных изменений: тарифы, кэш, effort и проверяемые критерии выбора модели.

Линейная иллюстрация рук с заголовком Sonnet 5.5 vs Opus 5.5.

Sonnet 5.5 стоит сначала оценить на чётко заданных задачах, а Opus 5.5 — включить в испытание там, где нужны сложные суждения, исходные данные неоднозначны или повторяются неудачи. Это способ подбора кандидатов, а не доказательство, что Sonnet всегда справляется с малым, а Opus побеждает на большом. Критериями приёмки остаются тесты репозитория и требования ревью.

Anthropic позиционирует Sonnet как более быстрое и менее затратное дополнение к Opus, а Opus — как модель для сложной работы, требующей взвешенных решений. Но тарифы и effort делают выбор сложнее формулы «Sonnet вдвое дешевле». Статья основана на документации, проверенной 29 сентября 2026 года; собственное парное испытание моделей не заявляется.

Одной тарифной таблицы недостаточно

Категория официального Claude APISonnet 5.5Opus 5.5
Ввод, долларов за миллион токенов24
Вывод, долларов за миллион токенов1020
Чтение кэша, долларов за миллион токенов0,200,20
Effort по умолчанию в APIhighmedium
Контекстное окно1M токенов1M токенов

Источники: спецификация Sonnet и спецификация Opus. Это тарифы разработчика, а не лимиты подписки или предложение Ofox. Строка чтения кэша особенно важна при повторном использовании контекста репозитория: большой кэшированный префикс не имеет двукратной разницы в цене, характерной для обычного ввода и вывода.

Представим два синтетических запроса: каждый читает 100 000 токенов кэша и генерирует 2 000 оплачиваемых выходных токенов, остальные категории исключены. Sonnet обойдётся в 0,04 доллара, Opus — в 0,06 доллара. Разница не двукратная, поскольку чтение кэша в примере стоит одинаково. Дополнительные ходы одной из моделей снова изменят расчёт.

Свяжите задачу с проверяемым результатом

ЗадачаС чего начать сравнениеКакие свидетельства сохранить
Ошибка со стабильным воспроизведениемSonnet с умеренным effort, затем при необходимости OpusПадающий тест, патч, полный прогон регрессии
Небольшая функция с явными требованиямиSonnet против текущей рабочей конфигурацииКритерии приёмки, границы изменений
Неясная ошибка между модулямиВключить Opus сразуКонкурирующие объяснения, изученные файлы, проверенная причина
Ревью репозиторияОдинаковый объём для обеих моделейПодтверждённые находки и ложные срабатывания
Рискованная миграцияОтдельно сравнить планирование и проверкуПлан миграции, откат, интеграционные тесты

Это варианты испытаний, а не измеренные показатели успешности. Короткий патч может требовать сложных рассуждений, а длинная механическая правка — быть простой. Число файлов или изменённых строк само по себе плохо отражает трудность.

Читайте результаты вместе с условиями

Стартовый отчёт Artificial Analysis о Sonnet показывает сильные результаты на нескольких задачах и значительно больший расход вывода на max. Он также отмечает проблему структурированного вывода в предварительном развёртывании и запланированные повторные оценки. Этого достаточно, чтобы испытать обе модели, но недостаточно, чтобы определить вашу самую дешёвую конфигурацию.

Сравнение Opus medium с Sonnet max — сравнение конфигураций, а не только моделей. Оно может быть полезным, если опубликованы обе настройки и фактические бюджеты. Даже одинаковые названия effort не гарантируют одинакового объёма вычислений.

В объявлении Anthropic тоже описаны сильные стороны моделей и условия оценки. Разделяйте заявления разработчика, независимые измерения и собственные наблюдения. Расхождения графиков могут объясняться задачами и настройками, а не необъяснимым противоречием.

Простое правило перехода к другой модели

До запуска задайте условие остановки: например, одна предложенная правка и проверка регрессии. При неудаче сначала разберите причину. Если модель неверно поняла задачу, уточните входные данные вместо слепого повышения effort. Если область проблемы найдена правильно, но корректного исправления нет, проба Opus станет полезным контролируемым шагом.

Передайте в новый запуск описание проблемы, нужные файлы и результаты тестов. Не считайте зашифрованные блоки рассуждений переносимыми между моделями. Для Sonnet 5.5 действуют правила модели и диалога из руководства по миграции. Сохраняйте видимые свидетельства вместо расчёта на непрерывность скрытого состояния.

Учитывайте стоимость первой попытки вместе с последующей. Иначе система маршрутизации может выглядеть дешёвой, если неудачу отнести к одной модели, а другой засчитать только финальный успешный запуск. Фиксируйте и время ревью: патч, который компилируется, но требует серьёзной доработки, ещё не завершает задачу.

Если вы работаете по подписке

Нельзя перевести таблицу API в точное количество запросов Claude Code. Лимиты подписки зависят от аккаунта и условий сервиса. Проверяйте фактически выбранную модель, особенно после обновления клиента или смены провайдера, и учитывайте способ оплаты отдельно от названия модели.

В руководстве Claude Code описаны проверка версии и явный выбор. Статья об effort разделяет значения по умолчанию в API и клиенте. Для другого разработчика используйте методику сравнения Sonnet и Sol.

Часто задаваемые вопросы

Sonnet всегда вдвое дешевле Opus?
Нет. Указанные тарифы некэшированного ввода и вывода вдвое ниже, но кэш, расход токенов, повторы и инструменты меняют стоимость результата. Пример выше специально выделяет эту разницу.
Нужно ли всегда использовать Opus для ревью?
Документация не даёт такого общего правила. Сравните подтверждённые находки и ложные срабатывания на типичных ревью, учитывая время человека на проверку каждой находки.
Можно ли переносить один диалог между моделями?
Видимые сообщения могут входить в поддерживаемый сценарий, но для блоков рассуждений действуют правила совместимости. Проверьте документацию миграции вместо предположения о переносе всего скрытого состояния.