Альтернативы Claude Opus 5: закрепить 4.6 или чинить промпт
Opus 5 говорит «готово», когда ничего не сделано? Opus 4.5-4.8 живы по той же цене $5/$25. Таблица «симптом-решение», даты вывода и замер разрыва токенов 1.30x.
TL;DR
Большинство претензий к Opus 5 сводится к задокументированным изменениям поведения, настраиваемым промптом, а не к регрессу возможностей. Claude Opus с 4.5 по 4.8 остаются Active по той же цене $5/$25 с опубликованными нижними границами вывода, поэтому закрепление более ранней версии это эксперимент в одну строку. Наши замеры токенов ниже показывают, во что он обходится на самом деле: на 23% дешевле по входному тексту и дороже на вызовах с большим числом инструментов.
Источник претензий: r/claude «Opus 5 is so awful», 522 голоса, доля одобрения 0.83, 507 комментариев (прочитано 2026-08-12)
Самый частый симптом: говорит, что починил, хотя не починил
Наиболее вероятная причина: thinking отключён, вызов инструмента выводится текстом и не выполняется
Закрепить прежний Opus: 4.5 / 4.6 / 4.7 / 4.8 все Active, те же $5/$25, изменение одной строки
Самый ранний вывод: Opus 4.5, «не раньше 2026-11-24»; у 4.6 это 2027-02-05
Гарантия уведомления: минимум за 60 дней до вывода
Текст дешевле на 4.6: 1,185 против 1,541 токена на одинаковом входе (замер 2026-08-12, 1.30x)
Инструменты дешевле на 5: системный промпт tool-use 286 против 497 токенов
Не тратьте время: снижение effort ради коротких ответов (не работает)
Удалить из промптов: «перепроверь свою работу» и любые шаги верификации
Пост с заголовком “Opus 5 is so awful” держится в верхней части r/claude с 9 августа. Его стоит прочитать, и прочитать внимательно, потому что большинство жалоб в нём описывает поведение, которое Anthropic документирует в собственном руководстве по промптам и считает настраиваемым.
Это не делает жалобы неверными. Это делает их исправимыми, что куда полезнее. Дальше мы сопоставляем самые громкие симптомы с задокументированными причинами, даём идентификаторы моделей для закрепления тем, кто не хочет ничего настраивать, и показываем, во что закрепление обходится на самом деле.
О чём на самом деле сообщают пользователи Opus 5
Пять групп симптомов, и ни одна из них не про «модель хуже проходит бенчмарки». Вот что содержится в треде по состоянию на 12 августа 2026 года.
| Симптом | Показательный комментарий (счёт) | Частота в треде |
|---|---|---|
| Утверждает, что исправление сделано, хотя это не так | Исходный пост: «Каждый раз, когда я прошу opus 5 что-то починить, он говорит, что готово, а потом ничего не чинит» | Исходный пост плюс несколько ответов |
| Подробно проговаривает собственные исправления | «Мне приходится поправлять то, что я час назад сообщил вам как факт» (117) | Верхний комментарий |
| Спорит вместо того, чтобы принять сообщённый баг | «Приходится минут пять доказывать ему, что баг, который я каждый раз вижу, реален» (29) | 3 независимых сообщения |
| Многословные, туманные формулировки | «Говорит как будто с IQ 1000» (13); «изобретает правдоподобно звучащую, но совершенно неопределённую терминологию» (17) | 4 независимых сообщения |
| Хочет закрепить 4.6 и боится, что её уберут | «Если они когда-нибудь уберут opus 4.6, я ухожу» (40); «Opus 4.6 до сих пор просто огонь» (30) | 3 независимых сообщения |
Три оговорки, прежде чем считать это данными.
Доля одобрения треда 0.83, то есть примерно один из шести проголосовавших не согласен. Это реальный раскол, а не консенсус. Кроме того, треды на Reddit жёстко отбирают тех, у кого всё плохо: никто не пишет «мой агентский цикл сегодня в порядке».
Автор поста сидит на подписке, а не на API. Это важнее, чем кажется: в API можно задать effort, переключить thinking и закрепить идентификатор модели. В чат-продукте по большей части нельзя. Часть решений ниже существует только при прямых вызовах API или обращении через шлюз.
Наконец, в треде широко разошлась теория, приписывающая изменения конкретным названным людям, перешедшим между компаниями. Мы её не повторяем. Она непроверяема и представляет собой обвинение в адрес реальных людей.
Дело в модели или в вашем промпте?
Начните отсюда: ответ «отчасти в вашем промпте» встречается чаще, чем следует из треда. Anthropic публикует руководство по промптам специально для Opus 5, и оно начинается с замечания, что модель «хорошо работает из коробки на существующих промптах Claude Opus 4.8», после чего перечисляет поведение, которое «чаще всего требует настройки».
Этот перечень совпадает с тредом почти пункт в пункт:
- Более длинные ответы по умолчанию. «Пользовательские ответы Claude Opus 5 по умолчанию длиннее, чем у прежних моделей Opus».
- Больше комментирования. «Claude Opus 5 охотно комментирует ход агентской работы: он склонен объявлять, что собирается сделать».
- Проговаривание исправлений. «Модель также чаще прежних проговаривает исправления к собственным более ранним утверждениям, что может быть нежелательно в пользовательских продуктах».
- Расширение границ задачи. «Claude Opus 5 также может расширить границы задачи, добавив шаги, о которых не просили».
- Больше subagent. «Claude Opus 5 делегирует subagent охотнее прежних моделей».
Положите этот список рядом с жалобами, и совпадение будет трудно не заметить. Верхний комментарий треда почти дословно описывает пункт про самоисправления. Комментарий про «огромный побочный квест впустую» (12 очков) это расширение границ. Комментарий «использовал других агентов, чтобы выполнить план, который я отклонил» (29 очков) это делегирование subagent.
Это читалось уже в день релиза, а не задним числом. Прочитав собственный анонс Anthropic, Simon Willison написал, что «судя по этому эпизоду из релизного поста, похоже, он может быть безжалостно проактивным», указывая на задачу Frontier-Bench, где Opus 5 ушёл далеко за буквальный запрос. Три недели спустя то же свойство изнутри рабочей сессии читается как побочный квест, о котором никто не просил. Само поведение под сомнение не ставится. Под сомнением то, нужно ли оно вам включённым по умолчанию.
Одна инструкция активно вредит, и её стоит убрать уже сегодня:
Если в вашем промпте есть явные инструкции по верификации («включай финальный шаг проверки для любой нетривиальной задачи», «используй subagent для проверки»), удалите их: такие инструкции вызывают избыточную верификацию у Claude Opus 5, а их удаление сокращает бесполезные токены без потери качества.
Это переворачивает стандартный совет по промптам. Если вы поддерживаете общую библиотеку промптов со сплошным правилом «просить модель самопроверяться», для Opus 5 нужно исключение, а не копия.
Какой симптом какому решению соответствует
Эта таблица рабочая часть статьи. Каждая строка связывает симптом из треда, задокументированную причину и минимальное изменение, которое его устраняет. Ничего из этого не требует уходить от Anthropic.
| Симптом | Задокументированная причина | Минимальное решение | Когда не стоит |
|---|---|---|---|
| Говорит, что починил, ничего не изменилось | Вызов инструмента выведен текстом при отключённом thinking | Включить thinking обратно, снизить effort до low или medium | Если thinking должен оставаться выключенным, используйте комбинированный промпт ниже |
Теги <thinking> в видимом выводе | Тот же путь с отключённым thinking | То же плюс удалить из системного промпта любое правило «не рассуждай» | Явное упоминание тегов задокументировано как менее эффективное |
| Ответы слишком длинные | Выросла многословность по умолчанию | Задавать длину в промпте явно | Не снижайте ради этого effort, это не работает |
| Постоянное «уточню, ранее я ошибся» | Проговаривание исправлений | Ограничить исправления теми, что меняют результат | Оставьте их в блоках thinking; здесь речь о видимом тексте |
| Спорит, реален ли баг | Буквальное прочтение инструкций вида «сообщай только о высокой критичности» | Просить все находки с оценкой уверенности и фильтровать вторым проходом | Не нужно, если вам действительно нужен один отфильтрованный проход |
| Делает работу, о которой не просили | Расширение границ задачи | Явно ограничить границы | Не для открытых исследовательских задач |
| Счёт вырос после перехода с 4.8 | Больше subagent плюс новый токенизатор | Ограничить число subagent, заново прогнать подбор effort | Прежде чем винить только subagent, посмотрите расчёт токенов ниже |
| Нужен быстрый проход на этапе ревью | Точность держится и на низком effort | Смело использовать low или medium | Для требовательной агентской работы поднимайтесь до xhigh |
Формулировка Anthropic про ограничение границ та, которую стоит скопировать дословно:
Выдавайте то, о чём просили, в предполагаемых границах. Рутинные решения принимайте сами и уточняйте только тогда, когда разные прочтения запроса привели бы к существенно разной работе. Если запрос кажется ошибочным или есть лучший подход, скажите об этом одним предложением и продолжайте задачу как поставлено, вместо того чтобы молча сужать, расширять или преобразовывать её. Доводите задачу до конца и останавливайтесь перед действиями, явно выходящими за рамки запрошенного.
Почему он говорит «готово», когда не готово
Потому что при отключённом thinking вызов инструмента может быть написан прозой вместо выполнения. Это самое полезное место в документации Anthropic по Opus 5, и оно объясняет самую громкую жалобу треда лучше любой теории о качестве модели.
Точная формулировка:
При отключённом thinking модель иногда пишет вызов инструмента в пользовательский текст вместо того, чтобы выдать структурированный блок
tool_use. Ход завершается штатно, вызов не выполняется никогда, а в агентских циклах утёкший текст остаётся в истории диалога, так что затрагиваются и последующие ходы. Чаще всего это происходит на нагрузках с большим числом инструментов, например при поиске.
Задержитесь на форме этого сбоя. Нет ошибки. Нет исключения. Ваш harness видит успешный ход, модель говорит, что отредактировала файл, а файла никто не касался. Затем выдуманный вызов лежит в истории и перекашивает всё последующее. Снаружи это неотличимо от модели, которая врёт о своей работе.
Две вещи делают это новой проблемой именно на Opus 5:
- На Opus 5 thinking включён по умолчанию, тогда как на Opus 4.8 пропуск этого поля означал отсутствие размышлений. То есть страдает только код, который явно отказывается от thinking, а такая настройка часто перенесена из времён 4.8, где она была поведением по умолчанию.
- Отключение thinking теперь ограничено уровнем
high. Сочетаниеthinking: {"type": "disabled"}сxhighилиmaxвозвращает 400. Руководство по миграции описывает оба изменения, а наш гид по API Opus 5 разбирает полный дифф конфигурации.
Рекомендованное решение это вообще не промпт. Это перестать отключать thinking:
для большинства задач включённый thinking на уровне
lowработает лучше, чем отключённый thinking при сопоставимой стоимости.
Если у вас интеграция, где thinking обязан оставаться выключенным, Anthropic даёт одну комбинированную инструкцию, смягчающую оба артефакта:
When you use a tool, you may say a brief sentence first. If no tool can express
what the user asked for, say so instead of guessing. Do not include internal or
system XML tags in your response.
Обратите внимание на первую часть. Сбой, судя по всему, происходит из-за подавления вступительной фразы, которую модель хочет написать, поэтому явное разрешение сказать пару слов перед вызовом инструмента и есть часть решения. Также удалите любое правило, запрещающее модели думать или рассуждать: руководство по промптам отмечает, что такие правила увеличивают утечку тегов, а не уменьшают её.
Почему он спорит, что вашего бага не существует
Отчасти из-за инструкции, которую вы, вероятно, написали сами. Трое разных людей в треде описывают одну и ту же схватку: они сообщают о баге, модель настаивает, что его нет, и спор стоит больше времени, чем стоило бы исправление.
Anthropic документирует смежное поведение в разделе про код-ревью руководства по промптам Opus 5:
Если в промпте для ревью написано «сообщай только о проблемах высокой критичности» или «будь консервативен», модель может выполнить эту инструкцию буквально и сообщить меньше; попросите её сообщать обо всём и фильтруйте отдельным проходом.
Важно точно понимать, что это объясняет, а что нет. Здесь описано недоотчётность, когда модель нормально проводит разбор, решает, что находка ниже заданной вами планки, и молчит. Это не объясняет напрямую спор, когда модель активно возражает против бага, который вы можете воспроизвести. Это разные формы сбоя, и утверждать, что документация покрывает обе, было бы небрежно.
Связывает их буквальное следование инструкциям. Формулировки о критичности в вашем промпте задают планку отчётности, и Opus 5 применяет её строже прежних моделей. Как только модель отнесла ваш баг ниже планки, повторный вопрос читается как просьба обосновать классификацию, а не пересмотреть её. Вы получаете защиту, а не второй взгляд.
Изменить нужно две вещи по порядку:
- Разделить поиск и фильтрацию. Просите каждую потенциальную проблему с оценкой уверенности и предполагаемой критичностью, а ранжируйте вторым проходом. Точность не пострадает, и вы перестанете оптимизировать под планку, которую модель применяет за вас.
- Явно возобновить разбор. Не согласны не повторяйте утверждение. Дайте воспроизведение и попросите запустить код: этот ход возвращает разговор от суждений к доказательствам.
Одно контринтуитивное замечание, если хочется добавить в промпт «будь внимательнее, в этот раз реально проверь»: не надо. Это инструкция по верификации, и по разделу выше она складывается с поведением, которое у модели уже есть. Вы купите более длинный ответ, а не более качественный.
Можно ли ещё закрепить Claude Opus 4.6 или 4.8?
Да, и Anthropic публикует дату-минимум для каждой версии. Комментарий «если они когда-нибудь уберут opus 4.6, я ухожу» это самая пригодная к действию тревога в треде, и страница устаревания моделей отвечает на неё напрямую.
| Модель | Идентификатор в ofox | Статус | Самый ранний вывод | Вход / Выход |
|---|---|---|---|---|
| Claude Opus 5 | anthropic/claude-opus-5 | Active | не раньше 2027-07-24 | $5 / $25 |
| Claude Opus 4.8 | anthropic/claude-opus-4.8 | Active | не раньше 2027-05-28 | $5 / $25 |
| Claude Opus 4.7 | anthropic/claude-opus-4.7 | Active | не раньше 2027-04-16 | $5 / $25 |
| Claude Opus 4.6 | anthropic/claude-opus-4.6 | Active | не раньше 2027-02-05 | $5 / $25 |
| Claude Opus 4.5 | anthropic/claude-opus-4.5 | Active | не раньше 2026-11-24 | $5 / $25 |
Каждая версия Opus начиная с 4.5 стоит по прайсу одинаково, поэтому закрепление более старой это решение о поведении, а не о бюджете. Заявленная политика Anthropic: «минимум 60 дней уведомления до вывода модели для публично выпущенных моделей», и у компании есть опубликованные обязательства о сохранении весов моделей после вывода.
Впрочем, вывод не теоретический. Claude Opus 4.1 был объявлен устаревшим 5 июня 2026 года и выведен 5 августа 2026 года, за неделю до этого поста. Об этом сообщили за два месяца, ровно как описывает политика. Честное прочтение такое: 4.6 в безопасности ещё надолго, предупреждение вы получите, и всё равно не стоит строить то, что не переживёт смену идентификатора модели.
Две сноски, если вы закрепляете версию:
- Fast mode есть только у Opus 5 и 4.8. На Opus 4.7 запрос
speed: "fast"возвращает ошибку. На Opus 4.6 он выполняется на обычной скорости и тарифицируется по обычной ставке, и это худший вариант сбоя, потому что он молчаливый. - Уровни effort различаются.
xhighесть у Opus 5, 4.8 и 4.7, но не у 4.6, где верхняя ступеньmaxбез промежуточной.
Почему 4.6, а не 4.8?
Потому что 4.6 это последний Opus на старом токенизаторе, и это единственная граница версий, которая меняет ваш счёт. Тред выбирает 4.6 по ощущению, и процитированные выше комментарии с указанием версии называют именно 4.6, а не 4.8. Более твёрдая причина в следующем разделе. Anthropic сменила токенизатор на 4.7, поэтому 4.8 считает ваш вход ровно так же, как Opus 5, и его закрепление даёт прежнее поведение при новом счёте токенов.
Выбирайте по тому, что именно хотите откатить:
- Поведение и стоимость токенов: 4.6. Самый свежий Opus на прежнем токенизаторе, на 23% дешевле по входному тексту. Вы отдаёте
xhighи fast mode, а его дата-минимум почти на четыре месяца раньше, чем у 4.8. - Только поведение: 4.8. Ближайший откат, на одну версию назад вместо двух, поэтому меньшая часть вашей настройки устаревает. Сохраняет fast mode и
xhigh, дата-минимум до 2027-05-28, а системный промпт tool-use занимает 290 токенов против 497 у 4.6, и это важнее токенизатора, как только ваш трафик становится насыщен инструментами.
Действительно ли закрепление 4.6 обходится дешевле?
По входным токенам на одном и том же тексте да, примерно на 23%. Мы это замерили. Это та часть, о которой в треде никто не упоминает, и она бьёт по допущению, что одинаковый прайс означает одинаковый счёт.
Anthropic отмечает на странице цен, что «модели Claude 4.7 и новее используют новый токенизатор… Этот токенизатор даёт примерно на 30% больше токенов на том же тексте. Claude Sonnet 4.6 и более ранние модели используют прежний токенизатор».
Мы отправили одну и ту же полезную нагрузку в 4,365 символов (технический текст плюс блок кода на Python, форма реального запроса на код-ревью) пяти моделям через ofox и считали prompt_tokens из ответа. Та же нагрузка, тот же запрос, тот же день.
| Модель | Токенизатор | prompt_tokens | против Opus 4.6 |
|---|---|---|---|
| Claude Opus 5 | новый | 1,541 | 1.30x |
| Claude Opus 4.8 | новый | 1,541 | 1.30x |
| Claude Sonnet 5 | новый | 1,541 | 1.30x |
| Claude Opus 4.6 | прежний | 1,185 | 1.00x |
| Claude Sonnet 4.6 | прежний | 1,185 | 1.00x |
Замер 2026-08-12 на api.ofox.ai. Одна полезная нагрузка это одна точка данных, а не бенчмарк, и Anthropic прямо говорит, что «точная величина прироста зависит от содержимого и формы нагрузки». Наши 1.30x попали внутрь названных Anthropic примерно 30%, и это максимум, что можно заключить из одной пробы.
При $5 за миллион входных токенов один и тот же документ стоит $0.0077 на Opus 5 и $0.0059 на Opus 4.6. Ничтожно на запрос и не ничтожно на миллионе агентских ходов.
Теперь противовес, потому что счёт идёт не в одну сторону. Anthropic публикует накладные расходы системного промпта tool-use по моделям, и здесь Opus 5 экономнее:
- Opus 5: 286 токенов (выбор инструмента
auto/none) - Opus 4.8: 290 токенов
- Opus 4.6: 497 токенов
- Opus 4.7: 675 токенов
То есть запрос с большим числом инструментов платит на 4.6 лишние 211 токенов за вызов, которых Opus 5 не платит. На коротких запросах с крупными схемами инструментов закрепление 4.6 может обойтись дороже, а не дешевле. Обратите внимание, где оказывается 4.8: 290 токенов это в пределах 4 токенов от Opus 5 и на 207 меньше, чем у 4.6, поэтому при насыщенном инструментами трафике именно 4.8 даёт прежнее поведение без штрафа на накладных расходах инструментов. Прежде чем считать закрепление оптимизацией расходов, определите, по какую сторону этой границы лежит ваш трафик. Если в игре кеширование промптов, учтите, что Opus 5 также снижает минимальный кешируемый префикс до 512 токенов против 4,096 у Opus 4.6; подробнее об этом в нашем материале про расчёт стоимости кеширования промптов.
А если вы хотите уйти от Anthropic?
Тогда самый дешёвый полезный ход это спуститься на ступень внутри Anthropic, прежде чем выходить наружу. Отсортировано по тому, сколько придётся менять на вашей стороне.
- Claude Sonnet 5,
anthropic/claude-sonnet-5, $2/$10. На 60% дешевле Opus и по входу, и по выходу, контекст 1M, а ставка $2/$10 теперь постоянная после того, как Anthropic отменила повышение до $3/$15 с 1 сентября. То же семейство промптов, так что настройка в основном переносится. Прямое сравнение есть в нашем материале Sonnet 5 против Opus 4.8. - Claude Haiku 4.5,
anthropic/claude-haiku-4.5, $1/$5. Для subagent и механических проходов. Контекст 200K, а не 1M. - GPT-5.6 Sol,
openai/gpt-5.6-sol, $5/$30. Чаще всего называемая в треде замена. Выигрывает по пропускной способности вывода и проигрывает по времени до первого токена; цифры в нашем посте Opus 5 против GPT-5.6 Sol, это сравнение бенчмарков, а не рекомендация по маршрутизации. - Kimi K3,
moonshotai/kimi-k3, $3/$15. 1M контекста на вход и 1M на выход, что необычно. См. Kimi K3 против GPT-5.5 против Opus 4.8.
Одно уточнение: ни один из этих вариантов не является заменой «как есть» для перечисленных выше симптомов. Сменить вендора ради многословности значит унаследовать настройки многословности другого вендора и всё равно переписать промпты. Закрепление более раннего Opus это единственный вариант на этой странице, который меняет одну строку и больше ничего.
Если ваша претензия относится к инструменту разработки, а не к модели, то модель может вообще не быть переменной. Наш обзор harness для агентов-программистов разбирает, какие harness вообще позволяют менять модель под капотом.
Как запустить две версии модели без двух аккаунтов
Каждому решению выше нужен A/B, а A/B между версиями моделей обычно означает два счёта и два набора учётных данных. Это неудобная часть подхода «просто закрепи 4.6 и посмотри». Вам нужно, чтобы вчерашняя и сегодняшняя модели отвечали на один и тот же промпт бок о бок, с сопоставимыми счётчиками токенов, а консоль вендора не рассчитана на то, чтобы это было удобно.
Поскольку Opus с 4.5 по 5 говорят на одном и том же OpenAI-совместимом HTTP-формате, разница между ними это одна строка в теле запроса. Направьте один клиент на один base URL, пройдите циклом по идентификаторам моделей и считайте usage из каждого ответа. Это работает одинаково, сравниваете ли вы две версии Anthropic или модель Anthropic против модели Moonshot.
Python: один промпт, четыре версии модели
from openai import OpenAI
client = OpenAI(base_url="https://api.ofox.io/v1", api_key="YOUR_OFOX_KEY")
PROMPT = "Find the race condition in this handler and fix it. Do not refactor anything else."
for model in [
"anthropic/claude-opus-5",
"anthropic/claude-opus-4.8",
"anthropic/claude-opus-4.6",
"anthropic/claude-sonnet-5",
]:
r = client.chat.completions.create(
model=model,
max_tokens=2048,
messages=[{"role": "user", "content": PROMPT}],
)
u = r.usage
print(f"{model:32} in={u.prompt_tokens:>6} out={u.completion_tokens:>6}")
Node: та же форма
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.ofox.io/v1",
apiKey: process.env.OFOX_API_KEY,
});
const PROMPT =
"Find the race condition in this handler and fix it. Do not refactor anything else.";
for (const model of [
"anthropic/claude-opus-5",
"anthropic/claude-opus-4.8",
"anthropic/claude-opus-4.6",
"anthropic/claude-sonnet-5",
]) {
const r = await client.chat.completions.create({
model,
max_tokens: 2048,
messages: [{ role: "user", content: PROMPT }],
});
console.log(
`${model.padEnd(32)} in=${r.usage.prompt_tokens} out=${r.usage.completion_tokens}`,
);
}
Именно этим циклом и получена таблица токенов выше. Прогоните его на своих промптах, прежде чем делать выводы из наших, и сохраняйте числа usage, а не только ответы: в этом конкретном сравнении счётчики токенов это половина картины.
Для effort и явного управления thinking используйте нативную для Anthropic конечную точку https://api.ofox.io/anthropic с голым идентификатором claude-opus-5, поскольку у этих параметров нет OpenAI-совместимого эквивалента.
Что же выбрать на практике?
Сначала правки промпта, потом закрепление, смена вендора в последнюю очередь. В порядке возрастания того, во что это вам обойдётся:
- Удалите инструкции по верификации. Бесплатно, займёт минуту, и Anthropic говорит, что это сокращает бесполезные токены без потери качества. Сделайте это, даже если вы довольны Opus 5.
- Включите thinking обратно, если вы его отключали, и вместо этого опустите
effortдоlowилиmedium. Это решение жалобы «говорит, что готово, а оно не готово». - Добавьте инструкции о краткости и границах задачи. Два абзаца системного промпта против задокументированного изменения поведения.
- Закрепите Opus 4.6 или 4.8, если вы сделали все три шага и всё равно предпочитаете прежнее поведение. Тот же прайс, опубликованная нижняя граница вывода минимум на год вперёд, и вернуться обратно тоже одна строка. Берите 4.6, если хотите ещё и прежний токенизатор, 4.8 если нужны fast mode и
xhigh. - Перейдите на Sonnet 5, если настоящая претензия это стоимость. На 60% дешевле Opus в обе стороны и то же семейство промптов.
- Смените вендора только если задача действительно лучше ложится на другую модель, а не потому что тред был злым. Промпты вы будете переписывать в любом случае.
Тред r/claude это реальный сигнал о реальном изменении поведения. Просто это не сигнал о том, что модель поглупела, и один из шести проголосовавших в том самом треде уже не согласен с заголовком.
Источники
Часто задаваемые вопросы
- Можно ли до сих пор использовать Claude Opus 4.6 вместо Opus 5?
- Да. Opus 4.5, 4.6, 4.7 и 4.8 указаны как Active на странице устаревания моделей Anthropic, и ни у одной нет даты вывода. Самая ранняя опубликованная нижняя граница вывода в линейке Opus у 4.5: «не раньше 24 ноября 2026 года», у 4.6 это «не раньше 5 февраля 2027 года». Anthropic также обязуется предупреждать минимум за 60 дней до вывода публично выпущенной модели. В API идентификатор модели claude-opus-4-6, через ofox это anthropic/claude-opus-4.6.
- Почему Claude Opus 5 говорит, что что-то починил, хотя это не так?
- Самая частая механическая причина в том, что thinking отключён. Anthropic документирует: при выключенном thinking Opus 5 иногда пишет вызов инструмента в видимый текст вместо структурированного блока tool_use. Ход завершается штатно, вызов не выполняется никогда, а в агентском цикле утёкший текст остаётся в истории и влияет на последующие ходы. Решение: снова включить thinking, а расходы контролировать уровнем effort low или medium.
- Дешевле ли закрепить Opus 4.6, чем использовать Opus 5?
- По входным токенам на одном и том же тексте да, примерно на 23%. Обе модели стоят $5 за миллион входных и $25 за миллион выходных токенов, но Opus 4.7 и новее используют новый токенизатор, который, по словам Anthropic, даёт примерно на 30% больше токенов на том же тексте. Мы замерили 1,541 токен на Opus 5 против 1,185 на Opus 4.6 для одинаковой полезной нагрузки в 4,365 символов, разрыв 1.30x. Это не чистый выигрыш: системный промпт tool-use у Opus 5 занимает 286 токенов против 497 у Opus 4.6, поэтому запросы с большим числом инструментов часть экономии отыгрывают назад.
- Что закреплять: Claude Opus 4.6 или Claude Opus 4.8?
- 4.6, если нужна ещё и экономия на входных токенах; 4.8, если нужно только прежнее поведение. Anthropic сменила токенизатор на Opus 4.7, поэтому 4.8 считает вход ровно так же, как Opus 5, и его закрепление не экономит токены вообще. 4.6 это самый свежий Opus на прежнем токенизаторе, замер дал 1,185 против 1,541 на той же нагрузке. Плата за это: у 4.6 нет уровня effort xhigh и он молча игнорирует fast mode, тогда как 4.8 сохраняет и то и другое, имеет более позднюю нижнюю границу вывода (не раньше 2027-05-28 против 2027-02-05 у 4.6) и системный промпт tool-use на 290 токенов против 497 у 4.6. На трафике с большим числом инструментов эти накладные расходы могут перевесить экономию на токенизаторе.
- Сделает ли снижение effort ответы Claude Opus 5 короче?
- Нет, и это самая частая бесполезная правка. Anthropic указывает, что effort управляет объёмом размышлений, а не длиной видимого ответа, и что на Opus 5 изменение effort не даёт надёжного сокращения ответов. Задавайте длину явно в промпте. effort по-прежнему правильный рычаг для стоимости токенов и задержки, просто не для многословности.
- Нужно ли убрать из промпта инструкцию «перепроверь свою работу»?
- На Opus 5 да. В руководстве Anthropic по промптам сказано, что модель проверяет себя сама без напоминаний, а инструкции о проверке и самопроверке, перенесённые из прежних моделей, вызывают избыточную верификацию. Их удаление сокращает бесполезные токены без потери качества. То же относится к обвязке в harness, добавляющей отдельный проход верификации.
- Хуже ли Claude Opus 5, чем Opus 4.6?
- По бенчмаркам возможностей нет, но «хуже для вашей задачи» это другой вопрос. Жалобы на r/claude группируются вокруг изменений поведения, которые Anthropic документирует и считает настраиваемыми через промпт: более длинные ответы по умолчанию, больше комментирования своих действий, более охотный запуск subagent, проговаривание собственных исправлений и расширение границ задачи. Если ваш промпт настраивался под 4.6 или 4.8 и переехал без изменений, вы скорее всего видите долг по настройке, а не регресс возможностей.
- Какие есть альтернативы Claude Opus 5 для программирования?
- Три пути в порядке нарастания изменений. Остаться в Anthropic и закрепить более ранний Opus (та же цена, промпт переписывать не нужно). Спуститься на ступень ниже к Claude Sonnet 5 за $2/$10, что на 60% дешевле по входу и на 60% дешевле по выходу. Либо уйти к GPT-5.6 Sol ($5/$30) или Kimi K3 ($3/$15). Закрепление самый дешёвый эксперимент, потому что меняет одну строку.


