Claude Opus 5 API: уровень Fable 5 за половину цены — полный гайд

Claude Opus 5 (claude-opus-5) вышел 24 июля 2026 по цене $5/$25 — вдвое дешевле Fable 5. Бенчмарки, изменения API от Opus 4.8 к 5 и как вызвать модель через ofox.

Claude Opus 5 API: уровень Fable 5 за половину цены — полный гайд

TL;DR — Anthropic выпустила Claude Opus 5 24 июля 2026 по цене $5/$25 — столько же, сколько Opus 4.8, и вдвое дешевле Fable 5. Идея: интеллект почти на уровне Fable 5 за половину цены. Model ID — claude-opus-5, контекст 1M, max output 128K, дата обучения — май 2026. Три изменения API, важные при миграции: адаптивное thinking теперь включено по умолчанию, отключение thinking ограничено уровнем high (disabled + xhigh/max = 400) и минимум для кэша снижается до 512 токенов. Всё остальное — цены, контекст, отклонение sampling-параметров, отсутствие prefill — не изменилось с 4.8. Проверено на ofox нашим ключом (2026-07-25).

Что выпустила Anthropic

Claude Opus 5 — новая рекомендованная по умолчанию модель Anthropic для сложного агентного кодинга и корпоративных задач. Model ID — claude-opus-5: фиксированный снимок без даты, без суффикса -20260724, который нужно отслеживать. По умолчанию модель несёт полное окно контекста в 1M токенов, 128K max output токенов (до 300K через Message Batches API с beta header output-300k-2026-03-24) и дату обучения — май 2026.

Главное — соотношение цены и возможностей. Anthropic описывает Opus 5 как «вдумчивую и проактивную модель, которая приближается к фронтирному интеллекту Claude Fable 5 за половину цены». Fable 5 стоит $10/$50 за миллион; Opus 5 — $5 за вход / $25 за выход, та же ставка, что у Opus 4.8 с мая, и вдвое меньше, чем у Fable 5. Fast Mode запускает ту же модель на скорости вывода до 2,5x за удвоенную базовую стоимость.

Чтобы не путаться в иерархии: Fable 5 по-прежнему самая мощная модель Anthropic. Opus 5 — это модель, к которой вы тянетесь, когда хотите получить бóльшую часть тех же возможностей, не переплачивая за премиум Fable.

Бенчмарки: собственные цифры Anthropic

Каждая цифра ниже — данные Anthropic, независимо не проверены: числа с запуска от вендора, а не результаты сторонних тестов. Считайте их лучшим случаем и прогоняйте собственные оценки, прежде чем на них полагаться. Паттерн по крайней мере согласован по широкому набору тестов:

БенчмаркЦифра Anthropic (независимо не проверена)
Frontier-Bench v0.1Превосходит все остальные модели; более чем вдвое перекрывает результат Opus 4.8
CursorBench 3.2В пределах 0,5% от пика Fable 5, при половине стоимости
ARC-AGI 3Примерно в 3 раза выше следующей по силе модели
OSWorld 2.0 (computer use)Обгоняет результат Fable 5 при трети стоимости
Zapier AutomationBenchДоля успешных прохождений ~1,5x относительно следующей модели
GDPval-AA (реальная экономическая работа)Уровень state of the art

Каждое число в этой таблице — данные Anthropic, независимо не проверены: собственные бенчмарки Anthropic с запуска. Мы не воспроизводили их независимо.

Сквозная линия — агентные задачи и computer use: длинногоризонтный кодинг, управление рабочим столом, автоматизация реальных задач, где Opus 5 либо не уступает Fable 5 за куда меньшие деньги, либо явно обходит остальное поле. Единственная честная оговорка, которую Anthropic называет сразу: Opus 5 остаётся позади Mythos 5 в задачах эксплуатации уязвимостей в кибербезопасности и биологических исследований — их обслуживает отдельная линейка моделей для защитного применения. Если ваша нагрузка не в этих двух доменах, этот разрыв вас не касается.

Для независимой перекрёстной проверки того, как прошлое поколение реально показало себя на настоящей работе, наш разбор релиза Opus 4.8 детально проходит по стороннему лидерборду GDPval-AA.

Что изменилось по сравнению с Opus 4.8 (то, что ломает код)

Opus 5 в большинстве аспектов сохраняет тот же интерфейс запросов, что и 4.8, но три изменения удивят вас, если просто поменять строку модели и выкатить.

1. Адаптивное thinking включено по умолчанию. В Opus 4.8 запрос без поля thinking выполнялся без мышления. В Opus 5 тот же запрос теперь выполняется с адаптивным thinking. Поскольку max_tokens — это жёсткий потолок на весь вывод (thinking плюс видимый ответ), нагрузка, настроенная под no-thinking 4.8, теперь может обрезаться. Пересмотрите max_tokens или передавайте thinking: {"type": "disabled"}, чтобы сохранить старое поведение. (проверено на ofox, 2026-07-25: запрос к claude-opus-5 без поля thinking возвращает блок thinking.)

2. Отключение thinking ограничено уровнем high. Это та самая 400, которой никто не ждёт. Вы всё ещё можете выключить thinking, но только на effort high или ниже. Скомбинируйте thinking: {"type": "disabled"} с effort xhigh или max — и запрос будет отклонён:

# Rejected on Opus 5 — 400 error
client.messages.create(
    model="claude-opus-5",
    max_tokens=16000,
    thinking={"type": "disabled"},
    output_config={"effort": "xhigh"},   # xhigh/max + disabled = 400
    messages=[{"role": "user", "content": "..."}],
)

# Fix: either re-enable thinking at high effort...
output_config={"effort": "xhigh"}         # thinking on by default
# ...or keep it off and drop to high or below
thinking={"type": "disabled"}, output_config={"effort": "high"}

3. Минимум для кэша снижается до 512 токенов (было 1024 в 4.8). Короткие системные промпты, которые раньше были слишком малы для кэширования, теперь создают записи в кэше без единого изменения в коде — маленький бесплатный выигрыш на счетах за prompt caching. (проверено на ofox, 2026-07-25: кэшируемый префикс ~530 токенов на claude-opus-5 создаёт запись в кэше; ~515 токенов — нет.)

Ещё два момента, которые стоит знать: изменение инструментов посреди диалога теперь возможно без инвалидации prompt cache (beta header mid-conversation-tool-changes-2026-07-01), и Opus 5 поставляется с классификаторами безопасности по кибербезопасности, так что вам следует обрабатывать stop_reason: "refusal" и можно включить автоматические фолбэки моделей (fallbacks: "default", beta header server-side-fallback-2026-07-01).

Что не ново: цены, окно контекста 1M, вывод 128K и жёсткие отклонения, перенесённые из 4.8 — нестандартные temperature/top_p/top_k, ручной budget_tokens и assistant prefill по-прежнему возвращают 400. Priority Tier по-прежнему не поддерживается.

Заметки по effort и промптингу

Opus 5 поддерживает полную лестницу effort — low, medium, high, xhigh, max — и по умолчанию использует high в Claude API и Claude Code. Рекомендация Anthropic — прогнать свежий свип по effort, а не переносить настройки 4.8, и протестировать max для критичных по возможностям задач (задавайте большой max_tokens, начиная примерно с 64K, когда запускаете xhigh или max).

Два сдвига в поведении стоят ревизии промптов. Opus 5 сам проверяет свою работу без указания, так что явные инструкции «перепроверь свой вывод» теперь ведут к избыточной верификации — уберите их. И его ответы по умолчанию длиннее, чем у 4.8; понижение effort сокращает thinking, но не видимую длину, так что если нужен более короткий вывод — явно просите краткость или целевую длину.

Как вызвать Opus 5 через ofox

Model ID на ofox.aianthropic/claude-opus-5, на том же OpenAI-совместимом эндпоинте, что и любая другая модель — без отдельного аккаунта Anthropic, без отдельного биллинга. Направьте свой существующий OpenAI SDK на base URL ofox и поменяйте две строки:

from openai import OpenAI

client = OpenAI(base_url="https://api.ofox.io/v1", api_key="your-ofox-key")

response = client.chat.completions.create(
    model="anthropic/claude-opus-5",
    messages=[{"role": "user", "content": "Refactor this module for testability..."}],
)

Чтобы использовать адаптивное thinking и параметр effort, вызывайте вместо этого нативный эндпоинт Anthropic — model ID теряет префикс провайдера:

import anthropic

client = anthropic.Anthropic(
    base_url="https://api.ofox.io/anthropic",
    api_key="your-ofox-key",
)

response = client.messages.create(
    model="claude-opus-5",
    max_tokens=8000,
    thinking={"type": "adaptive"},
    output_config={"effort": "high"},   # low | medium | high | xhigh | max
    messages=[{"role": "user", "content": "Audit this service for race conditions..."}],
)

(Оба пути вызова выше проверены на ofox, 2026-07-25: OpenAI-совместимый маршрут возвращает обычный completion, а нативный маршрут Anthropic с thinking: {"type": "adaptive"} плюс effort возвращает блок thinking.)

Прогон через один шлюз также делает вопрос миграции эмпирическим: пропустите одни и те же промпты через Opus 5, Opus 4.8 и Fable 5 на одном ключе и сравните качество и число токенов на вашей нагрузке, прежде чем переключать прод.

Opus 5 vs Fable 5 vs Sonnet 5: что выбрать

  • Claude Opus 5 ($5/$25) — новый выбор по умолчанию для агентного кодинга, computer use и длинногоризонтных корпоративных задач. Лучшее соотношение возможностей к цене в линейке прямо сейчас.
  • Claude Fable 5 ($10/$50) — потолок. Тянитесь к нему только когда задаче действительно нужна самая мощная модель, а стоимость вторична; на многих агентных бенчмарках Opus 5 отстаёт в пределах погрешности округления за половину цены.
  • Claude Sonnet 5 ($3/$15) — уровень скорости и стоимости. Качество почти как у Opus на кодинге для высокообъёмной или чувствительной к задержкам работы, где не нужна глубина рассуждений уровня Opus.

Если вы сегодня на Opus 4.8, это чистая миграция: та же цена, более высокие баллы, одно изменение строки модели плюс три подводных камня выше.

Вывод

Opus 5 — это очередной апгрейд Opus без звёздочки на цене: те же $5/$25, ощутимо более высокие баллы по кодингу и computer use, и заявление Anthropic о возможностях почти на уровне Fable 5 за половину цены выдерживает проверку на широком наборе бенчмарков. Оговорки узкие и честные: цифры бенчмарков — данные Anthropic, независимо не проверены (прогоняйте собственные оценки), отключение thinking теперь конфликтует с высокими уровнями effort, а вывод по умолчанию длиннее — следите за max_tokens и бюджетами задержек.

Для новых проектов начинайте с Opus 5. Для всего, что в проде на 4.8, поменяйте строку модели, пересмотрите max_tokens, проверьте каждый запрос, отключающий thinking, и выкатывайте.


По теме: разбор релиза Claude Opus 4.8 — предшественник и его результат на независимом лидерборде. Fable 5 vs Opus 4.8 vs GPT-5.5 на SWE-bench — где флагманский уровень оказывается на кодинге.