Что такое контекстное окно: лимиты токенов по моделям (2026)
Контекстное окно — это бюджет токенов на один запрос, вход плюс выход. Один и тот же документ на 9 моделях: от 614 до 957 токенов, разброс в 1.56 раза.
Harness для AI-кодинга 2026: 9 инструментов и выбор модели
Данные OpenRouter по 9 harness: внутри Claude Code чаще всего запускают GLM 5.2 — больше, чем все модели Anthropic вместе. Сначала цикл, потом модель.
429 Too Many Requests: что значит и когда повторять (2026)
429, это один код на 5 разных проблем. Сначала читайте retry-after, откатывайтесь 1s/2s/4s с джиттером, а на биллинговых 429 повтор пропускайте.
DeepSeek V4 Flash: 6 способов платить меньше (2026)
DeepSeek предупредил о росте цен на API. Попадание в кэш дешевле в 50 раз, разброс цены кэша между хостами 28x, очевидный slug выдаёт старую сборку 0423.
Seedance 2.0: как пользоваться, 6 фиксов и цена (2026)
Лицо плывёт, лезут субтитры? Спецификация промптов ByteDance, 6 фиксов и 720p по $0.16/с через один ключ ofox.
Qwen 3.8 Max в Codex CLI 2026: конфиг, лимит 258K, цена
Рабочий конфиг Codex CLI для Qwen 3.8 Max: 6 строк через ofox, $0.08 за три реальные задачи против $0.54 на GPT-5.5, плюс лимит контекста 258K.
Qwen 3.8 Max против DeepSeek V4 Flash: 3 балла, счёт в 345 раз
Qwen 3.8 Max набирает 53 в AA Intelligence Index против 50 у DeepSeek V4 Flash. На трёх задачах он обошёлся в 345 раз дороже и работал в 6 раз дольше.
Qwen 3.7 Max vs Kimi K3 vs DeepSeek V4: разрыв в цене 34x
Один и тот же набор оценок: Kimi K3 набирает 57 и стоит $2437 за прогон. DeepSeek V4 Flash набирает 50 и стоит $72. Qwen 3.7 Max набирает 46 за $1604.
Qwen 3.8 Max: цена, контекст и доступ к API (2026)
Qwen 3.8 Max вышел 3 августа 2026: $2/$6 за 1M токенов, контекст 1M, вывод до 131K, открытые веса на следующей неделе. Уже на ofox как bailian/qwen3.8-max.
Лучшие поставщики LLM API 2026: 4 типа и цена каждого
Сравнение четырёх типов LLM API по данным августа 2026 года, с ценами Ofox за сентябрь и различием базовых тарифов и цен провайдера.