Лимит Claude Code исчерпан слишком быстро: почему и 7 способов починить (2026)

Лимит Claude Code кончился к обеду? Opus жжёт в разы больше Sonnet, субагенты — 7x токенов, MCP съедает 33% контекста. Разбор через /usage и 7 решений.

claude-codecost-optimization

Ошибка Rate Limit Reached в Claude Code: причины 429 и 6 решений (2026)

429 в Claude Code? Tier 1 режет Sonnet 4.x до 30k ITPM / 50 RPM. Читай retry-after, добавь backoff, режь ITPM кэшем или пуль ёмкость. 6 решений.

claude-codetroubleshooting

Claude Tag в Slack (2026): настройка в 4 шага, ambient-режим, дедлайн 3 августа

Claude Tag — общий @Claude-сокомандник в Slack на Opus 4.8. Настройка в 4 шага, ambient-режим, админ-скоупы и переход с Claude in Slack к 3 августа 2026.

claudetutorial

Запуск GLM 5.2 локально (2026): 2-bit на 256 GB Mac или коробке с 4090

GLM 5.2 (753B) на своём железе: 2-bit влезает в Mac Studio на 256 GB, 4-bit просит 512 GB, ~3-9 tok/s. GGUF-кванты для llama.cpp, LM Studio и 4090.

glmopen-weights

Маршрутизация GLM-5.2, DeepSeek V4, MiniMax M3 и Kimi K2.6 через один API (2026)

Четыре модели за одним ключом ofox: blended от $0.19 до $2.40 за M, разрыв 12.86x. На 1000 задач в день счёт падает с $4205 до $1453. Python и Node.

model-comparisoncost-optimization

GLM-5.2 против GPT-5.5: стоимость токенов при 10K/100K/1M запросов в день (2026)

GLM-5.2 ($1.4/$4.4 за M) против GPT-5.5 ($5/$30): blended $2.40 против $13.33 за M, соотношение 5.56x.

glmopenai

GLM 5.2 на своём железе в 2026: оборудование, vLLM и сравнение цен с облаком

Self-host GLM 5.2 (753B MIT, контекст 1M): 8x H200 на vLLM FP8, 4x H100 на Q4 GGUF или Mac Studio на 2-bit.

glmopen-weights

Codex недельный лимит: 5 способов и API drop-in с потолком (2026)

Лимит Codex упал с 96% до 0% за день? Пять решений: банк сбросов, реферальные кредиты, drop-in API, предоплаченный потолок и downgrade тарифа.

codexopenai

Codex недельный лимит: 7 решений и drop-in API (2026)

Время сброса Codex приходит от сервера как метка resetsAt, а не по правилу часов. Как прочитать её самому и чем продолжить работу без простоя.

codex-clirate-limits

DeepSeek V3.2 prompt caching в ofox: 10 минут, до 80% экономии (2026)

DeepSeek V3.2: cache read $0.06/M против $0.29/M miss (в 4.8× дешевле), output $0.43/M, контекст 128K. Настройка в ofox за 10 минут.

deepseekapi-access