【上下文窗口】1M 到底能装多少内容:9 个模型实测,token 数差 1.56 倍(2026)

上下文窗口是一次请求的 token 预算,输入和输出都算在里面。同一篇英文文档发给 9 个模型,token 数从 614 到 957,差 1.56 倍,标称同样是 1M 能装的内容并不一样。

conceptcontext-window

【AI 编程工具横评】9 个 coding agent harness 怎么选:先定 harness,再定模型

OpenRouter 真实用量显示,Claude Code 里跑得最多的模型是 GLM 5.2,比 Anthropic 自家四个模型加起来还多。9 个 harness 逐个拆开,附六款工具同题实测。

coding-agentsagent-harness

遇到 429 Too Many Requests 怎么办?什么时候重试才有效?

遇到 429 或 Rate Limit Exceeded,先区分请求限流、每日额度与计费限制。本文给出中文排查表,说明什么时候等待、降低并发,以及什么情况不能靠重试恢复。

rate-limitserror

DeepSeek V4 Flash 涨价前:6 个真正省钱的杠杆(2026)

DeepSeek 官方已挂涨价预告。缓存命中比未命中便宜 50 倍,22 家托管商缓存读价差 28 倍,最顺手的 slug 买到的是旧版 0423。6 个可执行杠杆加盈亏平衡算法。

deepseekpricing

Seedance 2.0 怎么用(2026):官方 prompt 规范、6 个故障修法、成本

画面中途换脸、凭空冒字幕?字节官方 prompt 规范、6 个有据可查的修法、720p 每秒 $0.16、最低档 $0.04/s,一把 ofox key 三个档位全走通。

video-generationseedance

Codex CLI 接入 Qwen 3.8 Max:6 行配置、258K 上下文封顶的解法、实测成本

Qwen 3.8 Max 接进 Codex CLI 的可用配置:走 ofox 六行 TOML,三个真实编码任务实测 $0.08,同样三个任务 GPT-5.5 是 $0.54。以及先得修掉的 258K 上下文封顶。

codex-cliqwen

Qwen 3.8 Max 对比 DeepSeek V4 Flash:差 3 分,账单差 345 倍

Qwen 3.8 Max 在 AA Intelligence Index 拿 53 分,DeepSeek V4 Flash 0731 拿 50 分。但实测三个任务,前者贵 345 倍、慢 6 倍。这 3 分什么时候值得付。

qwendeepseek

Qwen 3.7 Max、Kimi K3、DeepSeek V4 实测对比:34 倍价差

同一套评测、同一套方法:Kimi K3 得 57 分,跑完花 $2,437;DeepSeek V4 Flash 得 50 分,只花 $72;Qwen 3.7 Max 得 46 分,花了 $1,604。

qwenkimi

Qwen 3.8 Max 价格、上下文与接入方式(2026)

Qwen 3.8 Max 于 2026-08-03 正式发布:$2/$6 每百万 token,1M 上下文,131K 输出上限,开源权重下周放出。ofox 已上架 bailian/qwen3.8-max。

qwenmodel-launch

2026 年最佳 LLM API 供应商:四种类型及各自成本

结合2026年8月的费用记录比较四类LLM API供应商,补充9月Ofox报价,并区分牌价、供应商价格和额外费用。

api-gatewayapi-guide