【上下文窗口】1M 到底能装多少内容:9 个模型实测,token 数差 1.56 倍(2026)
上下文窗口是一次请求的 token 预算,输入和输出都算在里面。同一篇英文文档发给 9 个模型,token 数从 614 到 957,差 1.56 倍,标称同样是 1M 能装的内容并不一样。
【AI 编程工具横评】9 个 coding agent harness 怎么选:先定 harness,再定模型
OpenRouter 每-app 真实用量显示,Claude Code 里跑得最多的模型是 GLM 5.2,比 Anthropic 自家四个模型加起来还多。9 个 harness 逐个拆开讲,附一次六款工具同题实测。
429 Too Many Requests:它意味着什么,何时该重试(2026)
一个 429 状态码对应 5 种不同的问题。先读 retry-after,按 1s/2s/4s 加抖动退避,遇到计费类 429 则完全跳过重试。
DeepSeek V4 Flash 涨价前:6 个真正省钱的杠杆(2026)
DeepSeek 官方已挂涨价预告。缓存命中比未命中便宜 50 倍,22 家托管商缓存读价差 28 倍,最顺手的 slug 买到的是旧版 0423。6 个可执行杠杆加盈亏平衡算法。
Seedance 2.0 怎么用(2026):官方 prompt 规范、6 个故障修法、成本
画面中途换脸、凭空冒字幕?字节官方 prompt 规范、6 个有据可查的修法、720p 每秒 $0.16、最低档 $0.04/s,一把 ofox key 三个档位全走通。
Qwen 3.8 Max 对比 DeepSeek V4 Flash:差 3 分,账单差 345 倍
Qwen 3.8 Max 在 AA Intelligence Index 拿 53 分,DeepSeek V4 Flash 0731 拿 50 分。但实测三个任务,前者贵 345 倍、慢 6 倍。这 3 分什么时候值得付。
Qwen 3.8 Max 价格、上下文与接入方式(2026)
Qwen 3.8 Max 于 2026-08-03 正式发布:$2/$6 每百万 token,1M 上下文,131K 输出上限,开源权重下周放出。ofox 已上架 bailian/qwen3.8-max。
Qwen 3.7 Max、Kimi K3、DeepSeek V4 实测对比:34 倍价差
同一套评测、同一套方法:Kimi K3 得 57 分,跑完花 $2,437;DeepSeek V4 Flash 得 50 分,只花 $72;Qwen 3.7 Max 得 46 分,花了 $1,604。
2026 年最佳 LLM API 供应商:四种类型及各自成本
同样的 token 有四种买法。Claude Opus 5 在其中三种上都是 $5/$25,gpt-oss-120B 只要 $0.15/M,充值手续费高达 5.5%,区域端点加价 10%。
DeepSeek V4 Flash 对决 Gemini 3.6 Flash:分数打平,价格差 10 倍
两者在 Artificial Analysis 上都拿 50 分。DeepSeek 定价 $0.14/M,Gemini 为 $1.50/M,但前者花掉 210M token,后者仅 59M。10 倍差距藏在哪。