GLM 5.2 をローカルで動かす(2026 年版)— 256GB Mac や 4090 マシンで 2-bit 実行
GLM 5.2(753B)をローカルで動かす。2-bit は 256GB の Mac Studio に収まり、4-bit は 512GB 必要、速度は ~3-9 tok/s。
GLM-5.2・DeepSeek V4・MiniMax M3・Kimi K2.6 を 1 つの API でルーティングする(2026年)
1 つの ofox キーで 4 モデルを使い分け。ブレンド単価は $0.19/M(V4 Flash)〜$2.40/M(GLM-5.2)の 12.86倍差。1M context、V4 は cache 無料。
GLM-5.2 と GPT-5.5 の料金比較:ブレンド単価で 5.56 倍差
GLM-5.2 と GPT-5.5 のブレンド単価は $2.40 対 $13.33 per M、5.56 倍の差。リクエスト量別の請求額、cache の効果、ofox なら 1 行で両モデルを A/B。
2026年版 GLM 5.2 セルフホスト実践 — ハードウェア、vLLM、クラウドとのコスト比較
GLM 5.2 を自前で動かす。8x H200、4x H100、Mac Studio のサイジング、クラウド GPU の時間単価と Z.ai 月額の比較、day-one 対応エンジンを実機目線で整理。
Codex の週次上限が一日で枯渇:5 つの対処法と支出を頭打ちにする drop-in API(2026)
Codex の週次上限が 1 日で 96% から 0% に?解決策は 5 つ。リセット繰越、リファラルクレジット、drop-in API、プリペイド上限、ティアの見直し。
Codex リセットはいつ?使用量が戻るタイミングと前倒しする方法
Codex のリセット時刻はサーバーが渡す resetsAt のタイムスタンプで、時計のルールではありません。自分で読む方法と、作業を続けるための解決策。
ofox で DeepSeek V3.2 の Prompt Caching を 10 分で導入、請求を 80% 削減する手順(2026 年版)
DeepSeek V3.2 のキャッシュ読み取りは $0.06/M、ミス時は $0.29/M(4.8× 安い)、出力 $0.43/M、コンテキスト 128K。
GLM 5.2 アクセスガイド:料金、API セットアップ、MIT 重み公開計画(2026 年版)
Zhipu が 2026 年 6 月 13 日に GLM 5.2 を発表しました。1M トークンのコンテキスト、総 753B パラメータの MoE、月額 $10〜$80 の Coding Plan。
MiniMax M3 vs Claude Opus 4.8:SWE-Bench 10点差・価格1/10(2026)
MiniMax M3 と Claude Opus 4.8 を比較:SWE-Bench Pro 59% vs 69.2%、価格はM3が約1/10。ofox 経由で同一APIから30秒で切り替える方法と判断基準を解説します。
Claude Opus 4.8 登場:ベンチマーク、Fast Mode、本当に変わった点
Claude Opus 4.8 は 2026 年 5 月 28 日にリリース。価格は 4.7 と同額のまま、独立系の GDPval-AA 実務リーダーボードで 1890 Elo を獲得し首位に。