GPT-6 Astra 対 Claude Fable 5.1:同じ $10/$50、61 対 66
GPT-6 Astra と Claude Fable 5.1 のトークン単価は同一。Artificial Analysis では Fable 5.1 が 66、Astra が 61。それぞれがまだ勝つ場所。
GPT-6 Astra と Claude Fable 5.1 のトークン単価はまったく同じです。入力 $10.00、出力 $50.00。そして Artificial Analysis Intelligence Index では Fable 5.1 が 66、Astra が 61 です。 OpenAI は 2026 年 9 月 3 日に、強いエージェント系ベンチマークの数字とともに Astra を出荷しました。第三者の合成指標は別の話をしており、移行の前にはどちらも読む価値があります。
要点
- 表示価格は同一。 どちらも 100 万あたり $10 / $50。トークン単価でどちらかが得ということはありません。
- キャッシュ読み取りは同一ではない。 Ofox 上の Fable 5.1 は 100 万あたり $0.25、OpenAI は Astra のキャッシュ入力を $1.00 としています。エージェントループで最も繰り返される部分に対して 4 倍の料金です。
- Fable 5.1 が合成指標で 5 点上、最大努力設定で 66 対 61。Astra はこのインデックスで 202 モデル中 8 位。
- Astra は OpenAI が選んだベンチマークで先行し、それらはエージェント寄りです。コンピュータ操作、脆弱性の発見、フロンティア数学。
- Astra の max は high のおよそ 2 倍の費用で 1 点。 61 対 60、同じインデックスの実行に $3,013 対 $1,429。
価格は同じ。キャッシュが安いのは片方だけ。
| 100 万トークンあたりの料金 | GPT-6 Astra | Claude Fable 5.1 |
|---|---|---|
| 入力 | $10.00 | $10.00 |
| 出力 | $50.00 | $50.00 |
| キャッシュ入力の読み取り | $1.00 | $0.25 |
| Fast モード入力 / 出力 | $20 / $100 | 提供なし |
| コンテキストウィンドウ | 1.1M | 1M |
| 最大出力 | 128K | 128K |
| 知識のカットオフ | 2026 年 4 月 | — |
Astra の標準料金と Fast モード料金は OpenAI が公表したローンチ価格、1.1M のコンテキスト、128K の出力上限、2026 年 4 月のカットオフはモデル仕様からです。Fable 5.1 の料金はライブの Ofox カタログで、anthropic/claude-fable-5.1 はキャッシュ入力を 100 万あたり $0.25 で読みます。Astra の Ofox 料金は OpenAI の定価と一致し、キャッシュ入力は $1.00 です。いずれも 2026 年 9 月 5 日に再読み取りしました。
実際の請求書を動かすのはキャッシュの行です。エージェントループは毎ターン同じシステムプロンプト、ツール定義、会話履歴を送り直すので、長時間走るタスクではキャッシュ入力が単一の最大項目になるのが普通です。$1.00 対 $0.25 では、同じキャッシュ済みコンテキストが Astra で 4 倍かかります。表示料金の比較では見えず、月次の請求書ではよく見えます。
第三者インデックスの結果
Artificial Analysis は GPT-6 Astra を 61、Claude Fable 5.1 を 66 と採点しています。 AA の Intelligence Index は 9 つの評価の合成です。GDPval-AA v2、𝜏³-Banking、Terminal-Bench v2.1、SciCode、Humanity’s Last Exam、GPQA Diamond、CritPt、AA-Omniscience、AA-LCR。Astra の位置はここです。
| 順位 | モデル | インデックス | タスク単価 |
|---|---|---|---|
| 1 | Claude Fable 5.1(max) | 66 | $3.69 |
| 2 | Claude Fable 5.1(xhigh) | 65 | $2.65 |
| 3 | Claude Opus 5(max) | 63 | $2.34 |
| 4 | Claude Opus 5(xhigh) | 63 | $1.80 |
| 5 | Claude Fable 5.1(high) | 62 | $1.43 |
| 6 | Muse Spark 1.3(max) | 62 | — |
| 7 | Claude Fable 5 | 62 | $3.14 |
| 8 | GPT-6 Astra(max) | 61 | $1.67 |
| — | Claude Opus 5(high) | 61 | $1.23 |
| — | Muse Spark 1.3(xhigh) | 61 | $0.55 |
| — | GPT-6 Astra(high) | 60 | $0.96 |
Artificial Analysis から 2026 年 9 月 4 日に読み取り。Astra は 202 モデル中 8 位で、絶対的には強い位置であり、文脈の中では具体的な位置です。その上にいるのはすべて Claude か Muse Spark の変種だからです。
この表では、順位よりも重要な比較が 2 つあります。
同じスコアなら、Astra は安いほうではない。 61 には 3 つの構成が並びます。Astra max が 1 タスク $1.67、Claude Opus 5 high が $1.23、Muse Spark 1.3 xhigh が $0.55。同じ計測スコアに到達するのに、Astra は最安の 3 倍かかります。
同じ価格なら、Astra は強いほうではない。 Fable 5.1 は同じ $10 / $50 で 5 点上です。
OpenAI が公表したもの、そしてなぜそれが同じ主張ではないのか
OpenAI のローンチ数値は本物で、その多くはエージェント系です。
| ベンチマーク | GPT-6 Astra |
|---|---|
| OSWorld 2.0(コンピュータ操作) | 72.6% |
| FrontierMath Tier 4 v2 | 97.6% |
| GPQA Diamond | 96.0% |
| Terminal-Bench 4.0 | 57.9% |
| ExploitBench | 100.0% |
| ExploitGym | 42.4% |
| SRE-Bench(1 回目) | 88.0% |
| ARC-AGI-3(アダプタ harness) | 99.9% |
| Humanity’s Last Exam(ツールあり) | 57.2% |
これらはベンダー報告で、ベンダーが選んだベンチマーク上のものであり、いくつかには但し書きが付いています。ARC-AGI-3 の 99.9% は「アダプタ harness」、Humanity’s Last Exam の 57.2% は「ツールあり」です。どちらの但し書きも欠陥ではありませんが、どちらも数字の意味を変え、どちらも同じ評価を第三者が走らせた結果と直接は比較できません。
ARC-AGI-3 の但し書きは、多くのものより重要だと判明しました。ARC Prize 自身の標準 harness では同じモデルが 62.7% で、1 つのベンチマーク上で 37 点の開きです。レビューが、なぜ両方の数字が正当なのか、そしてその差が実際に何を測っているのかを扱っています。
正直な読み方は、これらが別のものを測っているということです。AA のインデックスは汎用推論、長文脈の検索、知識に重みを置きます。OpenAI の選定はコンピュータ操作、ターミナル作業、セキュリティツール、数学に重みを置きます。一方で先行し他方で遅れることは、どちらかが間違っていることを意味しません。どちらがあなたの結果を予測するかは、実際に何を走らせるかで決まります。
Astra 自身の段階が互いに矛盾している
インデックス 1 点の費用はおよそ 2 倍。
| Astra の段階 | インデックス | AA インデックス実行費用 | タスク単価 | 出力トークン |
|---|---|---|---|---|
| max | 61 | $3,013.30 | $1.67 | 42M |
| high | 60 | $1,429.26 | $0.96 | 16M |
max は high の 2.6 倍の出力トークンを書き、インデックス全体で 2.1 倍の費用がかかって、得られるのは 1 点です。これは Gemini 3.8 Flash が 3.7 Flash に対して見せたのと同じパターンで、新しいモデルが同じ料金で 30% 多くの出力トークンを使いました。努力設定は価格の乗数であり、最上位設定がお買い得な設定であることはめったにありません。
本番ワークロードの既定を max にする前に、両方を自分のタスクで走らせて、その 1 点がそこに存在するか確認してください。AA の混合では 61 点中の 1 点、より狭いワークロードではゼロかもしれません。
GPT-6 Astra を選ぶとき
- コンピュータ操作とターミナル自動化。 OSWorld 2.0 の 72.6% と Terminal-Bench 4.0 の 57.9% は OpenAI が前面に出した数字で、このモデルが位置づけられたワークロードの分類です。
- セキュリティと脆弱性の作業。 ExploitBench の 100%、SRE-Bench の 1 回目 88% は具体的で、この領域を覆う比較可能な第三者の合成指標はありません。
- Fast モードが必要。 最大 2.5 倍速を $20 / $100 で買えるのは、Fable 5.1 がいくら払っても提供しない遅延のレバーです。
- すでに Bedrock を使っている。 Astra はローンチ時から対応しています。
Claude Fable 5.1 に留まるとき
- 同じ価格での汎用推論。 同じ $10 / $50 でインデックス 5 点差というのが、この比較で最も明快な論拠です。
- キャッシュの多いエージェントループ。 キャッシュ入力 100 万あたり $0.25 対 $1.00、長時間走るエージェントで最も速く増える項目です。
anthropic/claude-fable-5.1とopenai/gpt-6-astraは 2026 年 9 月 5 日時点でどちらも Ofox カタログにあるので、これは待つ話ではなく文字列 1 つの A/B です。
予算が制約なら、どちらも答えではない
この 2 つはどちらも出力 100 万あたり $50 のモデルです。タスクに 61 や 66 が要らないなら、同じインデックスにはより安く近づく方法があります。Claude Opus 5 は $5 / $25 で max 63 を出し、Astra より 2 点上でトークン単価は半分です。Opus 5 と GPT-5.6 Sol の比較がその帯を扱い、GPT-5.6 段階ガイドが OpenAI の前世代を扱っています。前世代は今も $10 / $50 ではなく $5 / $30 です。
これははっきり書く価値があります。GPT-6 Astra は OpenAI 自身のフラッグシップの入力価格を倍にし、出力を 3 分の 2 引き上げました。GPT-5.6 Sol の $5 / $30 からです。OpenAI のラインナップ内部から見たアップグレード判断はこれとは別の問いで、それには独自の答えがあります。Astra の完全な料金表が Fast モード、キャッシュの段階、各努力設定でのタスク単価を扱っています。
今日 A/B を走らせる
from openai import OpenAI
client = OpenAI(base_url="https://api.ofox.io/v1", api_key="YOUR_OFOX_API_KEY")
r = client.chat.completions.create(
model="anthropic/claude-fable-5.1",
messages=[{"role": "user", "content": "Refactor this function to remove the nested loop."}],
)
print(r.usage)
モデル文字列を openai/gpt-6-astra に変えてもう一度走らせるだけです。どちらも同じエンドポイント上で同じパラメータを取るので、この比較のコストは 1 行です。何が呼べるかの拠り所は GET https://api.ofox.io/v1/models のままです。
出典
- https://artificialanalysis.ai/models/gpt-6-astra
- https://artificialanalysis.ai/models/gpt-6-astra-high
- https://llm-stats.com/models/gpt-6-astra
- https://ofox.io/models/anthropic/claude-fable-5.1
- https://ofox.io/models/openai/gpt-6-astra
Artificial Analysis のインデックススコア、タスク単価、インデックス実行費用は 2026 年 9 月 4 日に読み取りました。GPT-6 Astra のベンチマーク表は 2026 年 9 月 3 日に報じられた OpenAI のローンチ数値です。両モデルの Ofox 料金は、GPT-6 Astra が掲載された 2026 年 9 月 5 日にライブの /v1/models エンドポイントから読み取りました。
よくある質問
- GPT-6 Astra は Claude Fable 5.1 より高いですか?
- 表示価格では高くありません。どちらも 100 万入力トークンあたり $10.00、100 万出力トークンあたり $50.00 です。違いはキャッシュ読み取りで、Ofox 上の Fable 5.1 は 100 万あたり $0.25、OpenAI は GPT-6 Astra のキャッシュ入力を $1.00 と設定しており 4 倍です。キャッシュの多いエージェントループではこの差が積み上がります。
- GPT-6 Astra と Claude Fable 5.1 のどちらが高得点ですか?
- Artificial Analysis Intelligence Index では Claude Fable 5.1 です。Fable 5.1 は最大努力設定で 66、GPT-6 Astra は同 61 で、同一のトークン単価で 5 点差です。Astra はこのインデックスで 202 モデル中 8 位、その上の 7 つは Claude と Muse Spark の変種です。
- GPT-6 Astra はどのベンチマークで先行していますか?
- OpenAI がローンチ時に公表したもので、その多くは汎用推論ではなくエージェントとツール利用に寄っています。OSWorld 2.0 のコンピュータ操作 72.6%、FrontierMath Tier 4 v2 97.6%、GPQA Diamond 96.0%、ExploitBench 100%、ARC-AGI-3 はアダプタ harness で 99.9%。これらはベンダーが選んだベンチマーク上のベンダー報告値であり、第三者の合成指標とは別物です。
- Ofox で GPT-6 Astra は使えますか?
- はい。2026 年 9 月 5 日から openai/gpt-6-astra として利用でき、入力 $10.00、出力 $50.00、キャッシュ読み取り $1.00 です。anthropic/claude-fable-5.1 も同じカタログにあり、表示価格は同一ですがキャッシュ読み取りは $0.25 です。このページを前提にせず、GET /v1/models で現在の一覧を確認してください。
- Claude Fable 5.1 から GPT-6 Astra に乗り換えるべきですか?
- 価格を理由にすべきではありません。料金は同じで、Astra のキャッシュ読み取りのほうが高いからです。ワークロードがコンピュータ操作、ターミナル自動化、セキュリティツールなら乗り換えてください。OpenAI がその方向で具体的な高い数字を公表しています。汎用推論と長文脈の作業なら留まってください。第三者インデックスは現在、同じ価格で Fable 5.1 を 5 点上に置いています。
- GPT-6 Astra の max と high の違いは何ですか?
- 計測された知能で 1 点、そして約 2 倍の費用です。Artificial Analysis は Astra を max で 61、high で 60 と採点し、インデックスの実行に max で $3,013.30、high で $1,429.26 を費やしました。出力トークンはそれぞれ 4,200 万と 1,600 万です。max に払うのなら、その 1 点が自分のタスクで実在するか検証してください。


