GPT-6 LunaとGemini 3.5 Flash-Lite、データ抽出にはどちら?
テキスト抽出に使うLunaとGemini 3.5 Flash-Liteを、公式料金・入力仕様・検証方法で比較。JSONの形式と値の正確さを分けて評価します。
テキストだけの抽出ではGPT-6 Lunaの標準トークン単価が低く、Gemini 3.5 Flash-Liteの資料は音声や動画の入力も明記しています。 選ぶ基準は、JSONとして読める回答ではなく、正しく抽出できたレコードです。単価や総合ベンチマークだけで、自社文書の正確さは決まりません。
2026年9月25日に公式資料を確認しました。両モデルの抽出性能を実測した記事ではありません。ドル額はプロバイダー直結価格による仮定の計算で、Ofox料金や実際の節約額ではありません。
まず共通のテキストタスクにそろえる
同じ抽出済みテキストから、仕入先、請求書番号、通貨、合計、根拠箇所を返すタスクなら、PDF解析・画像処理・音声認識とフィールド抽出を分離できます。実際の入力がスキャンや音声なら、その工程を含む評価も別に必要です。
| 項目 | GPT-6 Luna | Gemini 3.5 Flash-Lite |
|---|---|---|
| ID | gpt-6-luna | gemini-3.5-flash-lite |
| 引用モデルページの入力記述 | テキスト・画像のモダリティ | テキスト・画像・動画・音声・PDF |
| テキスト出力 | 対応 | 対応 |
| 構造化出力 | 対応 | 対応 |
| 最大入力 | 922,000トークン | 1,048,576トークン |
| 最大出力 | 128,000トークン | 65,536トークン |
出典はLunaとGeminiのモデル資料です。入力欄は同じ粒度のファイル形式一覧ではありません。Lunaのモダリティ記述からPDF非対応を推測せず、実際のエンドポイントの受付条件と課金を確認します。容量上限まで毎回投入する必要もありません。関係部分を取り出し、元のページや行番号を残します。
1,000件を処理する仮定の費用
Standardの短いリクエストで、100万トークン当たりの料金は次のとおりです。
| 区分 | Luna | Gemini 3.5 Flash-Lite |
|---|---|---|
| 通常入力 | $0.10 | $0.30 |
| キャッシュ入力 | $0.01 | $0.03 |
| 出力 | $0.50 | $2.50 |
1件につき通常入力2,000、課金対象出力200トークンで1,000件処理すると仮定します。合計200万入力・20万出力で、Lunaは $0.30、Geminiは $1.10 です。キャッシュ、再試行、推論量の差、ツール、前処理、地域料金、税は含めません。同じ文章でもトークン数は異なり、課金対象出力には推論が含まれる場合があります。
複数の短いリクエストを、1つの長いリクエストに置き換えて同じ費用になるとは限りません。Lunaは入力が272Kを超えると、リクエスト全体で入力・キャッシュ単価2倍、出力1.5倍になります。Geminiのキャッシュ保存は100万トークン・1時間当たり1ドルが別途必要です。Lunaの短い入力ではキャッシュ書き込みが100万トークン当たり$0.125です。OpenAI料金、Google料金、Lunaの課金解説を使い、異なる仕組みを別々に計算してください。
正しいJSONに誤った金額が入ることもある
通貨が原文にないなら、スキーマで許可した欠損表現を返すよう定義します。ドル記号だけでUSDと補完しないようにします。正規化した金額と一緒に原文箇所を保存すれば、確認の手掛かりになります。
| フィールド | 合格条件 | 残すべき誤り |
|---|---|---|
| 請求書番号 | 原文と一致 | 架空の番号 |
| 通貨 | 明示的な根拠 | 国からの推測 |
| 合計 | 金額と小数の解釈が正しい | 税額や小計との取り違え |
| 根拠 | 実在する原文箇所 | 存在しない引用 |
Googleの構造化出力資料は形式の制約を説明しますが、意味の検証は別に必要です。両者のフィールド定義を統一し、リクエストのスキーマは各APIの対応範囲に合わせます。スキーマが拒否されたことはAPI連携段階での結果であり、それだけではモデルがその項目を抽出できないとは判断できません。
失敗を隠さない評価セットを作る
欠損、複数の合計、小数点表記の違い、重複ページ、抽出とは無関係な指示が混ざった文書も含めます。文書内の指示はデータとして扱い、正解はプロンプトに渡しません。形式適合、フィールド精度、根拠のない値、レコード全体の合格を分けて記録します。
拒否、途中終了、タイムアウト、不正形式、再試行、手作業の修正も費用に含めます。Lunaの抽出ワークフローが検証の出発点になります。
実際に運用できる処理経路を選ぶ
整理済みテキストと費用が中心ならLunaから、Googleが明記する音声・動画入力が必要ならGeminiから接続を評価する方法があります。これは試す順番であり、性能順位ではありません。PDFはエンドポイントごとの受付条件と前処理を先に調べます。
例外だけを上位モデルに回すなら、見逃して受け入れた誤りも数えます。LunaからSolへの振り分けを参考に、最終判断にはデータセットと実行条件を添えてください。
よくある質問
- 標準のテキスト単価が低いのはどちらですか?
- 確認時点の短い入力では、100万入力・出力トークン当たりLunaが$0.10/$0.50、Geminiが$0.30/$2.50です。合格レコードの費用は実際の使用量と誤りにも左右されます。
- 構造化出力なら抽出値も正しいですか?
- いいえ。スキーマへの適合と、原文に基づく値・単位・欠損処理の正しさは別です。
- PDF対応をモデルのモダリティ表だけで比較できますか?
- できません。Lunaのtext/image表記だけでPDFファイル非対応とは判断できず、利用するAPIのファイル入力と課金を確認する必要があります。


