Gemini

Google: Gemini 3.8 Flash

Chat-50%
google/gemini-3.8-flash

Gemini 3.8 Flash is Google's most intelligent Flash model, with significant gains over 3.7 Flash across software engineering, agentic tasks, and multi-step reasoning. All input modalities (text/image/video/audio) unified pricing; batch tier at 50% discount. Thinking model with configurable levels. 1M context. Released September 2, 2026.

Janela de Contexto
1M
Tokens Máx de Saída
66K
Lançamento
2026-09-02
Capacidades
VisãoFunction CallingRaciocínioPrompt CachingBusca WebEntrada de ÁudioEntrada de VídeoEntrada PDF
Provedores Disponíveis
GoogleCloudVertex
Protocolos Suportados
OpenAIopenaiGeminigemini

Providers

GoogleCloudVertex
-50%
Tokens de Entrada
$0.75/M
$1.5/M
Tokens de Saída
$3.75/M
$7.5/M
Leitura de Cache
$0.075/M
$0.15/M
Escrita de Cache
$0.0415/M
$0.083/M
Entrada de Áudio
$0.75/M
$1.5/M
Escrita de Cache (1 hora)
$0.5/M
$1/M
Áudio em Cache
$0.075/M
$0.15/M
Busca Web
$0.014/R
Protocols
OpenAIopenai/v1/chat/completions
Geminigemini

Exemplos de Código

from google import genai
client = genai.Client(
api_key="YOUR_OFOX_API_KEY",
http_options={"api_version": "v1beta", "base_url": "https://api.ofox.io/gemini"},
)
response = client.models.generate_content(
model="google/gemini-3.8-flash",
contents="Hello!",
)
print(response.text)

Disponibilidade e status

Perguntas Frequentes

Google: Gemini 3.8 Flash na Ofox.ai custa $1.5/M por milhão de tokens de entrada e $7.5/M por milhão de tokens de saída. Pague por uso, sem mensalidade.