Google: Gemini 3.6 Flash
Chat-50%google/gemini-3.6-flashGemini 3.6 Flash est le modèle de travail de Google axé sur l'efficacité en tokens, publié le 2026-07-21. Il produit 17 % de tokens de sortie en moins que Gemini 3.5 Flash, requiert moins d'étapes de raisonnement et d'appels d'outils dans les workflows agentiques à plusieurs étapes, et effectue des modifications de code plus précises avec moins de boucles d'exécution. Modèle de réflexion à niveaux configurables, il accepte toutes les modalités d'entrée : texte, image, vidéo et audio. La vision, l'appel d'outils, la mise en cache des prompts, l'entrée PDF et la recherche web sont pris en charge. Fenêtre de contexte : 1M tokens, sortie : 64K. Disponible via les protocoles OpenAI et Gemini.
Fenêtre de contexte
1M
Tokens de sortie max
66K
Publié
2026-07-21
Capacités
VisionFunction CallingRaisonnementPrompt CachingRecherche webEntrée audioEntrée vidéoEntrée PDF
Fournisseurs disponibles
GeminiVertex
Protocoles supportés
openaigemini
Providers
Gemini
Tokens d'entrée
$1.5/M
Tokens de sortie
$7.5/M
Lecture cache
$0.15/M
Écriture cache
$0.083/M
Entrée audio
$1.5/M
Écriture cache (1 h)
$1/M
Audio en cache
$0.15/M
Recherche web
$0.014/R
Protocols
gemini
Vertex
-50%Tokens d'entrée
$0.75/M
$1.5/M
Tokens de sortie
$3.75/M
$7.5/M
Lecture cache
$0.075/M
$0.15/M
Écriture cache
$0.0415/M
$0.083/M
Entrée audio
$0.75/M
$1.5/M
Écriture cache (1 h)
$0.5/M
$1/M
Audio en cache
$0.075/M
$0.15/M
Recherche web
$0.014/R
Protocols
openai
/v1/chat/completionsgemini
Exemples de code
from google import genaiclient = genai.Client(api_key="YOUR_OFOX_API_KEY",http_options={"api_version": "v1beta", "base_url": "https://api.ofox.io/gemini"},)response = client.models.generate_content(model="google/gemini-3.6-flash",contents="Hello!",)print(response.text)
Disponibilité et état
Modèles associés
Questions fréquentes
Google: Gemini 3.6 Flash sur Ofox.ai coûte $1.5/M par million de tokens d'entrée et $7.5/M par million de tokens de sortie. Paiement à l'usage, sans frais mensuels.
Google: Gemini 3.6 Flash supporte une fenêtre de contexte de 1M tokens avec un maximum de 66K tokens en sortie, permettant de traiter de longs documents et de maintenir des conversations prolongées.
Configurez simplement votre URL de base sur https://api.ofox.io/v1 et utilisez votre clé API Ofox. L'API est compatible OpenAI — changez simplement l'URL de base et la clé API dans votre code existant.
Google: Gemini 3.6 Flash supporte les capacités suivantes : Vision, Function Calling, Raisonnement, Prompt Caching, Recherche web, Entrée audio, Entrée vidéo, Entrée PDF. Accédez à toutes les fonctionnalités via l'API unifiée Ofox.ai.