La passerelle IA d'entreprise pour plus de 100 modèles
— transparente par conception
Plus de 100 modèles derrière une seule API — GPT, Claude, Gemini, aux côtés de DeepSeek, Qwen, GLM et Kimi, du texte à la génération d'images et de vidéos. Pilotée à l'échelle de l'équipe : rôles, budgets et journal d'audit intégrés.

Nos engagements entreprise en quatre chiffres
* Le SLA couvre la disponibilité de la plateforme Ofox. Les incidents des fournisseurs de modèles en amont en sont exclus.
Une infrastructure IA de niveau entreprise dès la première requête
Une API, un tableau de bord, une facture — avec le contrôle, la fiabilité et le traitement des données qu'exige une mise en production. Les 0 % de commission ne sont que le point de départ.
0 % de commission — tarifs officiels du fournisseur
Facturation au tarif officiel du fournisseur du modèle : le prix affiché sur la fiche est celui que vous payez. À mesure que le volume augmente, des crédits allant jusqu'à 7 % s'appliquent automatiquement.
Une clé API pour GPT, Claude, Gemini et plus de 100 modèles
Accédez à Claude, GPT, Gemini, DeepSeek, Qwen et plus de 100 modèles avec une seule clé API. Entièrement compatible avec le SDK OpenAI.
SLA de disponibilité de 99,9 % avec bascule multirégion *
Redondance multirégion et bascule automatique. Des engagements de disponibilité noir sur blanc.
Contrôle fin des coûts par clé et par utilisateur
Définissez des budgets quotidiens, hebdomadaires ou mensuels par clé ou par utilisateur, avec limitation automatique du débit. Les tableaux de bord en temps réel suppriment les factures surprises.
Aucun stockage persistant du contenu
Les prompts et les réponses ne servent jamais à l'entraînement. Seuls subsistent des journaux d'exploitation de courte durée, ainsi que les métadonnées de requête et la consommation de jetons nécessaires à la facturation.
Support technique par paliers
Plus le volume augmente, plus les délais de réponse se réduisent. Les comptes du palier supérieur bénéficient d'un contact technique dédié et d'un traitement prioritaire des tickets.
Observabilité LLM (Langfuse, Datadog, Weave)
Bientôt disponibleJournalisation optionnelle des prompts et des réponses, transmise à Langfuse, Datadog et d'autres plateformes pour le débogage et l'analyse — la même attribution que dans le tableau de bord, exportée vers la stack d'observabilité que vous exploitez déjà.
* Le SLA couvre uniquement la disponibilité de la plateforme Ofox ; les incidents des fournisseurs de modèles en amont en sont exclus.
Sécurité et conformité : acheminer, pas conserver
Le rôle d'une passerelle est de transporter vos requêtes, pas de les garder. Le trafic est chiffré en TLS, le contenu n'est ni conservé ni utilisé pour l'entraînement — et lorsqu'une certification est encore en cours, nous le disons ci-dessous.
Comment vos données sont traitées
Chiffrement TLS en transit
L'ensemble du trafic API est chiffré de bout en bout entre vos systèmes et les nôtres.
Aucun stockage persistant des prompts ni des réponses
Les prompts et les réponses ne sont pas conservés : seuls des journaux d'exploitation de courte durée subsistent, ainsi que les métadonnées et le décompte de jetons nécessaires à la facturation.
Vos données ne servent jamais à l'entraînement
Votre contenu ne sert pas à entraîner des modèles, ni les nôtres ni ceux de tiers. Les fournisseurs en amont restent liés par leurs propres conditions entreprise.
Certifications et accords sur les données
SOC 2 Type II
Audit en cours — prévu au 3e trimestre 2026
ISO 27001
Prévu au 3e trimestre 2026
GDPR
DPA avec clauses contractuelles types ; liste des sous-traitants sur demande
DPA
Sur demande, avant la signature du contrat
Nous ne revendiquons pas de certifications que nous ne détenons pas encore. Si un référentiel conditionne votre calendrier de revue, dites-le-nous : nous vous indiquerons l'étape en cours de l'audit.
Une analyse d'usage conçue pour les équipes techniques
Coût, performance et consommation en temps réel — attribués à chaque modèle, clé API et membre. Les revues de dépenses et la planification de capacité s'appuient sur des données, pas sur un rapprochement de fin de mois.


Intégration : changez l'URL de base, gardez votre SDK
Ofox est compatible avec les SDK OpenAI, Anthropic et Gemini. Aucune réécriture, aucun client propriétaire à adopter.
Compatible avec les SDK OpenAI, Anthropic et Gemini
from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.io/v1", # ← la seule modification
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-5.6-sol",
messages=[{"role": "user", "content": "Hello!"}],
)
print(response.choices[0].message.content)Fonctionne avec Claude Code, Cursor, LangChain et d'autres
Toutes les intégrationsComment se déroule un déploiement en entreprise
Étape 1 Créez un compte et testez
Ouvrez un compte, créditez-le et menez votre propre évaluation : inutile de passer par un commercial pour vérifier si les modèles, la latence et les prix conviennent à votre charge de travail.
Étape 2 Lancez un pilote avec des budgets en place
Mettez une seule charge de travail en production, budgets et limites déjà en place. Validez la latence, la qualité et la facturation sur vos propres chiffres.
Étape 3 Passez en production avec rôles et limites par clé
Déployez rôles et budgets par clé à l'échelle de l'équipe. Plus le volume augmente, plus les délais de réponse se réduisent, avec un contact technique attitré.
FAQ entreprise
En quoi Ofox diffère-t-il des API officielles des fournisseurs ?
Vous conservez les tarifs officiels — 0 % de commission de plateforme — et remplacez de nombreuses intégrations par une seule : une clé, une facture et un tableau de bord pour OpenAI, Anthropic, Google, DeepSeek, Qwen, GLM, Kimi et plus de 100 modèles, avec rôles, budgets et journal d'audit intégrés. En direct, cela signifie une relation fournisseur, un SDK et une facture par fournisseur ; Ofox les consolide sans marge.
Que couvre le SLA de 99,9 % ?
La disponibilité de la plateforme Ofox : la passerelle, le routage et la couche API. Les incidents survenant chez un fournisseur de modèles en amont en sont exclus, car nous ne maîtrisons pas son infrastructure. Demandez-nous les conditions de crédits de service en vigueur.
Que se passe-t-il en cas de panne chez un fournisseur de modèles ?
Les défaillances au niveau de la plateforme sont contournées automatiquement entre nos régions. Lorsque c'est le fournisseur lui-même qui tombe, nous remontons l'erreur explicitement plutôt que de dégrader le service en silence — et, l'API étant agnostique au modèle, la plupart des équipes basculent vers un modèle équivalent en changeant une seule chaîne. Ces pannes sont exclues de notre SLA, et nous le disons d'emblée.
Combien de temps prend l'intégration ?
Quelques minutes pour la plupart des équipes. L'API est compatible avec les SDK OpenAI, Anthropic et Gemini : vous changez l'URL de base et la clé, et conservez votre code existant.
Stockez-vous nos prompts et nos réponses ?
Non. Le contenu des requêtes est traité en temps réel et n'est pas conservé : seuls subsistent des journaux d'exploitation de courte durée, ainsi que les métadonnées et le décompte de jetons nécessaires à la facturation. Tout le trafic est chiffré en TLS en transit.
Nos données servent-elles à entraîner des modèles ?
Jamais. Vos prompts et vos réponses ne servent pas à entraîner des modèles, ni les nôtres ni ceux de tiers. Les fournisseurs en amont restent liés par leurs propres conditions entreprise.
Êtes-vous certifiés SOC 2 ?
Pas encore. L'audit SOC 2 Type II est en cours, attendu au 3e trimestre 2026, et l'ISO 27001 suit le même calendrier. Nous ne revendiquerons pas une certification avant sa délivrance : si votre revue en dépend, contactez-nous et nous vous confirmerons par écrit l'étape en cours.
Êtes-vous conformes au RGPD ?
Oui. Nous proposons un DPA avec clauses contractuelles types, chiffrons l'ensemble du trafic en transit, ne conservons pas le contenu des requêtes et pouvons communiquer la liste de nos sous-traitants sur demande. Contactez-nous : nous vous transmettrons les documents pour votre revue.
Comment fonctionne la tarification ?
Paiement à l'usage au tarif officiel du fournisseur du modèle, avec 0 % de commission de plateforme : le prix affiché sur la fiche du modèle est celui qui vous est facturé. Pas d'abonnement mensuel, pas de minimum de plateforme, pas de pourcentage sur les recharges. Un volume soutenu génère automatiquement des crédits, jusqu'à 7 %.
Les requêtes en échec sont-elles facturées ?
Non. Une requête qui échoue renvoie une erreur explicite et n'est pas facturée : vous ne payez que les requêtes abouties.
Le solde prépayé expire-t-il ?
Non. Votre solde reste disponible jusqu'à son utilisation : aucune date d'expiration, aucun minimum mensuel pour le maintenir actif.
Comment plafonner les dépenses d'un membre de l'équipe ?
Définissez un plafond quotidien, hebdomadaire ou mensuel par membre ou par clé API dans la console. Une fois le plafond atteint, les requêtes sont limitées automatiquement et l'accès reprend à la période suivante — aucune facture surprise à cause d'un script parti à la dérive.
Peut-on restreindre les modèles que l'équipe peut appeler ?
Oui. Les accès se pilotent par rôle et par clé : vous pouvez limiter l'usage à un ensemble de modèles approuvés et y adjoindre des plafonds de dépense.
Prenez-vous en charge le SSO ?
Indiquez-nous votre fournisseur d'identité et nous vous confirmerons ce qui est pris en charge aujourd'hui et ce qui figure à la feuille de route.
Tous les modèles dont votre équipe a besoin, tout le contrôle qu'attend votre entreprise.
Testez d'abord un modèle dans le playground, ou parlons du déploiement de votre équipe : modèles, régions et exigences de revue compris.
