La passerelle IA d'entreprise pour plus de 100 modèles
— transparente par conception

Plus de 100 modèles derrière une seule API — GPT, Claude, Gemini, aux côtés de DeepSeek, Qwen, GLM et Kimi, du texte à la génération d'images et de vidéos. Pilotée à l'échelle de l'équipe : rôles, budgets et journal d'audit intégrés.

Nos engagements entreprise en quatre chiffres

* Le SLA couvre la disponibilité de la plateforme Ofox. Les incidents des fournisseurs de modèles en amont en sont exclus.

0 %
Commission de plateforme sur chaque requête
99,9 %
SLA de disponibilité *
Jamais
Entraînement sur vos prompts ou vos réponses
100 %
Requêtes tracées avec leur auteur et leur coût exact
Capacités entreprise

Une infrastructure IA de niveau entreprise dès la première requête

Une API, un tableau de bord, une facture — avec le contrôle, la fiabilité et le traitement des données qu'exige une mise en production. Les 0 % de commission ne sont que le point de départ.

Fiche du modèle$3.00 / M
Vous payez$3.00 / M · 0%
Crédit de volumejusqu'à −7 % · automatique

0 % de commission — tarifs officiels du fournisseur

Facturation au tarif officiel du fournisseur du modèle : le prix affiché sur la fiche est celui que vous payez. À mesure que le volume augmente, des crédits allant jusqu'à 7 % s'appliquent automatiquement.

OpenAIOpenAI
ClaudeClaude
GeminiGemini
DeepSeekDeepSeek
QwenQwen
GrokGrok
sk-ofox-••••••••

Une clé API pour GPT, Claude, Gemini et plus de 100 modèles

Accédez à Claude, GPT, Gemini, DeepSeek, Qwen et plus de 100 modèles avec une seule clé API. Entièrement compatible avec le SDK OpenAI.

100 % de disponibilité
30 derniers joursTokyo

SLA de disponibilité de 99,9 % avec bascule multirégion *

Redondance multirégion et bascule automatique. Des engagements de disponibilité noir sur blanc.

Plafond mensuel$0 / $1,000
Aujourd'hui
$0
Cette semaine
$0
Ce mois-ci
$0

Contrôle fin des coûts par clé et par utilisateur

Définissez des budgets quotidiens, hebdomadaires ou mensuels par clé ou par utilisateur, avec limitation automatique du débit. Les tableaux de bord en temps réel suppriment les factures surprises.

RequêteModèle
Non stockéNon entraîné

Aucun stockage persistant du contenu

Les prompts et les réponses ne servent jamais à l'entraînement. Seuls subsistent des journaux d'exploitation de courte durée, ainsi que les métadonnées de requête et la consommation de jetons nécessaires à la facturation.

Ticket< 24 h
Prioritaire< 4 h
DédiéTemps réel

Support technique par paliers

Plus le volume augmente, plus les délais de réponse se réduisent. Les comptes du palier supérieur bénéficient d'un contact technique dédié et d'un traitement prioritaire des tickets.

Traces
LangfuseDatadogWeave

Observabilité LLM (Langfuse, Datadog, Weave)

Bientôt disponible

Journalisation optionnelle des prompts et des réponses, transmise à Langfuse, Datadog et d'autres plateformes pour le débogage et l'analyse — la même attribution que dans le tableau de bord, exportée vers la stack d'observabilité que vous exploitez déjà.

* Le SLA couvre uniquement la disponibilité de la plateforme Ofox ; les incidents des fournisseurs de modèles en amont en sont exclus.

Sécurité et conformité

Sécurité et conformité : acheminer, pas conserver

Le rôle d'une passerelle est de transporter vos requêtes, pas de les garder. Le trafic est chiffré en TLS, le contenu n'est ni conservé ni utilisé pour l'entraînement — et lorsqu'une certification est encore en cours, nous le disons ci-dessous.

Comment vos données sont traitées

Chiffrement TLS en transit

L'ensemble du trafic API est chiffré de bout en bout entre vos systèmes et les nôtres.

Aucun stockage persistant des prompts ni des réponses

Les prompts et les réponses ne sont pas conservés : seuls des journaux d'exploitation de courte durée subsistent, ainsi que les métadonnées et le décompte de jetons nécessaires à la facturation.

Vos données ne servent jamais à l'entraînement

Votre contenu ne sert pas à entraîner des modèles, ni les nôtres ni ceux de tiers. Les fournisseurs en amont restent liés par leurs propres conditions entreprise.

Certifications et accords sur les données

SOC 2 Type II

Audit en cours — prévu au 3e trimestre 2026

En cours

ISO 27001

Prévu au 3e trimestre 2026

En cours

GDPR

DPA avec clauses contractuelles types ; liste des sous-traitants sur demande

Conforme

DPA

Sur demande, avant la signature du contrat

Disponible

Nous ne revendiquons pas de certifications que nous ne détenons pas encore. Si un référentiel conditionne votre calendrier de revue, dites-le-nous : nous vous indiquerons l'étape en cours de l'audit.

Gestion d'équipe

Une analyse d'usage conçue pour les équipes techniques

Coût, performance et consommation en temps réel — attribués à chaque modèle, clé API et membre. Les revues de dépenses et la planification de capacité s'appuient sur des données, pas sur un rapprochement de fin de mois.

Un seul jeu de filtres — modèle, membre, clé API, application — appliqué au coût, à la santé des requêtes, aux jetons et au cache. Le caché et le non caché sont tarifés séparément.

Basculez la même courbe entre modèles, clés API et membres : quand la consommation s'envole, la source est identifiée avant l'arrivée de la facture.

Coût, jetons et analyse du cache dans un seul tableau de bord
Intégration

Intégration : changez l'URL de base, gardez votre SDK

Ofox est compatible avec les SDK OpenAI, Anthropic et Gemini. Aucune réécriture, aucun client propriétaire à adopter.

Compatible avec les SDK OpenAI, Anthropic et Gemini

from openai import OpenAI

client = OpenAI(
    base_url="https://api.ofox.io/v1",  # ← la seule modification
    api_key="YOUR_OFOX_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-5.6-sol",
    messages=[{"role": "user", "content": "Hello!"}],
)

print(response.choices[0].message.content)

Fonctionne avec Claude Code, Cursor, LangChain et d'autres

Toutes les intégrations
Support et mise en route

Comment se déroule un déploiement en entreprise

Étape 1 Créez un compte et testez

Ouvrez un compte, créditez-le et menez votre propre évaluation : inutile de passer par un commercial pour vérifier si les modèles, la latence et les prix conviennent à votre charge de travail.

Étape 2 Lancez un pilote avec des budgets en place

Mettez une seule charge de travail en production, budgets et limites déjà en place. Validez la latence, la qualité et la facturation sur vos propres chiffres.

Étape 3 Passez en production avec rôles et limites par clé

Déployez rôles et budgets par clé à l'échelle de l'équipe. Plus le volume augmente, plus les délais de réponse se réduisent, avec un contact technique attitré.

Questions fréquentes

FAQ entreprise

Produit et fiabilité

En quoi Ofox diffère-t-il des API officielles des fournisseurs ?

Vous conservez les tarifs officiels — 0 % de commission de plateforme — et remplacez de nombreuses intégrations par une seule : une clé, une facture et un tableau de bord pour OpenAI, Anthropic, Google, DeepSeek, Qwen, GLM, Kimi et plus de 100 modèles, avec rôles, budgets et journal d'audit intégrés. En direct, cela signifie une relation fournisseur, un SDK et une facture par fournisseur ; Ofox les consolide sans marge.

Que couvre le SLA de 99,9 % ?

La disponibilité de la plateforme Ofox : la passerelle, le routage et la couche API. Les incidents survenant chez un fournisseur de modèles en amont en sont exclus, car nous ne maîtrisons pas son infrastructure. Demandez-nous les conditions de crédits de service en vigueur.

Que se passe-t-il en cas de panne chez un fournisseur de modèles ?

Les défaillances au niveau de la plateforme sont contournées automatiquement entre nos régions. Lorsque c'est le fournisseur lui-même qui tombe, nous remontons l'erreur explicitement plutôt que de dégrader le service en silence — et, l'API étant agnostique au modèle, la plupart des équipes basculent vers un modèle équivalent en changeant une seule chaîne. Ces pannes sont exclues de notre SLA, et nous le disons d'emblée.

Combien de temps prend l'intégration ?

Quelques minutes pour la plupart des équipes. L'API est compatible avec les SDK OpenAI, Anthropic et Gemini : vous changez l'URL de base et la clé, et conservez votre code existant.

Données et conformité

Stockez-vous nos prompts et nos réponses ?

Non. Le contenu des requêtes est traité en temps réel et n'est pas conservé : seuls subsistent des journaux d'exploitation de courte durée, ainsi que les métadonnées et le décompte de jetons nécessaires à la facturation. Tout le trafic est chiffré en TLS en transit.

Nos données servent-elles à entraîner des modèles ?

Jamais. Vos prompts et vos réponses ne servent pas à entraîner des modèles, ni les nôtres ni ceux de tiers. Les fournisseurs en amont restent liés par leurs propres conditions entreprise.

Êtes-vous certifiés SOC 2 ?

Pas encore. L'audit SOC 2 Type II est en cours, attendu au 3e trimestre 2026, et l'ISO 27001 suit le même calendrier. Nous ne revendiquerons pas une certification avant sa délivrance : si votre revue en dépend, contactez-nous et nous vous confirmerons par écrit l'étape en cours.

Êtes-vous conformes au RGPD ?

Oui. Nous proposons un DPA avec clauses contractuelles types, chiffrons l'ensemble du trafic en transit, ne conservons pas le contenu des requêtes et pouvons communiquer la liste de nos sous-traitants sur demande. Contactez-nous : nous vous transmettrons les documents pour votre revue.

Facturation

Comment fonctionne la tarification ?

Paiement à l'usage au tarif officiel du fournisseur du modèle, avec 0 % de commission de plateforme : le prix affiché sur la fiche du modèle est celui qui vous est facturé. Pas d'abonnement mensuel, pas de minimum de plateforme, pas de pourcentage sur les recharges. Un volume soutenu génère automatiquement des crédits, jusqu'à 7 %.

Les requêtes en échec sont-elles facturées ?

Non. Une requête qui échoue renvoie une erreur explicite et n'est pas facturée : vous ne payez que les requêtes abouties.

Le solde prépayé expire-t-il ?

Non. Votre solde reste disponible jusqu'à son utilisation : aucune date d'expiration, aucun minimum mensuel pour le maintenir actif.

Équipe et accès

Comment plafonner les dépenses d'un membre de l'équipe ?

Définissez un plafond quotidien, hebdomadaire ou mensuel par membre ou par clé API dans la console. Une fois le plafond atteint, les requêtes sont limitées automatiquement et l'accès reprend à la période suivante — aucune facture surprise à cause d'un script parti à la dérive.

Peut-on restreindre les modèles que l'équipe peut appeler ?

Oui. Les accès se pilotent par rôle et par clé : vous pouvez limiter l'usage à un ensemble de modèles approuvés et y adjoindre des plafonds de dépense.

Prenez-vous en charge le SSO ?

Indiquez-nous votre fournisseur d'identité et nous vous confirmerons ce qui est pris en charge aujourd'hui et ce qui figure à la feuille de route.

ofox

Tous les modèles dont votre équipe a besoin, tout le contrôle qu'attend votre entreprise.

Testez d'abord un modèle dans le playground, ou parlons du déploiement de votre équipe : modèles, régions et exigences de revue compris.

Obtenir votre clé API