AI Gateway · Gratuit de base

Un seul point de terminaison pour unifier tous les modèles et clés

Pointez Claude Code, Codex et votre SDK vers une seule adresse locale. Gérez tous les fournisseurs de manière centralisée, suivez chaque coût, chiffrez toutes les clés localement — changez de modèle sans jamais modifier vos outils.

Un seul point de terminaison pour unifier tous les modèles et clés

Un point de terminaison local qui relie tous les modèles cloud et locaux

Pointez l’outil vers la passerelle, qui relaie, facture et chiffre pour vous. La clé réelle reste sur votre appareil, l’outil n’obtient qu’une clé virtuelle isolée par projet.

Vos outils
Claude Code · Codex · SDK
Passerelle IA
Clé virtuelle · Chiffrement local
Tous les fournisseurs
Modèles cloud et locaux

Intégration en trois étapes, plus jamais besoin de changer d’outil

1

Fournisseur configuré

Saisissez une seule fois les vraies clés de chaque service — elles sont chiffrées localement sur votre machine et ne sont jamais téléchargées.

2

Délivrer une clé virtuelle

Attribuez des clés virtuelles par projet ou outil, isolées les unes des autres et révocables individuellement.

3

Pointer vers la passerelle

Il suffit de définir l’URL de base de n’importe quel outil vers la passerelle, et vous n’aurez plus besoin de modifier l’outil lors du changement de modèle ou de fournisseur.

Une passerelle pour gérer tous les appels de modèles

Toutes les fonctionnalités de base sont gratuites, les fonctionnalités pour les équipes peuvent être mises à niveau selon les besoins — jamais de facturation au token.

Accès unifié

  • Modèles cloud et locaux, une seule adresse
  • Conversion de protocoles Anthropic / OpenAI / Gemini
  • Essayez différents modèles et fournisseurs — sans modifier vos outils clients

Contrôle et visibilité

  • Clé virtuelle, isolée par projet
  • Statistiques d'utilisation et de coûts
  • Fallback automatique, basculement automatique en cas de défaillance du fournisseur principal
  • Mesure de l'utilisation multimodale — texte, images et audio

Sécurité

  • La clé réelle est chiffrée localement et n'est jamais téléchargée
  • La clé virtuelle peut être révoquée à tout moment
  • Tout se passe sur votre propre machine

Abonnement et quotas

  • Suivi des détails du plan, des points de terminaison disponibles et des limites de sortie
  • Quota multi-fenêtres : utilisé / restant / heure de réinitialisation
  • Intégration de l'autorisation OAuth pour les fournisseurs sur abonnement

Routage intelligent

  • Détection automatique des capacités du fournisseur lors de l'ajout d'un canal
  • Mappage de modèles à 3 niveaux, écriture automatique
  • Bascule automatique vers un canal de secours en cas d'échec du canal
  • Test de connectivité à deux modes : joignabilité sans clé, authentification vérifiée avec clé

Une passerelle pour connecter tous les principaux fournisseurs

Les grands modèles cloud et les modèles Ollama locaux sont unifiés derrière un seul point de terminaison.

Anthropic
OpenAI
Gemini
OpenRouter
Ollama
Mistral AI
DeepSeek
Llama
Zhipu GLM
Moonshot Kimi
Qwen (Tongyi Qianwen)
Doubao
腾讯混元
MiniMax
01.AI Yi
SiliconFlow

…et tout fournisseur compatible avec le protocole OpenAI

VIP

Capacités d'équipe, évolutives selon les besoins

Gestion avancée pour les petites équipes et les entreprises, débloquée avec le VIP — toujours sans facturation par token.

Équilibrage de charge multi-canal — répartir le trafic entre plusieurs canaux du même modèle
Plafond budgétaire et alertes
Partage de clé et autorisations d’équipe
Analyse détaillée de l’utilisation
Suivi des quotas d'abonnement, alerte instantanée en cas d'épuisement
Interception pré-budget — refuser avant de lancer l’appel, plutôt qu’après coup.
Intégration des comptes d'abonnement Claude Code / Codex

Questions fréquentes

Ma clé quittera-t-elle mon ordinateur ?

Non. La clé réelle est chiffrée localement sur votre machine ; l’outil n’accède qu’à une clé virtuelle et ne la télécharge jamais.

Quels outils peuvent le cibler ?

Tout outil prenant en charge une URL de base personnalisée, y compris Claude Code, Codex et divers SDK.

Que comprend la version gratuite ?

Un point de terminaison unifié pour les modèles cloud et locaux, clés virtuelles, statistiques d’utilisation et de coût, basculement automatique et chiffrement local, tout cela gratuitement.

Les modèles locaux sont-ils pris en charge ?

Pris en charge. Les modèles Ollama locaux fonctionnent comme les modèles cloud, tous connectés au même point de terminaison.

Est-il possible de suivre les quotas d'abonnement (par exemple Claude Pro / Max) ?

Oui. La passerelle affiche les détails du forfait du compte d'abonnement associé, les points de terminaison disponibles, les limites de sortie, ainsi que la consommation du quota multi-fenêtres (utilisé / restant / heure de réinitialisation).

Comment la passerelle détermine-t-elle quel modèle utiliser ?

La passerelle ne décide pas — le modèle à utiliser pour chaque requête est spécifié par votre client, et la passerelle transfère la requête vers le canal capable de servir ce modèle.

Quelle est la différence entre les trois modes de routage : Fixed, Failover et Balanced ?

Ils déterminent « quel canal utiliser lorsqu'un même modèle dispose de plusieurs canaux » : utilisation fixe d'un seul canal ; basculement principal/secondaire dans l'ordre ; répartition équitable en alternance. Les différents modèles ne basculent pas entre eux.

Téléchargement gratuit Connexion à Claude Code

ServBay AI Helper
ServBay AI Helper