AI Gateway · Básico gratis

Un solo endpoint para unificar todos los modelos y claves

Dirige Claude Code, Codex y tu SDK a una dirección local. Gestiona todos los proveedores de forma unificada, realiza un seguimiento de cada coste y cifra todas las claves localmente; cambiar de modelo ya no requiere modificar las herramientas.

Un solo endpoint para unificar todos los modelos y claves

Un endpoint local que conecta todos los modelos locales y en la nube

Dirige las herramientas al gateway, el gateway reenvía, cobra y cifra por ti. La clave real permanece en tu dispositivo, y las herramientas solo obtienen una clave virtual aislada por proyecto.

Tus herramientas
Claude Code · Codex · SDK
AI Gateway
Clave virtual · Encriptación local
Todos los proveedores
Modelos en la nube y locales

Tres pasos para integrarse, nunca más tendrás que cambiar de herramienta

1

Proveedor configurado

Introduce cada clave real de cada proveedor una sola vez: se cifrarán localmente en tu máquina y nunca se subirán.

2

Emitir clave virtual

Emite claves virtuales por proyecto o herramienta, aisladas entre sí y revocables individualmente.

3

Apuntar al gateway

Apunta la URL base de cualquier herramienta al gateway y luego podrás cambiar de modelo o proveedor sin tener que modificar la herramienta.

Una puerta de enlace para gestionar todas las llamadas a modelos

Todas las funciones básicas son gratuitas y las funciones a nivel de equipo se pueden actualizar según las necesidades—nunca se cobrará por tokens.

Acceso unificado

  • Modelo en la nube y local, una sola dirección
  • Conversión de protocolos Anthropic / OpenAI / Gemini
  • Prueba diferentes modelos y proveedores — sin necesidad de modificar las herramientas del cliente

Control y visibilidad

  • Clave virtual, aislada por proyecto
  • Estadísticas de uso y costos
  • Cambio automático: si el proveedor principal falla, se cambia automáticamente
  • Medición de uso multimodal: texto, imágenes y audio

Seguridad

  • Clave real cifrada localmente, nunca se sube
  • La clave virtual se puede revocar en cualquier momento
  • Todo el proceso se realiza en tu propia máquina

Suscripción y cuota

  • Rastrear los detalles del plan, los endpoints disponibles y los límites de salida
  • Cuota de múltiples ventanas: utilizado / restante / hora de reinicio
  • Integración de autorización OAuth para proveedores de suscripción

Enrutamiento inteligente

  • Detectar automáticamente las capacidades del proveedor al añadir un canal
  • Mapeo de modelos de tres niveles, escritura automática
  • Repliegue automático a canal de respaldo si el canal falla
  • Prueba de conectividad en dos modos: sin Key, comprobar accesibilidad; con Key, verificar autenticación.

Una puerta de enlace para conectar con todos los principales proveedores

Modelos grandes en la nube y modelos locales de Ollama, todos unificados bajo un solo endpoint.

Anthropic
OpenAI
Gemini
OpenRouter
Ollama
Mistral AI
DeepSeek
Llama
Zhipu GLM
Cara oculta de la luna Kimi
Qwen
Doubao
Tencent Hunyuan
MiniMax
01.AI Yi
SiliconFlow

...y cualquier proveedor compatible con el protocolo OpenAI

VIP

Capacidades a nivel de equipo, actualiza según tus necesidades

Gestión avanzada para pequeños equipos y empresas, desbloqueada junto con VIP—y aún así, nunca se cobrará por tokens.

Balanceo de carga multicanal — distribuye el tráfico entre varios canales del mismo modelo
Límite presupuestario y alerta
Key y permisos compartidos del equipo
Análisis detallado del uso
Seguimiento de la cuota de suscripción, alertas inmediatas al agotarse
Intercepción previa al presupuesto: rechazar antes de iniciar la llamada en lugar de después
Integración de cuentas de suscripción de Claude Code / Codex

Preguntas frecuentes

¿Mi clave saldrá de mi computadora?

No. La clave real se cifra localmente en tu dispositivo; la herramienta solo obtiene una clave virtual y nunca se sube.

¿Qué herramientas pueden apuntar a él?

Cualquier herramienta que admita una URL base personalizada, incluyendo Claude Code, Codex y varios SDK.

¿Qué incluye la versión gratuita?

Punto final unificado para modelos en la nube y locales, clave virtual, estadísticas de uso y costos, conmutación automática y cifrado local, todo gratis.

¿Se admiten modelos locales?

Compatible. Los modelos locales de Ollama funcionan igual que los modelos en la nube, todos detrás del mismo endpoint.

¿Se pueden rastrear las cuotas de suscripción (como Claude Pro / Max)?

Sí. AI Gateway mostrará los detalles del plan de las cuentas de suscripción vinculadas, los endpoints disponibles, los límites de salida, así como el uso de la cuota en múltiples ventanas (utilizado / restante / tiempo de restablecimiento).

¿Cómo decide la pasarela qué modelo usar?

El gateway no decide: es tu cliente quien especifica qué modelo usar en cada solicitud, y el gateway reenvía la solicitud al canal que puede atender ese modelo.

¿Cuál es la diferencia entre los tres tipos de enrutamiento: Fixed, Failover y Balanced?

Determinan «qué canal usar cuando un mismo modelo tiene varios canales»: fijo, usando solo uno; principal y respaldo, cambiando en orden; rotación con distribución equitativa. Los distintos modelos no cambiarán entre sí.

Descarga gratuita Conectar con Claude Code

ServBay AI Helper
ServBay AI Helper