
ngrok ofrece una plataforma unificada para enrutar, asegurar y gestionar el tráfico hacia cualquier LLM, ya sea en la nube o local. Permite monitorear el uso, optimizar costos y mantener tus productos de IA siempre en línea.
Enrutamiento multi-proveedor
Envía solicitudes a modelos públicos como GPT o Claude, y recurre a alternativas si uno falla o se ralentiza.
Acceso a modelos autoalojados
Conéctate de forma privada a LLMs locales sin exponer IPs públicas ni abrir puertos de entrada.
Monitorización de costes
Realiza un seguimiento de tokens, latencia y errores en cada llamada para ver exactamente qué aplicación, desarrollador o modelo impulsa el gasto.
Consolidación de claves
Gestiona claves de OpenAI, Anthropic o proveedores personalizados en un solo lugar manteniendo las tarifas existentes.
Control de acceso por aplicación
Emite claves con permisos específicos para cada aplicación o desarrollador, restringiendo los proveedores y modelos a los que pueden acceder.
Tráfico de producción resiliente
Redirige automáticamente las solicitudes fallidas o lentas hacia alternativas saludables para que los usuarios nunca noten las interrupciones.
Una única URL de pasarela
Cambia tu baseURL a `https://gateway.ngrok.ai` y sustituye tu clave de API—no necesitas ningún otro cambio en el código.
Compatibilidad con SDK
Funciona con el SDK de OpenAI, el SDK de Anthropic y el SDK de Vercel AI sin configuración adicional.
Enrutamiento de LLMs locales
Accede a modelos autoalojados mediante conectividad privada, manteniendo el tráfico fuera de redes públicas.
Trae tu propia clave (BYOK)
Usa tus claves de proveedor existentes para enrutar a través de ellas, paga a los proveedores directamente y conserva tus tarifas actuales.
Claves de acceso con permisos
Asigna a cada aplicación o desarrollador su propia clave con permisos limitados a proveedores y modelos específicos.
Observabilidad unificada
Consulta tokens, latencia y errores agregados en cada llamada, con paneles de proveedor que muestran el gasto por aplicación o desarrollador.
Redirección automática
Cuando un modelo o clave se ralentiza o falla, las solicitudes se cambian a una alternativa saludable que hayas definido—los usuarios nunca lo notan.
Reintentos integrados
Las solicitudes fallidas se reintentan al instante, de modo que las aplicaciones siguen funcionando sin necesidad de código personalizado de gestión de errores.
Totalmente programable
Configura la pasarela por completo mediante APIs, utilizable desde agentes de codificación, Terraform, CLI o herramientas personalizadas.
https://gateway.ngrok.ai y sustituye tu clave de API por la de ngrok—no se requieren otros cambios en el código. Si usas modelos autoalojados, conéctalos mediante conectividad privada para que sean accesibles desde la pasarela sin IPs públicas. Opcionalmente, trae tus propias claves de proveedor para enrutar a través de cuentas existentes y configura claves con permisos por aplicación o desarrollador para controlar el acceso. Para configuraciones avanzadas, configura la pasarela programáticamente mediante API, Terraform o CLI. La documentación completa está disponible en el sitio oficial.ngrok ofrece una plataforma unificada para enrutar, asegurar y gestionar el tráfico hacia cualquier LLM, ya sea en la nube o local. Permite monitorear el uso, optimizar costos y mantener tus productos de IA siempre en línea.
Category:Servicios API
Visit Link:https://ngrok.ai/
Tags:ngrok、enrutamiento LLM、puerta de enlace API、infraestructura de IA、gestión de tráfico