
Edgee
Edgee · Programación
Edgee es una puerta de enlace de agentes de IA para equipos de ingeniería que se sitúa entre tus agentes de programación y los proveedores de LLM. Comprime las cargas de tokens, enruta las solicitudes entre más de 200 modelos de frontera y de pesos abiertos, y rastrea el costo por desarrollador, repositorio o pull request. Los equipos la usan para reducir el costo de LLM sin tocar el código de la aplicación ni perder calidad en los resultados.

Acerca de Edgee
Qué es Edgee
Edgee es infraestructura, no una app que abres en el navegador. Es una puerta de enlace de agentes de IA que intercepta cada solicitud que tu agente de programación envía a un proveedor de modelos, aplica reglas de enrutamiento y compresión, y luego reenvía la solicitud. Instalas una CLI. Conectas Claude Code, Codex, Copilot, Cursor u OpenCode. A partir de ahí, la puerta de enlace se encarga de la medición. El objetivo es simple. Conservas el mismo resultado del modelo y pagas menos tokens por él.
Este es el problema que resuelve. Gasto descontrolado en agentes de programación. Cuando un equipo pone un agente en el equipo de cada desarrollador, nadie puede decir qué repositorio o qué persona quemó el presupuesto hasta que llega la factura. Esa falta de visibilidad duele. Edgee les da a los líderes de ingeniería la imagen en tiempo real, y les permite fijar presupuestos de tokens por desarrollador o por squad. Cuando un presupuesto se llena, las solicitudes se reenrutan a un modelo de pesos abiertos a mitad de tarea en lugar de detenerse.
El alcance es el principal límite. Edgee apunta a agentes de programación y llamadas LLM basadas en API, no a productos de chat para consumidores. No administrará una suscripción personal de ChatGPT. El plan gratuito cubre a un solo desarrollador, y funciones como SSO, alojamiento privado de la puerta de enlace y residencia de datos personalizada quedan detrás del nivel Enterprise, que usa precios personalizados.
Primeros pasos
- Instala la CLI de Edgee con
curl -fsSL https://install.edgee.ai | bash, Homebrew en macOS, o el instalador de PowerShell en Windows. - Lanza tu agente de programación a través de la puerta de enlace, por ejemplo
edgee launch claudeoedgee launch codex. - Asigna una política de enrutamiento y un presupuesto de tokens a un desarrollador, un squad o toda la organización desde el panel.
- De forma opcional, conecta tus propias claves de proveedor (BYOK) para controlar la facturación, o usa las claves que ofrece Edgee y paga una comisión de plataforma del 5% en las recargas.
- Revisa el uso y el costo por desarrollador, repositorio y PR en el enlace de analíticas de sesión que la CLI imprime al salir.
Información del producto
Un vistazo rápido a los precios, las plataformas compatibles y el rendimiento de Edgee.
Ideal para
Los usuarios, tareas y casos de uso en los que esta herramienta encaja mejor.
Usuarios
- Desarrolladores individuales
- Gerentes de ingeniería
- Equipos de plataforma con necesidades de cumplimiento
Tareas
- Recortar las facturas de tokens en agentes de programación
- Mantener los agentes en marcha durante caídas
- Atribuir el gasto de LLM
Casos de uso
- Un equipo cuya cuota de Claude Pro o Max se agota a mitad de sprint
- Una empresa que estandariza muchos agentes bajo una sola política
- Una organización con reglas de residencia de datos
Funciones clave
Enrutamiento inteligente de modelos
Edgee enruta cada solicitud según el presupuesto y la política que fijas, y mantiene una cadena configurable de proveedores detrás de cada regla. Si un proveedor devuelve un error 5xx o agota el tiempo de espera, la solicitud pasa al siguiente modelo en lugar de fallar. Cuando se alcanza un tope de gasto, el enrutamiento cambia a un modelo de pesos abiertos a mitad de tarea, así una sesión de programación no se detiene, y la solicitud continúa en un modelo evaluado para trabajo de programación en lugar de abandonar la tarea por completo. Las sesiones no se rompen. Eso importa durante una refactorización larga.
Compresión de tokens
La puerta de enlace recorta tokens redundantes en dos capas. La compresión de entrada maneja aproximadamente el 99% del volumen de tokens al recortar las cargas de resultados de herramientas, el contenido abultado de archivos y la salida de comandos que los agentes leen pero rara vez necesitan de nuevo, mientras que la compresión de salida apunta al flujo más pequeño pero más valioso de respuestas del modelo. Edgee describe esto como sin pérdida semántica para el trabajo de programación, lo que significa que obtienes el mismo resultado del modelo con menos tokens facturados. No se necesitan cambios en el código de la aplicación.
Observabilidad de equipo
El costo y el uso se desglosan por desarrollador, por repositorio, por PR y por modelo. Los líderes de ingeniería ven el gasto en tiempo real en lugar de esperar la factura mensual. El plan Team suma topes de gasto por asiento con alertas cuando un desarrollador se acerca al límite, además de integración con GitHub para la atribución por repositorio y PR.
Modelos de pesos abiertos
Edgee sirve GLM, Kimi y MiniMax a velocidad turbo por un precio mensual fijo. Estos son los modelos a los que caen las políticas de enrutamiento, y están evaluados para tareas de programación. Le dan a los equipos un objetivo más barato que mantiene la calidad lo bastante cerca como para terminar el trabajo.
Trae tus propias claves
Puedes usar las claves de proveedor de Edgee por comodidad, o conectar tus propias claves para controlar la facturación y usar modelos personalizados. Edgee no cobra recargo sobre los tokens que ya le pagas a un proveedor, lo que mantiene las configuraciones BYOK neutrales en costo del lado de la puerta de enlace.
Despliegue en las instalaciones
La misma puerta de enlace corre dentro de tu propia infraestructura mediante Docker Compose o Helm, conectada o aislada. Los prompts, las respuestas y las claves de proveedor nunca salen de tu red, y eso es lo que hace usable el producto para equipos regulados.
Catálogo de modelos
El catálogo abarca modelos de frontera y de pesos abiertos de todos los proveedores principales, con precios en vivo y tamaños de contexto. Al momento de escribir, lista 221 modelos y 974 rutas de proveedor, y cualquiera de ellos es un objetivo válido para una regla de enrutamiento.
API única para varios proveedores
Las apps y los agentes pueden llamar a los LLM a través de una sola API de Edgee en lugar de malabarear con SDK de proveedores separados. El uso en esa ruta es de pago por uso sin necesidad de un plan, facturado con una comisión de plataforma del 5% cuando recargas créditos de Edgee.
Ventajas y desventajas
Ventajas
- Recorta el gasto de tokens mediante compresión sin cambiar el código de la aplicación.
- Enruta entre más de 200 modelos con fallback y reenrutamiento a mitad de tarea cuando los proveedores fallan o se alcanzan los límites.
- El seguimiento granular de costos por desarrollador, repositorio y pull request cierra la brecha de visibilidad del gasto de los agentes.
- Admite BYOK, despliegue en las instalaciones y configuraciones aisladas para equipos con reglas de datos estrictas.
- Un nivel gratuito generoso para un solo desarrollador con acceso a todos los agentes de programación principales.
Desventajas
- El valor de categoría no está disponible en el registro del producto, así que la tabla Info lo lista como N/A.
- Las funciones Enterprise como SSO, alojamiento privado del modelo y residencia de datos personalizada exigen precios personalizados, lo que implica una conversación con ventas.
- Edgee enmarca el ahorro de la compresión como sin pérdida específicamente para tareas de programación, así que los equipos que usan agentes para otro trabajo deberían verificar la calidad del resultado por su cuenta.
Preguntas frecuentes
Es una puerta de enlace de agentes de IA que intercepta las solicitudes entre tu agente de programación y los proveedores de LLM. Edgee comprime tokens, enruta entre modelos según los presupuestos que fijas, e informa el costo y el uso por desarrollador, repositorio y PR. Piénsalo como una puerta de enlace API para el tráfico de IA.
Contenido relacionado
Explora herramientas, habilidades y artículos relacionados con Edgee.
Alternativas a Edgee
Forefront
Forefront · ProgramaciónForefront es una plataforma web para construir con IA de código abierto. Te deja ajustar los principales modelos de lenguaje de código abierto con tus propios datos, evaluar cómo rinden y ejecutarlos a través de una API o exportarlos para alojarlos tú mismo. Los desarrolladores que quieren la comodidad de una plataforma cerrada pero insisten en ser dueños de sus modelos y sus datos son el público objetivo.
Startkit
StartKit.AI · ProgramaciónStartkit es un boilerplate para crear productos de SaaS con IA y wrappers de IA. Piénsalo como un boilerplate para startups de IA con las partes aburridas ya conectadas: autenticación, pagos con Stripe y Lemon Squeezy, límites de uso, correo transaccional y un kit de inicio de API de IA que habla con OpenAI, Anthropic, Groq o Llama. Clonas el repositorio, pones tu precio y te dedicas a la parte del producto por la que la gente paga de verdad. Está hecho con Next.js sobre React y Tailwind, así que buena parte del código boilerplate ya te resulta familiar.
Testim
Tricentis · ProgramaciónTestim es una plataforma de automatización de pruebas impulsada por IA para crear y ejecutar pruebas de extremo a extremo en aplicaciones web, móviles y Salesforce. Se apoya en el aprendizaje automático para mantener las pruebas estables cuando cambia una interfaz, así que los equipos dedican menos tiempo a reparar selectores rotos. No está nada mal para una herramienta de pruebas automatizadas que puedes empezar a usar hoy mismo. Creas pruebas grabando acciones en un navegador y luego añades JavaScript cuando necesitas más control. Es una opción sólida para equipos de QA con mucho trabajo.
