Edgee

Edgee

Edgee · Programmation

Edgee est une passerelle d'agents IA pour les équipes d'ingénierie qui se place entre vos agents de codage et les fournisseurs de LLM. Elle compresse les charges de tokens, route les requêtes entre plus de 200 modèles de pointe et à poids ouverts, et suit le coût par développeur, dépôt ou pull request. Les équipes l'utilisent pour réduire le coût des LLM sans toucher au code de l'application ni perdre en qualité de résultats.

Aperçu de l'interface de Edgee

À propos de Edgee

Qu'est-ce qu'Edgee

Edgee est une infrastructure, pas une application que vous ouvrez dans un navigateur. C'est une passerelle d'agents IA qui intercepte chaque requête que votre agent de codage envoie à un fournisseur de modèles, applique des règles de routage et de compression, puis transmet la requête. Vous installez une CLI. Vous connectez Claude Code, Codex, Copilot, Cursor ou OpenCode. La passerelle prend ensuite le relais pour la mesure. L'objectif est simple. Vous gardez le même résultat du modèle et payez moins de tokens pour l'obtenir.

Voici le problème qu'elle résout. Les dépenses incontrôlées sur les agents de codage. Dès qu'une équipe met un agent sur la machine de chaque développeur, personne ne peut dire quel dépôt ou quelle personne a brûlé le budget avant que la facture n'arrive. Ce manque de visibilité fait mal. Edgee donne aux responsables d'ingénierie une vue en temps réel, et leur permet de fixer des budgets de tokens par développeur ou par squad. Quand un budget est épuisé, les requêtes sont reroutées vers un modèle à poids ouverts en pleine tâche au lieu de s'arrêter.

La portée est la principale limite. Edgee vise les agents de codage et les appels LLM basés sur une API, pas les produits de chat grand public. Elle ne gérera pas un abonnement ChatGPT personnel. Le plan gratuit couvre un seul développeur, et des fonctionnalités comme le SSO, l'hébergement privé de la passerelle et la résidence des données personnalisée se trouvent derrière le niveau Enterprise, qui utilise une tarification sur mesure.

Premiers pas

  1. Installez la CLI Edgee avec curl -fsSL https://install.edgee.ai | bash, Homebrew sur macOS, ou l'installateur PowerShell sur Windows.
  2. Lancez votre agent de codage via la passerelle, par exemple edgee launch claude ou edgee launch codex.
  3. Attribuez une politique de routage et un budget de tokens à un développeur, un squad ou toute l'organisation depuis le tableau de bord.
  4. En option, branchez vos propres clés de fournisseur (BYOK) pour maîtriser la facturation, ou utilisez les clés fournies par Edgee et payez des frais de plateforme de 5 % sur les recharges.
  5. Consultez l'usage et le coût par développeur, dépôt et PR dans le lien d'analytique de session que la CLI affiche à la sortie.

Informations sur le produit

Aperçu des tarifs, des plateformes compatibles et des performances de Edgee.

Offre gratuiteOui
Offres payantes$0 - $30/developer/mo (Enterprise custom)
PlateformeWeb, CLI (macOS, Linux, Windows), cloud or self-hosted
DéveloppeurEdgee
CatégorieProgrammation
Date de lancementJan 2025
Dernière mise à jourSep 2025
Visites du site14.1K
Classement mondial du site1.9M
Disponibilité de l’APIOui

Idéal pour

Les utilisateurs, tâches et cas d'usage où cet outil convient le mieux.

Utilisateurs

  • Développeurs indépendants
  • Responsables d'ingénierie
  • Équipes plateforme avec des besoins de conformité

Tâches

  • Réduire les factures de tokens sur les agents de codage
  • Maintenir les agents en marche pendant les pannes
  • Attribuer la dépense LLM

Cas d'usage

  • Une équipe dont le quota Claude Pro ou Max s'épuise en pleine sprint
  • Une entreprise qui standardise de nombreux agents sous une seule politique
  • Une organisation avec des règles de résidence des données

Fonctionnalités clés

Routage intelligent des modèles

Edgee route chaque requête selon le budget et la politique que vous fixez, et garde une chaîne configurable de fournisseurs derrière chaque règle. Si un fournisseur renvoie une erreur 5xx ou dépasse le délai, la requête passe au modèle suivant au lieu d'échouer. Quand un plafond de dépense est atteint, le routage bascule vers un modèle à poids ouverts en pleine tâche, donc une session de codage ne cale pas, et la requête se poursuit sur un modèle évalué pour le travail de codage plutôt que d'abandonner la tâche entièrement. Les sessions ne cassent pas. Cela compte pendant une longue refactorisation.

Compression des tokens

La passerelle resserre les tokens redondants en deux couches. La compression des entrées traite environ 99 % du volume de tokens en coupant les charges de résultats d'outils, le contenu volumineux des fichiers et la sortie de commandes que les agents lisent mais dont ils ont rarement besoin à nouveau, tandis que la compression des sorties cible le flux plus petit mais plus précieux des réponses du modèle. Edgee décrit cela comme sans perte sémantique pour le travail de codage, ce qui veut dire que vous obtenez le même résultat du modèle avec moins de tokens facturés. Aucune modification du code de l'application n'est nécessaire.

Observabilité d'équipe

Le coût et l'usage sont ventilés par développeur, par dépôt, par PR et par modèle. Les responsables d'ingénierie voient la dépense en temps réel au lieu d'attendre la facture mensuelle. Le plan Team ajoute des plafonds de dépense par siège avec des alertes quand un développeur approche de la limite, plus une intégration GitHub pour l'attribution par dépôt et par PR.

Modèles à poids ouverts

Edgee sert GLM, Kimi et MiniMax à vitesse turbo pour un prix mensuel fixe. Ce sont les modèles vers lesquels les politiques de routage se replient, et ils sont évalués pour les tâches de codage. Ils donnent aux équipes une cible moins chère qui garde une qualité assez proche pour finir le travail.

Apportez vos propres clés

Vous pouvez utiliser les clés de fournisseur d'Edgee par commodité, ou brancher vos propres clés pour maîtriser la facturation et utiliser vos modèles personnalisés. Edgee ne prélève aucune marge sur les tokens que vous payez déjà à un fournisseur, ce qui garde les configurations BYOK neutres en coût du côté de la passerelle.

Déploiement sur site

La même passerelle tourne dans votre propre infrastructure via Docker Compose ou Helm, connectée ou isolée. Les prompts, les réponses et les clés de fournisseur ne quittent jamais votre réseau, et c'est ce qui rend le produit utilisable pour les équipes réglementées.

Catalogue de modèles

Le catalogue couvre les modèles de pointe et à poids ouverts de tous les grands fournisseurs, avec des prix en direct et des tailles de contexte. Au moment où j'écris, il liste 221 modèles et 974 routes de fournisseur, et n'importe lequel d'entre eux est une cible valide pour une règle de routage.

API unique pour plusieurs fournisseurs

Les applications et les agents peuvent appeler des LLM via une seule API Edgee au lieu de jongler avec des SDK de fournisseurs séparés. L'usage sur ce chemin est payé à l'usage sans plan requis, facturé avec des frais de plateforme de 5 % quand vous rechargez des crédits Edgee.

Avantages et inconvénients

Avantages

  • Réduit la dépense en tokens par la compression sans changer le code de l'application.
  • Route entre plus de 200 modèles avec repli et reroutage en pleine tâche quand les fournisseurs échouent ou que les limites sont atteintes.
  • Le suivi granulaire des coûts par développeur, dépôt et pull request comble le déficit de visibilité sur la dépense des agents.
  • Prend en charge le BYOK, le déploiement sur site et les configurations isolées pour les équipes aux règles de données strictes.
  • Un niveau gratuit généreux pour un développeur unique avec accès à tous les principaux agents de codage.

Inconvénients

  • La valeur de catégorie n'est pas disponible dans la fiche produit, la table Info l'inscrit donc comme N/A.
  • Les fonctionnalités Enterprise comme le SSO, l'hébergement privé du modèle et la résidence des données personnalisée exigent une tarification sur mesure, ce qui implique un échange avec le service commercial.
  • Edgee présente l'économie de compression comme sans perte spécifiquement pour les tâches de codage, donc les équipes qui utilisent des agents pour d'autres travaux devraient vérifier elles-mêmes la qualité des résultats.

Questions fréquentes

C'est une passerelle d'agents IA qui intercepte les requêtes entre votre agent de codage et les fournisseurs de LLM. Edgee compresse les tokens, route entre les modèles selon les budgets que vous fixez, et rapporte le coût et l'usage par développeur, dépôt et PR. Voyez-la comme une passerelle API pour le trafic IA.

Contenus associés

Découvrez des outils, des compétences et des articles liés à Edgee.

Alternatives à Edgee

Forefront

Forefront

Forefront · Programmation

Forefront est une plateforme web pour construire avec de l'IA open source. Elle vous laisse affiner les principaux modèles de langage open source sur vos propres données, évaluer leurs performances et les exécuter via une API ou les exporter pour les héberger vous-même. Les développeurs qui veulent le confort d'une plateforme fermée mais tiennent à rester propriétaires de leurs modèles et de leurs données sont le public visé ici.

Gratuit / $0 - $99/moVoir les détails
Startkit

Startkit

StartKit.AI · Programmation

Startkit est un boilerplate pour créer des produits SaaS d'IA et des wrappers d'IA. Voyez-le comme un boilerplate de startup IA avec les parties ennuyeuses déjà branchées : authentification, paiements Stripe et Lemon Squeezy, limites d'usage, e-mail transactionnel et un kit de démarrage d'API IA qui parle à OpenAI, Anthropic, Groq ou Llama. Vous clonez le dépôt, fixez votre prix et attaquez la partie du produit pour laquelle les gens paient vraiment. Il repose sur Next.js au-dessus de React et Tailwind, donc une bonne partie du code boilerplate vous semble déjà familière.

Payant / $99 - $499 one-timeVoir les détails
Testim

Testim

Tricentis · Programmation

Testim est une plateforme d'automatisation des tests dopée à l'IA, qui sert à créer et exécuter des tests de bout en bout sur des applications web, mobiles et Salesforce. Elle s'appuie sur l'apprentissage automatique pour garder les tests stables quand une interface change, alors les équipes passent moins de temps à réparer des sélecteurs cassés. Pas mal pour un outil de tests automatisés que vous pouvez utiliser dès aujourd'hui. Vous créez des tests en enregistrant des actions dans un navigateur, puis vous ajoutez du JavaScript quand vous avez besoin de plus de contrôle. C'est un choix solide pour une équipe QA bien occupée.

Gratuit / Custom pricing on requestVoir les détails