GoModel
ENTERPILOT · Programmation
GoModel est une passerelle IA open source qui se place entre votre application et chaque grand modèle de langage que vous appelez. Elle expose une API compatible avec OpenAI et Anthropic, achemine les requêtes entre 33 fournisseurs et ajoute des couches de cache, de garde-fous, de budgets et de suivi de l'usage par requête. Si vous traitiez jusqu'ici le changement de fournisseur et l'attribution des coûts comme des problèmes de code applicatif, GoModel déplace cette logique dans un seul binaire auto-hébergé que vous contrôlez.
À propos de GoModel
Qu'est-ce que GoModel
GoModel est une passerelle, pas un modèle. Vous lancez un binaire Go à côté de votre application, vous pointez votre SDK existant vers son URL de base, et il gère les parties pénibles quand on parle à de nombreux fournisseurs de LLM en même temps. Le projet se décrit comme « comme OpenRouter, mais open source et auto-hébergé », et cette formule est juste. La couche de routage et de contrôle qu'OpenRouter vend comme service hébergé, GoModel vous la donne sous forme de logiciel que vous pouvez déployer vous-même. Pour les équipes à la recherche d'une alternative à OpenRouter qu'elles peuvent faire tourner sur leur propre matériel, c'est l'argument en une phrase.
La promesse centrale est le découplage. Le code de votre application appelle un nom stable, et le fournisseur et le modèle réels derrière ce nom changent via un ajustement de configuration plutôt qu'une réécriture. Ça marche. Quand un fournisseur tombe, un repli se déclenche automatiquement. Quand la même requête revient, un cache à correspondance exacte y répond plus vite et à moindre coût.
Le revers, c'est que l'auto-hébergement veut dire que l'exploitation vous revient. Vous lancez le binaire, configurez les clés des fournisseurs et gérez le stockage qui contient le cache et les données d'audit. Aucun éditeur ne corrige quoi que ce soit à votre place. L'infrastructure est la vôtre. Pour une équipe sans personne à l'aise avec l'exploitation d'infrastructure, c'est un coût réel, pas une note de bas de page. Prévoyez du temps pour cela.
Premiers pas
- Récupérez le projet depuis son dépôt GitHub et suivez le guide d'installation pour lancer le binaire Go unique dans votre environnement.
- Ajoutez les clés d'API des fournisseurs que vous utilisez, comme OpenAI, Anthropic ou Gemini, en variables d'environnement.
- Ouvrez l'interface d'administration intégrée et créez un modèle virtuel ou un alias, puis associez-le au fournisseur et au modèle réels qui se trouvent derrière.
- Changez l'URL de base de votre app pour l'endpoint GoModel et gardez votre SDK OpenAI ou Anthropic existant.
- Surveillez l'usage, les budgets et les journaux d'audit depuis le tableau de bord à mesure que le trafic passe par la passerelle.
Informations sur le produit
Aperçu des tarifs, des plateformes compatibles et des performances de GoModel.
Idéal pour
Les utilisateurs, tâches et cas d'usage où cet outil convient le mieux.
Utilisateurs
- Ingénieurs backend et plateforme
- Équipes DevOps et infrastructure
- Petites équipes produit
Tâches
- Changement de fournisseur
- Maîtrise des coûts
- Attribution de l'usage
- Déploiement de garde-fous
Cas d'usage
- Faire tourner une app en production qui a besoin d'un basculement automatique quand un fournisseur tombe.
- Auditer les requêtes après un incident, quand vous avez besoin de métadonnées d'exécution pour reconstituer ce qui s'est passé et pourquoi.
- Donner à chaque équipe une clé virtuelle délimitée, avec son propre budget et ses propres limites de débit.
- Évaluer de nombreux modèles derrière un seul endpoint pendant la recherche et le prototypage initiaux.
Fonctionnalités clés
Une seule API pour 33 fournisseurs
GoModel place OpenAI, Anthropic, Gemini, Bedrock, Vertex, Azure, Groq, Ollama, vLLM et d'autres derrière un seul endpoint. Cela fait 33 fournisseurs. Il reste compatible avec les formats de requête d'OpenAI et d'Anthropic, donc vous changez l'URL de base et gardez le SDK que vous connaissez déjà. Il alterne aussi entre plusieurs clés par fournisseur en round-robin, ce qui répartit la charge et réduit la portée d'une seule clé limitée.
Alias et modèles virtuels
Vous publiez des noms stables comme smart-chat et réassociez le fournisseur et le modèle réels derrière eux sans toucher au code de l'application. Pourquoi est-ce important ? Les équipes obtiennent une interface prévisible pendant que vous expérimentez ce qu'il y a en dessous. Le projet présente cela comme un changement de configuration, pas un changement d'application, et c'est tout l'intérêt.
Basculement automatique et répartition de charge
Quand un fournisseur renvoie une erreur de disponibilité, GoModel bascule vers le modèle ou le fournisseur suivant, réessaie avec un backoff et utilise un disjoncteur pour absorber les services instables. Il peut aussi répartir un modèle virtuel entre plusieurs cibles en round-robin pondéré, ou laisser le routage par coût choisir le modèle le moins cher capable de traiter une requête. Le basculement est automatique. C'est tout l'attrait.
Flux de travail délimités
Cache, audit, suivi de l'usage, budgets, garde-fous et basculement sont des interrupteurs que vous réglez par fournisseur, modèle ou parcours utilisateur. Les flux sont versionnés, et la portée la plus précise l'emporte, si bien qu'une route peut exiger la journalisation d'audit tandis qu'une autre tourne plus légère. C'est souple. C'est ainsi qu'on applique des comportements différents à des équipes différentes sans une pile de logique conditionnelle.
Garde-fous avant l'envoi
GoModel peut injecter des prompts système ou réécrire des messages avec un LLM avant qu'une requête ne parte. Les étapes s'exécutent en groupes ordonnés, et les groupes parallèles tournent ensemble. C'est un moyen d'imposer un ton, de bloquer certains contenus ou de normaliser les entrées de façon centralisée plutôt que de demander à chaque service de le faire. Moins de logique dupliquée.
Cache de réponses
Le cache à correspondance exacte renvoie les requêtes identiques plus vite et à moindre coût, donc la même requête ne paie pas le prix plein deux fois. Cela compte surtout dans les boucles d'agents et les nouvelles tentatives, où des appels quasi identiques s'accumulent et brûlent discrètement le budget. Petit changement, vraie économie.
Suivi de l'usage et journaux d'audit
Le suivi par requête associe la dépense à des équipes, des locataires et des fonctionnalités, au-delà du total unique qu'affiche le tableau de bord d'un fournisseur. Les journaux d'audit et les métadonnées d'exécution rendent chaque requête traçable, ce que vous voulez quand un basculement se déclenche et que personne ne se rappelle pourquoi. Aucune supposition.
Un seul binaire avec interface d'administration
La passerelle est livrée comme un seul binaire Go avec une interface d'administration intégrée et un stockage qui évolue avec votre charge via SQLite, Postgres ou MongoDB. Les métriques Prometheus et le streaming SSE sont inclus, donc les points d'observabilité existent dès le premier jour. Rien à ajouter après coup.
Avantages et inconvénients
Avantages
- Auto-hébergé et sous licence MIT, donc vos prompts et vos clés de fournisseur restent dans votre propre environnement.
- Une seule API compatible OpenAI et Anthropic couvre 33 fournisseurs et réduit le travail d'intégration à un changement d'URL de base.
- Les flux délimités vous laissent ajuster cache, audit, budgets et garde-fous par fournisseur, modèle ou parcours utilisateur.
- Le basculement automatique et les disjoncteurs empêchent la panne d'un seul fournisseur de faire tomber votre app.
- Le suivi de l'usage et les journaux d'audit intégrés répondent à « qui a dépensé quoi » et « que s'est-il passé » sans outillage supplémentaire.
Inconvénients
- L'auto-hébergement veut dire que le déploiement, les mises à jour et le stockage sont à votre charge, ce qui représente un vrai travail pour une équipe sans expérience en infrastructure.
- Les fonctionnalités Pro payantes se trouvent dans une offre distincte, donc l'expérience entièrement gérée ne fait pas partie du binaire gratuit.
- Le passthrough vers les fournisseurs conserve sa propre couche d'authentification et de suivi sur le trajet, ce qui ajoute un saut pour les équipes habituées à appeler les fournisseurs directement.
Questions fréquentes
Non. GoModel est une passerelle et un routeur. Il transmet les requêtes aux fournisseurs que vous configurez, comme OpenAI, Anthropic ou Gemini, et ne sert pas de modèles en propre.
Contenus associés
Découvrez des outils, des compétences et des articles liés à GoModel.
Alternatives à GoModel
Forefront
Forefront · ProgrammationForefront est une plateforme web pour construire avec de l'IA open source. Elle vous laisse affiner les principaux modèles de langage open source sur vos propres données, évaluer leurs performances et les exécuter via une API ou les exporter pour les héberger vous-même. Les développeurs qui veulent le confort d'une plateforme fermée mais tiennent à rester propriétaires de leurs modèles et de leurs données sont le public visé ici.
Startkit
StartKit.AI · ProgrammationStartkit est un boilerplate pour créer des produits SaaS d'IA et des wrappers d'IA. Voyez-le comme un boilerplate de startup IA avec les parties ennuyeuses déjà branchées : authentification, paiements Stripe et Lemon Squeezy, limites d'usage, e-mail transactionnel et un kit de démarrage d'API IA qui parle à OpenAI, Anthropic, Groq ou Llama. Vous clonez le dépôt, fixez votre prix et attaquez la partie du produit pour laquelle les gens paient vraiment. Il repose sur Next.js au-dessus de React et Tailwind, donc une bonne partie du code boilerplate vous semble déjà familière.
Testim
Tricentis · ProgrammationTestim est une plateforme d'automatisation des tests dopée à l'IA, qui sert à créer et exécuter des tests de bout en bout sur des applications web, mobiles et Salesforce. Elle s'appuie sur l'apprentissage automatique pour garder les tests stables quand une interface change, alors les équipes passent moins de temps à réparer des sélecteurs cassés. Pas mal pour un outil de tests automatisés que vous pouvez utiliser dès aujourd'hui. Vous créez des tests en enregistrant des actions dans un navigateur, puis vous ajoutez du JavaScript quand vous avez besoin de plus de contrôle. C'est un choix solide pour une équipe QA bien occupée.
