Retrace

Retrace

Retrace · Programmation

Retrace est un moteur de rejeu d'exécution pour les agents IA. Il enregistre chaque appel au modèle, chaque invocation d'outil, chaque récupération et chaque erreur dans l'exécution d'un agent, puis laisse les ingénieurs rejouer cette exécution pas à pas. Quand quelque chose casse, vous bifurquez l'exécution depuis le span exact où ça a mal tourné. Vous changez une entrée ou un modèle. Puis vous relancez tout ce qui suit en aval pour voir ce que le correctif fait réellement.

Aperçu de l'interface de Retrace

À propos de Retrace

Qu'est-ce que Retrace

Retrace est une plateforme de débogage et de vérification conçue pour les équipes qui mettent des agents IA en production. Au lieu de lire des journaux et de deviner pourquoi un agent a produit une mauvaise réponse, vous ouvrez l'exécution enregistrée comme un arbre de spans. Puis vous le parcourez jusqu'à trouver le premier pas qui a échoué, dérivé ou renvoyé un résultat sans fondement.

Le produit vise une douleur précise. Les agents se comportent de façon non déterministe, donc un bug qui apparaît une fois en production est difficile à reproduire. Retrace règle ça en rendant les exécutions rejouables. Vous capturez l'exécution une fois. Puis vous la réexécutez autant de fois que nécessaire.

La principale limite est la portée. Retrace est un outil de développeur, pas un produit sans code, et il suppose que votre agent tourne sur les SDK compatibles ou parle à OpenAI, Anthropic ou Gemini. Les équipes sur des stacks inhabituels devront peut-être instrumenter les appels à la main. Le tarif se fait aussi au volume de traces. Les agents à très fort volume vous font vite monter dans les plans supérieurs.

Premiers pas

  1. Installez le SDK avec pip install retrace-sdk pour Python ou npm install retrace-sdk pour TypeScript.
  2. Configurez votre clé d'API avec retrace.configure(api_key="rt_...").
  3. Enveloppez la fonction de votre agent dans le décorateur @retrace.record et réglez resumable=True si vous voulez le rejeu en cascade par bifurcation plus tard.
  4. Lancez votre agent une fois. Les appels aux fournisseurs OpenAI, Anthropic et Gemini sont instrumentés automatiquement, donc la trace les capture sans travail supplémentaire.
  5. Ouvrez la trace enregistrée, inspectez l'arbre de spans et bifurquez depuis le premier pas divergent pour tester un correctif.

Informations sur le produit

Aperçu des tarifs, des plateformes compatibles et des performances de Retrace.

Offre gratuiteOui
Offres payantes$0 - $2000/mo
PlateformeWeb, Python SDK, TypeScript SDK
DéveloppeurRetrace
CatégorieProgrammation
Date de lancementAug 2025
Dernière mise à jourAug 2025
Visites du siteN/A
Classement mondial du siteN/A
Disponibilité de l’APIOui

Idéal pour

Les utilisateurs, tâches et cas d'usage où cet outil convient le mieux.

Utilisateurs

  • Ingénieurs IA qui déboguent des échecs d'agents en production
  • Équipes plateforme qui ajoutent des contrôles CI sur le comportement des agents
  • Fondateurs qui évaluent si un agent est prêt pour la production

Tâches

  • Reproduire un échec non déterministe
  • Tester un changement de prompt ou de modèle
  • Vérifier un correctif avant de livrer
  • Stopper une dépense incontrôlée

Cas d'usage

  • Un client signale une mauvaise réponse et vous devez trouver quel appel d'outil l'a causée
  • Un ajustement de prompt casse en silence un pas en aval
  • Une équipe veut partager un exemple assaini d'un bug

Fonctionnalités clés

Enregistrement des exécutions

Retrace capture chaque appel au modèle, chaque invocation d'outil, chaque récupération et chaque erreur sous forme de span avec son entrée, sa sortie, son coût et son minutage. Les appels aux fournisseurs OpenAI, Anthropic et Gemini sont instrumentés automatiquement, donc vous n'avez pas à câbler chacun à la main. Le résultat est un enregistrement complet et structuré de ce que votre agent a réellement fait. Pas un journal partiel. Pas une supposition.

Bifurcation et rejeu en cascade

C'est la capacité qui sépare Retrace des simples outils de supervision d'agents IA. Vous branchez une exécution enregistrée sur un seul span avec une entrée modifiée, puis vous rejouez en cascade chaque pas en aval pour que tout l'agent se réexécute sur le nouveau chemin. Elle répond à une question que les journaux ne peuvent pas. Si je change cette seule chose, qu'est-ce qui casse plus bas ?

Prouver le correctif

Après avoir changé un prompt, un outil ou un modèle, prouver-le-correctif relance l'exécution qui a échoué et renvoie un verdict. Vous obtenez l'un de trois résultats : amélioré, régressé ou inchangé, plus le premier span divergent. Ça transforme « je crois que ça l'a corrigé » en un résultat vérifiable.

Portes d'évaluation pour la CI/CD

La capacité d'évaluer et de poser une porte note les exécutions enregistrées selon des critères de comportement et renvoie une décision de porte passe ou échoue pour un pipeline. Les équipes peuvent lancer des contrôles de comportement en CI à côté de leurs tests habituels. Un agent qui dérive est rattrapé avant d'atteindre les utilisateurs. Les détecteurs de juge multi-agents sont disponibles à partir du plan Pro.

Application des budgets et des garde-fous

Avant que votre agent fasse son prochain appel au modèle ou à l'outil, appliquer-budget demande si cet appel est autorisé. Il renvoie autoriser, bloquer ou retenir selon les budgets de coût, la détection de boucles et les plafonds de latence. C'est ainsi que vous stoppez une boucle incontrôlée ou un pic de dépense coûteux avant qu'il n'arrive. Pas après que la facture tombe.

Recherche sémantique dans les traces

Chercher-spans lance une recherche sémantique dans les spans enregistrés et les mémoires de l'agent pour retrouver des occurrences antérieures d'un comportement, d'un prompt ou d'un échec par le sens plutôt que par le texte exact. Si un bug similaire est apparu il y a trois semaines, vous pouvez le ressortir sans vous rappeler la formulation exacte.

Mémoire de l'agent

Retrace livre un stockage de mémoire basé sur MCP qui conserve des faits persistants, des préférences, des corrections et des motifs extraits d'exécutions antérieures de l'agent. Les agents peuvent les rappeler par le sens, ce qui aide à garder un comportement cohérent d'une session à l'autre au lieu de réapprendre les mêmes corrections chaque fois.

Bandes publiées

Publier-bande convertit une exécution nettoyée en une bande interactive et partageable. C'est utile pour les rapports de bug, les démos et les retours d'expérience, et la suppression des données personnelles est incluse dans tous les plans. Le niveau gratuit autorise 10 bandes publiées par mois.

Avantages et inconvénients

Avantages

  • Le rejeu pas à pas rend reproductibles les échecs non déterministes des agents, ce qui est le problème central que la plupart des outils de journalisation laissent sans réponse.
  • La bifurcation et le rejeu en cascade testent un seul changement contre tout le chemin en aval, donc vous voyez les effets de bord avant qu'ils n'atteignent la production.
  • L'instrumentation automatique pour OpenAI, Anthropic et Gemini réduit la configuration à un décorateur et une clé d'API.
  • Le plan gratuit est réel, pas un essai : 1 000 traces, 10 rejeux par bifurcation et la suppression des données personnelles sont inclus.
  • Les portes d'évaluation de la CI permettent de tester le comportement de l'agent comme du code ordinaire, avec un résultat passe ou échoue sur lequel un pipeline peut agir.

Inconvénients

  • Aucune entrée en libre-service sous $29/mo pour le rejeu déterministe par cassettes, donc les développeurs solo ont une profondeur de rejeu limitée sur le plan gratuit.
  • Le plan gratuit conserve les traces 7 jours et donne un seul siège, ce qui ne couvre pas une équipe qui partage des traces.
  • Le support se limite aux fournisseurs OpenAI, Anthropic et Gemini, donc les agents sur d'autres fournisseurs de modèles demandent une instrumentation manuelle.

Questions fréquentes

Retrace enregistre les exécutions d'agents IA et les rend rejouables. Vous capturez une exécution une fois, puis vous la rejouez, la bifurquez à n'importe quel pas et testez des changements sans que l'échec d'origine doive se reproduire.

Contenus associés

Découvrez des outils, des compétences et des articles liés à Retrace.

Alternatives à Retrace

Forefront

Forefront

Forefront · Programmation

Forefront est une plateforme web pour construire avec de l'IA open source. Elle vous laisse affiner les principaux modèles de langage open source sur vos propres données, évaluer leurs performances et les exécuter via une API ou les exporter pour les héberger vous-même. Les développeurs qui veulent le confort d'une plateforme fermée mais tiennent à rester propriétaires de leurs modèles et de leurs données sont le public visé ici.

Gratuit / $0 - $99/moVoir les détails
Startkit

Startkit

StartKit.AI · Programmation

Startkit est un boilerplate pour créer des produits SaaS d'IA et des wrappers d'IA. Voyez-le comme un boilerplate de startup IA avec les parties ennuyeuses déjà branchées : authentification, paiements Stripe et Lemon Squeezy, limites d'usage, e-mail transactionnel et un kit de démarrage d'API IA qui parle à OpenAI, Anthropic, Groq ou Llama. Vous clonez le dépôt, fixez votre prix et attaquez la partie du produit pour laquelle les gens paient vraiment. Il repose sur Next.js au-dessus de React et Tailwind, donc une bonne partie du code boilerplate vous semble déjà familière.

Payant / $99 - $499 one-timeVoir les détails
Testim

Testim

Tricentis · Programmation

Testim est une plateforme d'automatisation des tests dopée à l'IA, qui sert à créer et exécuter des tests de bout en bout sur des applications web, mobiles et Salesforce. Elle s'appuie sur l'apprentissage automatique pour garder les tests stables quand une interface change, alors les équipes passent moins de temps à réparer des sélecteurs cassés. Pas mal pour un outil de tests automatisés que vous pouvez utiliser dès aujourd'hui. Vous créez des tests en enregistrant des actions dans un navigateur, puis vous ajoutez du JavaScript quand vous avez besoin de plus de contrôle. C'est un choix solide pour une équipe QA bien occupée.

Gratuit / Custom pricing on requestVoir les détails