Forsy

Forsy

Forsy · Programmation

Forsy est une plateforme de données pour agents d'IA qui enregistre le comportement des agents pendant qu'ils tournent, et non après coup. Elle capture des flux de travail complets en temps réel à travers les chaînes d'outils, puis transforme cette activité en données de haute fidélité que les équipes peuvent évaluer, concéder sous licence ou échanger. Conçue par l'équipe derrière CPIBench-0, Forsy se présente comme la boucle d'apprentissage des agents d'IA qui opèrent dans le monde vivant.

Aperçu de l'interface de Forsy

À propos de Forsy

Qu'est-ce que Forsy

Forsy est une infrastructure de données et une place de marché d'agents pour les équipes qui construisent ou achètent des agents d'IA. Presque toutes les piles d'agents vous disent si une tâche s'est terminée. Elles ne vous disent pas comment l'agent y est parvenu, quels appels d'outils ont échoué, ni pourquoi une réponse a dérivé au milieu d'une exécution longue. Forsy comble ce vide. Il capture nativement les flux de travail des agents au moment où ils se produisent, puis emballe le résultat sous une forme que vous pouvez inspecter et réutiliser.

Le produit est livré avec CPIBench-0, un benchmark public pour évaluer la façon dont les modèles de pointe et les configurations d'agents gèrent des opérations qui dépendent de systèmes cyber-physiques. Ces projets couvrent la mécatronique, la fabrication, les matériaux et l'énergie, si bien que les données reflètent des conditions réelles et désordonnées, et non des tâches de laboratoire propres. Si vous évaluez une plateforme de données pour agents d'IA, ce duo de capture et d'évaluation constitue l'argument principal.

Le hic, c'est l'accès. Forsy fonctionne sur un modèle de demande de démonstration, sans inscription en libre-service et sans palier de prix publié. Vous ne pouvez donc pas l'essayer sans parler d'abord au service commercial. Il n'existe pas non plus de documentation publique de l'API. C'est un vrai obstacle pour les équipes qui aiment tester un outil avant de s'engager.

Pour commencer

  1. Ouvrez le site de Forsy et utilisez le formulaire de demande de démonstration, en indiquant votre nom, votre adresse e-mail et votre organisation.
  2. Attendez que l'équipe vous recontacte et programme une présentation de la plateforme, modules de capture et de place de marché compris.
  3. Pendant la démonstration, parcourez la façon dont les flux de travail sont capturés, ce que montrent les classements de CPIBench-0 et comment les données d'agents peuvent être concédées sous licence.
  4. Convenez du périmètre et des conditions d'accès avec l'équipe Forsy, car les tarifs et le conditionnement ne sont publiés nulle part.
  5. Connectez votre propre chaîne d'outils d'agents, ou commencez par les données publiques du benchmark avant de brancher des flux de travail en direct.

Informations sur le produit

Aperçu des tarifs, des plateformes compatibles et des performances de Forsy.

Offre gratuiteNon
Offres payantesCustom pricing
PlateformeWeb
DéveloppeurForsy
CatégorieProgrammation
Date de lancementJul 2025
Dernière mise à jourSep 2026
Visites du siteN/A
Classement mondial du siteN/A
Disponibilité de l’APIN/A

Idéal pour

Les utilisateurs, tâches et cas d'usage où cet outil convient le mieux.

Utilisateurs

  • Équipes d'IA qui construisent des agents
  • Responsables données et ML
  • Équipes opérationnelles dans l'industrie

Tâches

  • Capturer les flux de travail d'agents
  • Comparer les modèles et les configurations d'agents
  • Concéder des données d'agents sous licence

Cas d'usage

  • Évaluer un agent avant le déploiement
  • Étudier des opérations cyber-physiques
  • Construire un pipeline de données autour des agents

Fonctionnalités clés

Capture des flux de travail en temps réel

Forsy enregistre l'activité de l'agent pendant qu'il tourne, en capturant les appels d'outils, les changements de contexte et l'état de l'espace de travail au moment où ils surviennent. Vous obtenez la trace complète d'une tâche, et non un journal nettoyé reconstitué plus tard. Pour déboguer un agent qui se comporte différemment à chaque exécution, la différence compte. C'est la preuve qu'il vous faut.

Suivi de toute la chaîne d'outils

La plateforme suit les agents à travers leurs chaînes d'outils pour qu'un flux de travail reste connecté de bout en bout. Si un agent passe d'un système de fichiers à un outil de recherche puis à un endpoint personnalisé, Forsy garde chacune de ces étapes réunies dans une seule vue connectée. Les équipes qui évaluent une plateforme de données pour agents veulent en général cette couverture avant tout le reste.

Place de marché de données d'agents

Les flux de travail capturés deviennent des actifs. Forsy se décrit comme une place de marché où les équipes peuvent découvrir, concéder sous licence et échanger des données d'agents authentiques. Cela ouvre une voie de monétisation aux équipes qui détiennent des traces utiles. Les conditions de mise en vente et de licence passent par l'équipe Forsy plutôt que par une boutique en libre-service.

Benchmark CPIBench-0

Forsy publie CPIBench-0, son premier benchmark pour les modèles et les agents dans les opérations cyber-physiques. Il est construit à partir de projets réels en mécatronique, fabrication, matériaux et énergie, avec plus de 1900 exécutions évaluées. Le benchmark sépare un Model Track et un Agent Track. Vous voyez ainsi si la capacité brute survit à la configuration complète de l'agent.

Performance face au coût

Les classements de CPIBench-0 indiquent le taux de réussite et le score à côté du coût total, du temps d'exécution et de l'usage de jetons. Des vues comme le taux de réussite face au temps d'exécution total montrent combien un agent dépense pour atteindre un résultat donné, ce qui aide à repérer une configuration qui brûle des jetons pour un gain marginal. Pour les équipes à budget serré, ce cadrage est plus utile qu'un simple chiffre de précision.

Boucle d'apprentissage pour les agents déployés

L'idée centrale est une boucle d'apprentissage. Les agents opèrent dans le monde, leurs flux de travail sont capturés, et ces données nourrissent un comportement meilleur. Elle vise les agents qui travaillent dans des environnements réels et désordonnés plutôt que dans des bacs à sable. C'est pourquoi le benchmark s'appuie sur des projets industriels.

Avantages et inconvénients

Avantages

  • Capture le comportement de l'agent en temps réel, si bien que les traces reflètent ce qui s'est réellement passé
  • CPIBench-0 associe la précision au coût, au temps d'exécution et à la consommation de jetons pour évaluer les agents
  • Réunit la capture de données et une place de marché pour concéder et échanger des données d'agents
  • Les données du benchmark s'appuient sur de vrais projets industriels, et non sur des tâches synthétiques
  • Couvre à la fois le modèle de base et la configuration complète de l'agent dans ses classements

Inconvénients

  • Aucun tarif publié, vous ne pouvez donc pas estimer le coût sans parler au service commercial
  • Pas d'inscription en libre-service ; tout commence par une demande de démonstration
  • La disponibilité de l'API n'est pas indiquée, ce qui laisse la planification de l'intégration incertaine
  • La place de marché est récente, donc les conditions de mise en vente et de licence ne sont pas clairement documentées

Questions fréquentes

Forsy capture en temps réel les flux de travail des agents d'IA et les transforme en données que vous pouvez évaluer, concéder sous licence ou échanger. Qu'est-ce qui le distingue alors ? Il associe cette couche de capture à CPIBench-0, un benchmark pour les agents qui exécutent des opérations cyber-physiques.

Contenus associés

Découvrez des outils, des compétences et des articles liés à Forsy.

Alternatives à Forsy

Forefront

Forefront

Forefront · Programmation

Forefront est une plateforme web pour construire avec de l'IA open source. Elle vous laisse affiner les principaux modèles de langage open source sur vos propres données, évaluer leurs performances et les exécuter via une API ou les exporter pour les héberger vous-même. Les développeurs qui veulent le confort d'une plateforme fermée mais tiennent à rester propriétaires de leurs modèles et de leurs données sont le public visé ici.

Gratuit / $0 - $99/moVoir les détails
Startkit

Startkit

StartKit.AI · Programmation

Startkit est un boilerplate pour créer des produits SaaS d'IA et des wrappers d'IA. Voyez-le comme un boilerplate de startup IA avec les parties ennuyeuses déjà branchées : authentification, paiements Stripe et Lemon Squeezy, limites d'usage, e-mail transactionnel et un kit de démarrage d'API IA qui parle à OpenAI, Anthropic, Groq ou Llama. Vous clonez le dépôt, fixez votre prix et attaquez la partie du produit pour laquelle les gens paient vraiment. Il repose sur Next.js au-dessus de React et Tailwind, donc une bonne partie du code boilerplate vous semble déjà familière.

Payant / $99 - $499 one-timeVoir les détails
Testim

Testim

Tricentis · Programmation

Testim est une plateforme d'automatisation des tests dopée à l'IA, qui sert à créer et exécuter des tests de bout en bout sur des applications web, mobiles et Salesforce. Elle s'appuie sur l'apprentissage automatique pour garder les tests stables quand une interface change, alors les équipes passent moins de temps à réparer des sélecteurs cassés. Pas mal pour un outil de tests automatisés que vous pouvez utiliser dès aujourd'hui. Vous créez des tests en enregistrant des actions dans un navigateur, puis vous ajoutez du JavaScript quand vous avez besoin de plus de contrôle. C'est un choix solide pour une équipe QA bien occupée.

Gratuit / Custom pricing on requestVoir les détails