Forsy

Forsy

Forsy · Programación

Forsy es una plataforma de datos para agentes de IA que registra cómo se comportan los agentes mientras se ejecutan, no después. Captura flujos de trabajo completos en tiempo real a lo largo de las cadenas de herramientas y luego convierte esa actividad en datos de alta fidelidad que los equipos pueden evaluar, licenciar o comerciar. Creada por el equipo detrás de CPIBench-0, Forsy se posiciona como el bucle de aprendizaje para agentes de IA que operan en el mundo vivo.

Vista previa de la interfaz de Forsy

Acerca de Forsy

Qué es Forsy

Forsy es una infraestructura de datos y un mercado de agentes para equipos que construyen o compran agentes de IA. Casi todas las pilas de agentes te dicen si una tarea terminó. No te dicen cómo llegó hasta ahí, qué llamadas a herramientas fallaron ni por qué una respuesta se desvió a mitad de una ejecución larga. Forsy cubre ese hueco. Captura de forma nativa los flujos de trabajo de los agentes mientras ocurren y después empaqueta el resultado como algo que puedes inspeccionar y reutilizar.

El producto incluye CPIBench-0, un benchmark público para evaluar cómo los modelos de frontera y las configuraciones de agentes manejan operaciones que dependen de sistemas ciberfísicos. Esos proyectos abarcan mecatrónica, manufactura, materiales y energía, así que los datos reflejan condiciones reales y desordenadas, no tareas de laboratorio limpias. Si estás evaluando una plataforma de datos para agentes de IA, esta pareja de captura y evaluación es el argumento principal.

El problema está en el acceso. Forsy funciona con un modelo de solicitud de demo, sin registro autoservicio y sin niveles de precio publicados. Así que no puedes probarlo sin hablar antes con ventas. Tampoco hay documentación pública de la API. Es una barrera real para los equipos a los que les gusta probar una herramienta antes de comprometerse.

Cómo empezar

  1. Abre el sitio de Forsy y usa el formulario de solicitud de demo, con tu nombre, tu correo y tu organización.
  2. Espera a que el equipo te contacte y agende un recorrido por la plataforma, incluidos los módulos de captura y de mercado.
  3. En la demo, repasa cómo se capturan los flujos de trabajo, qué muestran las clasificaciones de CPIBench-0 y cómo se pueden licenciar los datos de agentes.
  4. Acuerda el alcance y las condiciones de acceso con el equipo de Forsy, ya que el precio y el empaquetado no se publican en ninguna parte.
  5. Conecta tu propia cadena de herramientas de agentes, o empieza con los datos públicos del benchmark antes de conectar flujos de trabajo en vivo.

Información del producto

Un vistazo rápido a los precios, las plataformas compatibles y el rendimiento de Forsy.

Plan gratuitoNo
Planes de pagoCustom pricing
PlataformaWeb
DesarrolladorForsy
CategoríaProgramación
Fecha de lanzamientoJul 2025
Última actualizaciónSep 2026
Visitas al sitio webN/A
Ranking global del sitioN/A
Disponibilidad de la APIN/A

Ideal para

Los usuarios, tareas y casos de uso en los que esta herramienta encaja mejor.

Usuarios

  • Equipos de IA que construyen agentes
  • Responsables de datos y ML
  • Grupos de operaciones en la industria

Tareas

  • Capturar flujos de trabajo de agentes
  • Comparar modelos y configuraciones de agentes
  • Licenciar datos de agentes

Casos de uso

  • Evaluar un agente antes de desplegarlo
  • Investigar operaciones ciberfísicas
  • Montar un pipeline de datos alrededor de los agentes

Funciones clave

Captura de flujos de trabajo en tiempo real

Forsy registra la actividad del agente mientras este se ejecuta, y captura llamadas a herramientas, cambios de contexto y estado del espacio de trabajo tal como ocurren. Obtienes el rastro completo de una tarea, no un registro limpio armado después. Para depurar un agente que se comporta distinto en cada ejecución, la diferencia importa. Es la evidencia que necesitas.

Seguimiento de toda la cadena de herramientas

La plataforma sigue a los agentes a lo largo de sus cadenas de herramientas para que un flujo de trabajo permanezca conectado de principio a fin. Si un agente salta entre un sistema de archivos, una herramienta de búsqueda y un endpoint propio, Forsy mantiene cada uno de esos pasos juntos en una sola vista conectada. Los equipos que evalúan una plataforma de datos para agentes suelen querer esta cobertura antes que nada.

Mercado de datos de agentes

Los flujos de trabajo capturados se convierten en activos. Forsy se describe como un mercado donde los equipos pueden descubrir, licenciar y comerciar datos auténticos de agentes. Eso abre un camino para que los equipos que tienen rastros útiles los monetaricen. Las condiciones de publicación y licencia pasan por el equipo de Forsy en lugar de por una tienda autoservicio.

Benchmark CPIBench-0

Forsy publica CPIBench-0, su primer benchmark para modelos y agentes en operaciones ciberfísicas. Está construido a partir de proyectos reales de mecatrónica, manufactura, materiales y energía, con más de 1900 ejecuciones evaluadas. El benchmark separa un Model Track y un Agent Track. Así puedes ver si la capacidad bruta sobrevive a la configuración completa del agente.

Rendimiento frente a coste

Las clasificaciones de CPIBench-0 informan la tasa de éxito y la puntuación junto al coste total, el tiempo de ejecución y el uso de tokens. Vistas como tasa de éxito frente a tiempo de ejecución total muestran cuánto gasta un agente para llegar a un resultado dado, lo que ayuda a detectar una configuración que quema tokens por una ganancia marginal. Para equipos con presupuesto ajustado, ese enfoque es más útil que un solo número de precisión.

Bucle de aprendizaje para agentes desplegados

La idea central es un bucle de aprendizaje. Los agentes funcionan en el mundo, sus flujos de trabajo se capturan y esos datos vuelven a alimentar un comportamiento mejor. Está pensado para agentes que operan en entornos reales y desordenados, no en sandboxes. Por eso el benchmark se apoya en proyectos industriales.

Ventajas y desventajas

Ventajas

  • Captura el comportamiento del agente en tiempo real, así que los rastros reflejan lo que de verdad pasó
  • CPIBench-0 combina precisión con coste, tiempo de ejecución y gasto de tokens para evaluar agentes
  • Une la captura de datos con un mercado para licenciar y comerciar datos de agentes
  • Los datos del benchmark se basan en proyectos industriales reales, no en tareas sintéticas
  • Cubre tanto el modelo base como la configuración completa del agente en sus clasificaciones

Desventajas

  • No hay precios publicados, así que no puedes estimar el coste sin hablar con ventas
  • Sin registro autoservicio; todo empieza con una solicitud de demo
  • La disponibilidad de API no se indica, lo que deja la planificación de la integración en el aire
  • El mercado es joven, así que las condiciones de publicación y licencia no están bien documentadas

Preguntas frecuentes

Forsy captura flujos de trabajo de agentes de IA en tiempo real y los convierte en datos que puedes evaluar, licenciar o comerciar. ¿Y qué lo hace distinto? Une esa capa de captura con CPIBench-0, un benchmark para agentes que ejecutan operaciones ciberfísicas.

Contenido relacionado

Explora herramientas, habilidades y artículos relacionados con Forsy.

Alternativas a Forsy

Forefront

Forefront

Forefront · Programación

Forefront es una plataforma web para construir con IA de código abierto. Te deja ajustar los principales modelos de lenguaje de código abierto con tus propios datos, evaluar cómo rinden y ejecutarlos a través de una API o exportarlos para alojarlos tú mismo. Los desarrolladores que quieren la comodidad de una plataforma cerrada pero insisten en ser dueños de sus modelos y sus datos son el público objetivo.

Gratis / $0 - $99/moVer detalles
Startkit

Startkit

StartKit.AI · Programación

Startkit es un boilerplate para crear productos de SaaS con IA y wrappers de IA. Piénsalo como un boilerplate para startups de IA con las partes aburridas ya conectadas: autenticación, pagos con Stripe y Lemon Squeezy, límites de uso, correo transaccional y un kit de inicio de API de IA que habla con OpenAI, Anthropic, Groq o Llama. Clonas el repositorio, pones tu precio y te dedicas a la parte del producto por la que la gente paga de verdad. Está hecho con Next.js sobre React y Tailwind, así que buena parte del código boilerplate ya te resulta familiar.

De pago / $99 - $499 one-timeVer detalles
Testim

Testim

Tricentis · Programación

Testim es una plataforma de automatización de pruebas impulsada por IA para crear y ejecutar pruebas de extremo a extremo en aplicaciones web, móviles y Salesforce. Se apoya en el aprendizaje automático para mantener las pruebas estables cuando cambia una interfaz, así que los equipos dedican menos tiempo a reparar selectores rotos. No está nada mal para una herramienta de pruebas automatizadas que puedes empezar a usar hoy mismo. Creas pruebas grabando acciones en un navegador y luego añades JavaScript cuando necesitas más control. Es una opción sólida para equipos de QA con mucho trabajo.

Gratis / Custom pricing on requestVer detalles