
SlimSnap
SlimSnap · Imagen · Programación
SlimSnap es una herramienta gratuita de captura a JSON pensada para programar con IA. Capturas una región de la pantalla, la anotas con flechas o llamadas y copias texto estructurado en lugar de una imagen. El OCR y las cajas delimitadoras deterministas vienen integrados, así que un agente ve el texto y la posición exactos de cada elemento en pantalla. Se ejecuta en local, no cuesta nada y funciona donde quepa texto. Entonces, ¿por qué recurrir a ella y no a una captura normal? Porque una captura normal es un callejón sin salida en una terminal.

Acerca de SlimSnap
Qué es SlimSnap
SlimSnap es una utilidad de escritorio que cubre un hueco en los flujos de trabajo de programación con IA. Herramientas como Claude Code, Aider y Codex CLI pueden leer tus archivos y ejecutar tus pruebas, pero no mirar tu pantalla. En cuanto quieres hablar de un fallo de interfaz, acabas escribiendo un párrafo para describir lo que una captura mostraría de un vistazo. Las terminales no aceptan imágenes, así que SlimSnap convierte la pantalla en algo que sí aceptan: texto. Es una captura estructurada para agentes, no otro archivo de imagen.
La idea central es sencilla. Una captura son píxeles, y los píxeles pierden información antes de que un modelo llegue a leerlos. SlimSnap, en cambio, exporta un documento estructurado. Cada etiqueta, botón y mensaje de error aparece con su texto, su posición en coordenadas normalizadas y cualquier anotación que hayas dibujado. Como los datos son deterministas, el agente deja de adivinar dónde están las cosas y empieza a arreglar lo que has marcado.
La limitación principal es el alcance. SlimSnap cubre solo macOS y Windows, y es un complemento para agentes de programación, no un editor de imágenes general. Quien use Linux tiene que escribir al equipo y esperar. Tampoco edita ni sustituye tus capturas actuales, así que si necesitas una imagen pulida para un informe de errores, seguirás recurriendo a otra herramienta. Es justo.
Primeros pasos
- Descarga la app gratuita desde el sitio oficial para macOS (Apple Silicon) o Windows 10/11.
- Pulsa ⌘⇧S en Mac o Ctrl+Shift+S en Windows y arrastra para seleccionar cualquier zona de la pantalla, o ⌘⇧L / Ctrl+Shift+L para una página entera con desplazamiento. Ese es todo el paso de captura.
- Añade flechas, llamadas o resaltados para señalar el elemento que quieres.
- Copia la captura como JSON y pégala en Claude Code, Aider o cualquier agente que acepte texto.
- Opcional: instala el conector para que Claude lea las capturas directamente de tu máquina sin pegar nada.
Información del producto
Un vistazo rápido a los precios, las plataformas compatibles y el rendimiento de SlimSnap.
Ideal para
Los usuarios, tareas y casos de uso en los que esta herramienta encaja mejor.
Usuarios
- Desarrolladores que usan agentes de programación con IA
- Ingenieros de QA y pruebas
- Equipos atentos a la accesibilidad
Tareas
- Reportar fallos de interfaz a un agente de programación
- Describir un estado de pantalla dentro de una terminal o una sesión SSH
- Capturar páginas largas con desplazamiento
Casos de uso
- Estás depurando un problema de diseño y escribir «el botón bajo la cabecera a la izquierda» no te lleva a ninguna parte.
- Trabajas por SSH en una máquina remota y quieres mostrarle a un agente cómo se ve una ventana local.
- Pegas algo en un mensaje de commit o en un registro de CI y necesitas la pantalla como texto, no como archivo adjunto.
Funciones clave
Captura a JSON estructurado
Todo el sentido de SlimSnap está en su formato de salida. En vez de una imagen plana, obtienes un documento donde cada elemento lleva un id, un tipo, su valor de texto y una caja delimitadora. Esa estructura es la que deja que un agente de programación razone sobre la pantalla igual que razona sobre el código. Es el paso que convierte una captura de región de pantalla para agentes de programación en algo sobre lo que pueden actuar.
Anotaciones que llevan intención
Una flecha o una llamada son intención, no adorno. Cuando señalas un botón, SlimSnap registra por id a qué elemento apunta la marca, así que la intención exportada dice «arregla e4» en lugar de dejar que el agente adivine qué querías. Marcar se vuelve una instrucción precisa. Una flecha. Un objetivo. Sin ambigüedad alguna.
OCR integrado y diseño determinista
El OCR viene incorporado, así que cada etiqueta, botón y mensaje de error de la captura llega como texto real. Esto es lo que una captura con OCR simple no te da. Las cajas delimitadoras viven en coordenadas normalizadas de 0 a 1, lo que significa que las posiciones se mantienen estables entre resoluciones. El agente ve las palabras que ves tú, en el sitio donde las ves.
Captura de página completa con desplazamiento
Pulsa ⌘⇧L o Ctrl+Shift+L para una captura de página completa. Desplázate tú mismo o deja que Autoscroll lo haga, y las páginas largas se dividen en fotogramas legibles envueltos en un solo JSON. Las páginas altas son todo el problema. Esto importa porque una herramienta de IA no puede leer una imagen muy alta, y una página alta redimensionada a menudo pierde su texto de cuerpo por completo.
Solo local por diseño
La captura y el OCR se ejecutan en tu máquina. No hay subida, ni cuenta, ni servidor de por medio, así que tus pantallas nunca salen del dispositivo. Eso es poco común. Para quien maneja interfaces sensibles, es la diferencia entre una herramienta que puede usar y otra que no.
Esquema abierto bajo MIT
El esquema JSON está publicado en GitHub bajo licencia MIT. Puedes leerlo, validar contra él o escribir tu propio exportador sin pedir permiso a nadie. Sin ataduras. Un formato abierto también significa que no te quedas atascado si luego quieres conectar capturas a un flujo personalizado.
Conector para agentes, sin pegar
Instala el conector y Claude lee tus capturas directamente de la máquina, así que puedes capturar, marcar y solo preguntar. Nada de pegar. Se distribuye como paquete para Claude Desktop, un comando de una línea para Claude Code o un enlace directo de Cursor.
Ventajas y desventajas
Ventajas
- Gratis y sin registro, y se instala en segundos.
- La salida estructurada conserva texto y posiciones que el redimensionado de imágenes destruiría. Nada se pierde.
- Las anotaciones se asignan a elementos concretos por id, así que la intención sobrevive el viaje hasta el agente.
- El procesamiento local mantiene las pantallas en la máquina, sin cuenta.
- El esquema abierto bajo MIT te deja validar, ampliar o construir tu propio exportador.
Desventajas
- Solo macOS y Windows; el soporte para Linux no está hecho y depende de solicitudes por correo.
- Es un complemento para agentes de programación, no un editor de capturas general, así que no sustituye a una herramienta para imágenes pulidas de informes de errores.
- La vía del conector se centra en Claude y Cursor, así que otros agentes dependen del copiar y pegar.
- Sin API, lo que limita la automatización para equipos que quieren programar capturas en el servidor.
Preguntas frecuentes
Convierte una región de pantalla en JSON estructurado que los agentes de programación con IA pueden leer. Capturas, anotas y copias el JSON en lugar de una imagen, así que el agente obtiene texto y posiciones exactas y no una imagen que tiene que interpretar. Es la forma más limpia de hacer una captura para Claude Code o cualquier herramienta basada en terminal.
Contenido relacionado
Explora herramientas, habilidades y artículos relacionados con SlimSnap.
Alternativas a SlimSnap
X Ray Interpreter
X-ray Interpreter · ImagenX Ray Interpreter es una herramienta de radiología con IA basada en web que convierte radiografías, tomografías, resonancias, ecografías e imágenes PET en informes en lenguaje sencillo. Subes un estudio, obtienes una interpretación preliminar de la radiografía en unos momentos y luego haces preguntas de seguimiento si algo necesita explicación. Funciona como segunda opinión y como apoyo de aprendizaje, no como diagnóstico médico.
Aieasypic
AIEasyPic · ImagenAIEasyPic es un generador de imágenes con IA que convierte prompts de texto simples en obras terminadas en segundos. También puedes entrenar modelos personalizados con tus propias fotos, intercambiar caras en imágenes existentes y crear clips de vídeo cortos a partir de texto, todo desde el navegador. Le va bien a los creadores ocasionales que quieren imágenes rápidas y a los aficionados que desean construir un modelo personal sin tocar una línea de código.
Chargen
Chargen · ImagenChargen es un generador de personajes con IA y un conjunto de herramientas de creación de mundos pensado para Dungeons & Dragons y otros juegos de rol de mesa. Convierte una idea de una línea en un retrato de personaje pintado, levanta PNJ, monstruos, mapas y encuentros desde la misma sesión, y mantiene los detalles de cada criatura a mano. La parte de arte para juegos de rol de mesa funciona con un sistema de créditos llamado Gold, mientras que los generadores de texto siguen siendo gratis para todos.
