SlimSnap

SlimSnap

SlimSnap · Image · Programmation

SlimSnap est un outil gratuit de capture vers JSON conçu pour la programmation assistée par IA. Vous capturez une zone de l'écran, vous l'annotez de flèches ou de légendes, et vous copiez du texte structuré plutôt qu'une image. L'OCR et des cadres de délimitation déterministes sont intégrés, si bien qu'un agent voit le texte et la position exacts de chaque élément à l'écran. Il tourne en local, ne coûte rien et fonctionne partout où du texte peut passer. Alors pourquoi y recourir plutôt qu'à une capture classique ? Parce qu'une capture classique est une impasse dans un terminal.

Aperçu de l'interface de SlimSnap

À propos de SlimSnap

Qu'est-ce que SlimSnap

SlimSnap est un utilitaire de bureau qui comble une lacune dans les flux de programmation assistée par IA. Des outils comme Claude Code, Aider et Codex CLI savent lire vos fichiers et lancer vos tests, mais pas regarder votre écran. Dès que vous voulez parler d'un bug d'interface, vous finissez par taper un paragraphe pour décrire ce qu'une capture montrerait d'un coup d'œil. Les terminaux n'acceptent pas les images, alors SlimSnap transforme l'écran en quelque chose qu'ils acceptent : du texte. C'est une capture structurée pour agents, pas un fichier image de plus.

L'idée de base est simple. Une capture, ce sont des pixels, et les pixels perdent de l'information avant qu'un modèle ne les lise. SlimSnap, lui, exporte un document structuré. Chaque libellé, bouton et message d'erreur apparaît avec son texte, sa position en coordonnées normalisées et toute annotation que vous avez dessinée. Comme les données sont déterministes, l'agent cesse de deviner où sont les choses et se met à corriger ce que vous avez marqué.

La principale limite, c'est la portée. SlimSnap ne couvre que macOS et Windows, et c'est un compagnon pour agents de programmation, pas un éditeur d'images généraliste. Les utilisateurs de Linux doivent écrire à l'équipe et attendre. Il ne modifie pas non plus vos captures existantes ni ne les remplace, donc si vous voulez une image soignée pour un rapport de bug, vous vous tournerez encore vers un autre outil. C'est juste.

Premiers pas

  1. Téléchargez l'application gratuite sur le site officiel pour macOS (Apple Silicon) ou Windows 10/11.
  2. Appuyez sur ⌘⇧S sur Mac ou Ctrl+Shift+S sur Windows et faites glisser pour sélectionner n'importe quelle zone de l'écran, ou ⌘⇧L / Ctrl+Shift+L pour une page entière avec défilement. Toute l'étape de capture tient là.
  3. Ajoutez des flèches, des légendes ou des surlignages pour désigner l'élément visé.
  4. Copiez la capture au format JSON, puis collez-la dans Claude Code, Aider ou tout agent qui accepte du texte.
  5. Facultatif : installez le connecteur pour que Claude lise les captures directement depuis votre machine, sans rien coller.

Informations sur le produit

Aperçu des tarifs, des plateformes compatibles et des performances de SlimSnap.

Offre gratuiteOui
Offres payantes$0
PlateformemacOS, Windows
DéveloppeurSlimSnap
CatégorieImage · Programmation
Date de lancementNov 2024
Dernière mise à jourSep 2025
Visites du site4.3K
Classement mondial du site4.4M
Disponibilité de l’APINon

Idéal pour

Les utilisateurs, tâches et cas d'usage où cet outil convient le mieux.

Utilisateurs

  • Développeurs qui utilisent des agents de programmation IA
  • Ingénieurs QA et de test
  • Équipes sensibles à l'accessibilité

Tâches

  • Signaler un bug d'interface à un agent de programmation
  • Décrire un état d'écran dans un terminal ou une session SSH
  • Capturer de longues pages à défilement

Cas d'usage

  • Vous déboguez un problème de mise en page et taper « le bouton sous l'en-tête à gauche » ne mène nulle part.
  • Vous travaillez en SSH sur une machine distante et voulez montrer à un agent à quoi ressemble une fenêtre locale.
  • Vous collez dans un message de commit ou un journal de CI et avez besoin de l'écran sous forme de texte, pas de pièce jointe.

Fonctionnalités clés

Capture vers JSON structuré

Tout l'intérêt de SlimSnap tient à son format de sortie. Au lieu d'une image plate, vous obtenez un document où chaque élément porte un id, un type, sa valeur textuelle et un cadre de délimitation. Cette structure est ce qui permet à un agent de programmation de raisonner sur l'écran comme il raisonne sur du code. C'est l'étape qui transforme une capture de zone d'écran pour agents de programmation en quelque chose sur quoi ils peuvent agir.

Des annotations porteuses d'intention

Une flèche ou une légende, c'est une intention, pas une décoration. Quand vous désignez un bouton, SlimSnap enregistre par id l'élément que la marque vise, si bien que l'intention exportée dit « corrige e4 » au lieu de laisser l'agent deviner ce que vous vouliez dire. Marquer devient une instruction précise. Une flèche. Une cible. Plus aucune ambiguïté.

OCR intégré et mise en page déterministe

L'OCR est intégré, donc chaque libellé, bouton et message d'erreur de la capture arrive sous forme de vrai texte. C'est ce qu'une capture OCR toute simple ne vous donne pas. Les cadres de délimitation tiennent dans des coordonnées normalisées de 0 à 1, ce qui veut dire que les positions restent stables d'une résolution à l'autre. L'agent voit les mots que vous voyez, à l'endroit où vous les voyez.

Capture de page entière à défilement

Appuyez sur ⌘⇧L ou Ctrl+Shift+L pour une capture pleine page. Faites défiler vous-même ou laissez Autoscroll s'en charger, et les longues pages se découpent en cadres lisibles réunis dans un seul JSON. Les pages hautes sont tout le problème. Cela compte parce qu'un outil d'IA ne peut pas lire une image très haute, et qu'une page haute redimensionnée perd souvent tout son texte de corps.

Local uniquement par conception

La capture et l'OCR tournent sur votre machine. Aucun envoi, aucun compte, aucun serveur dans la boucle, donc vos écrans ne quittent jamais l'appareil. C'est rare. Pour qui manipule des interfaces sensibles, c'est la différence entre un outil utilisable et un outil à écarter.

Schéma ouvert sous MIT

Le schéma JSON est publié sur GitHub sous licence MIT. Vous pouvez le lire, valider vos données dessus ou écrire votre propre exportateur sans demander la permission à personne. Aucun verrouillage. Un format ouvert veut aussi dire que vous n'êtes pas coincé si vous voulez plus tard brancher vos captures sur un pipeline maison.

Connecteur pour agents, sans collage

Installez le connecteur et Claude lit vos captures directement depuis la machine : vous capturez, vous marquez, vous demandez. Aucun collage. Il se présente sous forme de paquet pour Claude Desktop, d'une commande en une ligne pour Claude Code ou d'un lien direct Cursor.

Avantages et inconvénients

Avantages

  • Gratuit et sans inscription, et l'installation prend quelques secondes.
  • La sortie structurée préserve le texte et les positions que le redimensionnement d'image détruirait. Rien ne se perd.
  • Les annotations se rattachent à des éléments précis par id, donc l'intention survit jusqu'à l'agent.
  • Le traitement local garde les écrans sur la machine, sans compte requis.
  • Le schéma ouvert sous MIT vous laisse valider, étendre ou bâtir votre propre exportateur.

Inconvénients

  • macOS et Windows seulement ; la prise en charge de Linux n'existe pas et dépend de demandes par courriel.
  • C'est un compagnon pour agents de programmation, pas un éditeur de captures généraliste, donc il ne remplacera pas un outil pour des images soignées de rapport de bug.
  • La voie du connecteur se concentre sur Claude et Cursor, donc les autres agents en restent au copier-coller.
  • Pas d'API, ce qui limite l'automatisation pour les équipes qui veulent scripter des captures côté serveur.

Questions fréquentes

Il transforme une zone d'écran en JSON structuré que les agents de programmation IA peuvent lire. Vous capturez, annotez et copiez le JSON à la place d'une image, donc l'agent reçoit un texte et des positions exacts, et non une image qu'il doit interpréter. C'est la façon la plus propre de faire une capture pour Claude Code ou tout outil fondé sur un terminal.

Contenus associés

Découvrez des outils, des compétences et des articles liés à SlimSnap.

Alternatives à SlimSnap

X Ray Interpreter

X Ray Interpreter

X-ray Interpreter · Image

X Ray Interpreter est un outil de radiologie par IA basé sur le web qui transforme les radiographies, les scanners, les IRM, les échographies et les images TEP en comptes rendus en langage clair. Vous téléchargez un examen, obtenez une interprétation préliminaire de la radiographie en quelques instants, puis posez des questions complémentaires si quelque chose mérite une explication. Il sert de second avis et d'aide à l'apprentissage, pas de diagnostic médical.

Gratuit / $9.9 - $99Voir les détails
Aieasypic

Aieasypic

AIEasyPic · Image

AIEasyPic est un générateur d'images par IA qui transforme de simples prompts texte en œuvres finies en quelques secondes. Vous pouvez aussi entraîner des modèles personnalisés sur vos propres photos, échanger des visages dans des images existantes et créer de courts clips vidéo à partir de texte, le tout depuis un navigateur. Il convient aux créateurs occasionnels qui veulent des visuels rapides et aux amateurs qui souhaitent bâtir un modèle personnel sans toucher à la moindre ligne de code.

Gratuit / $6.60 - $29.40/moVoir les détails
Chargen

Chargen

Chargen · Image

Chargen est un générateur de personnages par IA et une boîte à outils de création d'univers conçue pour Donjons & Dragons et les autres jeux de rôle sur table. Il transforme une idée d'une ligne en un portrait de personnage peint, crée des PNJ, des monstres, des cartes et des rencontres dans la même session, et garde les détails de chaque créature à portée de main. Le volet art pour jeu de rôle sur table repose sur un système de crédits appelé Gold, tandis que les générateurs de texte restent gratuits pour tous.

Gratuit / $0 - $30/moVoir les détails