
Google Gemma 4
Google DeepMind · Autres
Google Gemma 4 est une famille de modèles d'IA à poids ouverts de Google DeepMind conçue pour le raisonnement avancé et les flux de travail d'agents. Elle existe en quatre tailles, des petits modèles qui tournent sur téléphone jusqu'à un modèle dense de 31B qui tient sur le GPU d'une seule station de travail. Vous téléchargez les poids gratuitement sous licence Apache 2.0, vous les modifiez et vous les exécutez où vous voulez. De quoi faire de Gemma 4 un choix pratique quand vous voulez garder le contrôle total de vos données plutôt que dépendre d'une API dans le cloud. Aucun envoi requis. Aucune facture surprise à la fin du mois.

À propos de Google Gemma 4
Qu'est-ce que Google Gemma 4
Google Gemma 4 est la quatrième génération de la gamme de modèles ouverts de Google, et elle s'appuie sur la même base de recherche que les modèles fermés Gemini 3 de l'entreprise, publiée sous forme de poids téléchargeables que n'importe qui peut inspecter et affiner. La famille couvre quatre tailles : deux modèles compacts pour les appareils (Effective 2B et Effective 4B), un modèle à mélange d'experts de 26B et un modèle dense de 31B. Sur le classement de texte d'Arena AI, la version 31B se place au troisième rang des modèles ouverts, tandis que la version 26B occupe le sixième. Voyez-le comme un LLM local qui vous appartient entièrement.
Le principal problème qu'il résout, c'est le contrôle. Avec les poids sur votre matériel, rien ne quitte votre machine et il n'y a aucune facture au token. Cela compte si vous traitez des dossiers privés, travaillez hors ligne ou avez besoin de coûts prévisibles à grande échelle. C'est aussi simple que ça.
Le gros point noir, c'est le matériel et l'installation. Les petits modèles tournent sur des appareils du quotidien, mais les versions 26B et 31B exigent un vrai GPU, et toutes les tailles vous demandent de gérer vous-même le service, la quantification et les mises à jour. L'affinage est réellement ouvert, mais cette liberté a un prix. Prévoyez de la patience.
Pour commencer
- Choisissez une taille adaptée à votre matériel, en commençant par E2B ou E4B si vous êtes sur téléphone ou portable.
- Téléchargez les poids depuis Hugging Face ou la page Gemma de Google, ou ouvrez-les dans Google AI Studio.
- Chargez le modèle dans votre environnement d'exécution et, si besoin, appliquez une quantification 4 bits pour réduire l'usage de mémoire.
- Envoyez-lui du texte, des images ou de l'audio selon la tâche, puis branchez l'appel de fonctions ou la sortie JSON si vous construisez un agent.
- Facultativement, affinez le modèle sur vos propres données pour figer un ton ou une tâche précise, puis déployez-le en local.
Informations sur le produit
Aperçu des tarifs, des plateformes compatibles et des performances de Google Gemma 4.
Idéal pour
Les utilisateurs, tâches et cas d'usage où cet outil convient le mieux.
Utilisateurs
- Les développeurs qui veulent affiner un modèle d'IA sur l'appareil avec leurs propres données et conserver les poids, puisque la licence Apache 2.0 autorise l'usage commercial et la redistribution.
- Les chercheurs et les équipes soucieuses de la confidentialité qui doivent faire tourner l'inférence hors ligne sur du matériel local plutôt que d'envoyer des données à un service cloud.
- Les passionnés dotés d'un GPU milieu de gamme qui veulent un raisonnement de niveau pointe sans payer de frais au token.
Tâches
- Raisonnement en plusieurs étapes et casse-têtes logiques
- Créer des agents locaux
- Travail multimodal comme décrire des images ou traiter de courts clips vidéo et audio, que toute la famille prend en charge à des niveaux variables.
Cas d'usage
- Une startup qui prototypе un assistant sur un portable avant de s'engager sur une infrastructure cloud.
- Choisir les bons cas d'usage de Gemma 4 pour une équipe qui veut un contrôle total des données plutôt qu'une API gérée.
- Une entreprise avec des données réglementées qui doit tout garder sur ses propres serveurs.
- Une app Android qui a besoin de comprendre sur l'appareil sans aller-retour réseau.
Fonctionnalités clés
Quatre tailles pour différents matériels
Gemma 4 existe en variantes E2B, E4B, 26B MoE et 31B dense, donc vous adaptez le modèle à l'appareil et non l'inverse. Les deux modèles pour appareils visent téléphones et portables, tandis que les versions 26B et 31B tournent sur un seul GPU grand public ou de station de travail. Cette amplitude est tout l'intérêt : une famille, de la poche au bureau. Choisissez par appareil, pas par effet de mode.
Raisonnement avancé et flux de travail d'agents
Google a conçu Gemma 4 pour la logique en plusieurs étapes, pas seulement pour le chat. Il gère l'appel de fonctions, la sortie JSON structurée et les instructions système de façon native, ce qu'il vous faut pour assembler un agent qui agit sur les résultats au lieu de simplement parler. Le modèle 31B occupe aujourd'hui le troisième rang des modèles ouverts sur le classement d'Arena AI. Un bond énorme par rapport à la génération précédente.
Entrée multimodale
La famille lit le texte et les images, et les modèles pour appareils ajoutent une entrée audio native pour comprendre la parole. La prise en charge des images et des vidéos courtes traverse toute la gamme avec une entrée à résolution variable, donc vous n'êtes pas enfermé dans un seul format. Pour un sous-titrage simple ou des questions sur une image, les modèles compacts suffisent souvent sans un plus gros modèle serveur. C'est beaucoup d'amplitude pour une seule famille.
Licence ouverte Apache 2.0
Les versions antérieures de Gemma sortaient sous une licence personnalisée avec des restrictions d'usage. Gemma 4 passe à Apache 2.0, ce qui autorise l'usage commercial, la modification et la redistribution sans accord particulier. C'est le changement le plus important pour quiconque se demande s'il peut lancer un produit dessus. Pas besoin d'équipe juridique.
Base construite sur la recherche Gemini 3
Les modèles reposent sur la même recherche et la même technologie que Gemini 3, donc vous obtenez des capacités proches du modèle phare fermé de Google dans un paquet ouvert. Google présente les deux gammes comme complémentaires plutôt que concurrentes, avec Gemma pour le contrôle et Gemini pour le confort géré. Pour les équipes qui n'ont jamais voulu de dépendance au cloud, cette base partagée est l'atout. Même ADN, règles différentes.
Accès par API en plus de l'exécution locale
Vous pouvez récupérer Gemma 4 via l'API Gemini de Google et AI Studio si vous préférez ne pas l'héberger vous-même, et il est aussi disponible via Vertex AI et Hugging Face. L'héberger vous-même est optionnel, pas obligatoire. Cette souplesse convient aux équipes qui veulent prototyper dans le cloud et passer au matériel local ensuite. Testez pas cher, déployez en local.
Avantages et inconvénients
Avantages
- Gratuit à télécharger et à exécuter, sans coût au token une fois sur votre matériel.
- La licence Apache 2.0 autorise l'usage commercial, l'affinage et la redistribution.
- Quatre tailles couvrent du téléphone à la station de travail, donc vous choisissez selon votre appareil.
- L'appel de fonctions natif et la sortie JSON le rendent utile pour l'automatisation de type agent.
- L'entrée multimodale, avec l'audio sur les modèles pour appareils, couvre plus que les tâches purement textuelles.
Inconvénients
- Les modèles 26B et 31B exigent un GPU capable et un vrai travail d'installation, donc ils ne s'utilisent pas en un branchement.
- Vous gérez vous-même le service, la quantification et les mises à jour, ce qui déplace la charge de maintenance sur vous.
- La longueur de contexte et le raisonnement maximal restent en retrait des modèles fermés Gemini de Google sur les benchmarks les plus durs.
- Sur les petits appareils, les modèles compacts échangent la précision contre la vitesse, donc les tâches complexes peuvent décevoir.
Questions fréquentes
C'est un modèle d'IA à poids ouverts pour le raisonnement, le code et les tâches d'agents que vous exécutez vous-même. Les gens s'en servent pour créer des assistants locaux, affiner sur des données privées et ajouter une compréhension multimodale à des apps sans dépendre d'une API cloud. Si vous voulez que vos données restent en place, c'est une réponse.
Contenus associés
Découvrez des outils, des compétences et des articles liés à Google Gemma 4.
Alternatives à Google Gemma 4
BinkBink
BinkBink · AutresBinkBink est une plateforme de jeux en ligne gratuite et un créateur de jeux par IA qui permet à n'importe qui de transformer une courte description textuelle en un jeu de navigateur jouable. Vous pouvez plonger dans des centaines de jeux créés par la communauté. Ou décrivez votre propre idée, jouez-y en quelques secondes, puis partagez-la avec vos amis. Vous voulez créer votre propre jeu ? Pas besoin de coder. Aucun moteur à installer, aucun téléchargement, aucune prise de tête.

Audiogen
Audiogen Inc. · AutresAudiogen est un générateur de musique par IA conçu par Audiogen Inc., une petite équipe de recherche qui a passé environ deux ans et demi à entraîner son propre modèle de musique générative et à bâtir une interface web autour. Au lieu d'une simple zone de texte, cet outil de musique par IA transforme la timeline en une Station de Travail Audio Générative (GAW), pensée pour les débutants, où l'inpainting, l'extension, le remix et l'édition de pistes fonctionnent davantage comme de la peinture sur une toile. Le produit est encore en bêta, l'accès passe donc par une liste d'attente ou une invitation. Les formules payantes ne sont pas encore publiées.
Aiml API
AIMLAPI OÜ · AutresAiml API est une API unifiée de modèles d'IA qui place plus de 1000 modèles d'OpenAI, Google, Anthropic et d'autres derrière un seul point d'accès et une seule facture. Vous écrivez du code contre un unique schéma compatible OpenAI, puis vous passez d'un modèle de chat, d'image, de vidéo ou d'audio à un autre en changeant une chaîne de modèle. Elle convient aux développeurs et aux petites équipes qui veulent un accès multimodèle sans jongler avec une douzaine de comptes de fournisseurs distincts, et elle supprime le casse-tête habituel de la facturation quand on teste plusieurs prestataires. Une seule clé couvre tout.
