Google dévoile Gemma 4, son nouveau modèle IA open source

Web

Google dévoile Gemma 4, son nouveau modèle IA open source

Gemma 4, c’est le nom de la nouvelle famille de modèles IA dévoilée par Google. Elle présente la particularité d’être déclinée en quatre tailles distinctes, et surtout d’être publiée avec la très permissive licence Apache 2.0.

Gemma 4 : quatre modèles, quatre tailles

Pour cette nouvelle itération des modèles Gemma, Google DeepMind a choisi de décliner la famille Gemma 4 en plusieurs modèles de différentes tailles. L’objectif étant de s’adapter à du matériel différent, que vous cherchiez à faire tourner une IA sur votre smartphone ou sur un gros serveur.

Ce qui donne les quatre modèles suivants :

  • Gemma 4 E2B et E4B : ces deux modèles sont taillés pour l’Edge computing. L’E2B cible les appareils mobiles, tandis que l’E4B offre une capacité de traitement supérieure tout en restant optimisé pour les terminaux.
  • Gemma 4 26B : pensé pour un déploiement sur serveur, ce modèle de 26 milliards de paramètres s’appuie sur une architecture de type Mixture of Experts (MoE).
  • Gemma 4 31B : un modèle encore plus dense de 31 milliards de paramètres.

“Nos modèles de plus grande taille offrent des performances de pointe pour leur catégorie : le modèle 31B occupe actuellement la troisième place mondiale parmi les modèles ouverts dans le classement Arena AI Text, référence du secteur, tandis que le modèle 26B se classe en sixième position.”, précise Google. Il est également précisé que ces modèles surclassent des modèles 20 fois plus volumineux.

Les fenêtres de contexte annoncées par Google ont de quoi séduire également :

  • 128K tokens pour les versions Edge
  • Jusqu’à 256K tokens pour les versions de 26 et 31 milliards de paramètres.

Toute la famille Gemma 4 bénéficie d’un support multimodal natif couvrant la vidéo et l’image. Cela signifie qu’il est possible de s’appuyer sur ces modèles pour de la reconnaissance de caractères (OCR) ou l’analyse de graphiques. Petit bonus exclusif pour l’Edge (E2B et E4B) : ces versions ont une prise en charge native de l’audio pour la reconnaissance vocale !

Il y a aussi un véritable intérêt vis-à-vis des agents autonomes : “La prise en charge native de l’appel de fonctions, de la sortie JSON structurée et des instructions système natives vous permet de créer des agents autonomes capables d’interagir avec divers outils et API, et d’exécuter des flux de travail de manière fiable.”, précise Google.

Changement de licence Open Source avec Apache 2.0

Au-delà des évolutions techniques, l’autre information importante, c’est le changement de licence opéré par Google. Fini la licence restrictive des versions précédentes ! Google déploie Gemma 4 sous licence Apache 2.0, qui est l’une des licences les plus permissives dans l’univers de l’open source. Autrement dit, vous pouvez intégrer les modèles Gemma 4 dans vos applications sans craindre de ne pas respecter la licence d’utilisation.

Ces quatre modèles sont d’ores et déjà disponibles au téléchargement pour ceux qui voudraient lancer de premiers tests ! Je vous rappelle que vous pouvez tester votre configuration sur le site web CanIRun.ai. La famille Gemma 4 a d’ailleurs été intégrée.

Source

SOURCE