Brief IA

IBM publie Granite 4.2 sous Apache 2.0 avec fonctions agentiques

🔬 Research·Tom Levy·

IBM publie Granite 4.2 sous Apache 2.0 avec fonctions agentiques

IBM publie Granite 4.2 sous Apache 2.0 avec fonctions agentiques
Key Takeaways
1IBM publie Granite 4.2 en trois tailles sous licence Apache 2.0
2Granite Speech 5.0 Turbo CTC compte 470 millions de paramètres et revendique une vitesse doublée
3Le modèle Granite 4.2 30B domine les benchmarks internes sur les tâches agentiques
💡Why it mattersCes modèles ouverts intègrent des capacités avancées d'agents et sont proposés sur plusieurs plateformes, élargissant l'accès à des outils performants pour la communauté IA.
Le brief IA que lisent les pros

Le brief IA que les pros lisent chaque soir

Les 7 actus IA du jour, décryptées en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
Full Analysis

IBM diffuse en licence Apache 2.0 sa nouvelle génération Granite 4.2, déclinée jusqu’à 30B de paramètres, et la série Granite Speech 5.0 Turbo CTC. L’entreprise met en avant des capacités agentiques, une fenêtre de contexte étendue et des gains de vitesse en reconnaissance vocale, tandis que ses benchmarks internes indiquent un avantage du modèle 30B sur des tâches d’outillage.

Distribution Apache 2.0 et performances annoncées

Tous les modèles Granite 4.2 et Granite Speech 5.0 Turbo CTC sont proposés sous licence Apache 2.0 et disponibles sur Hugging Face, Ollama, GitHub et d'autres plateformes. Granite Speech 5.0 Turbo CTC compte 470 millions de paramètres. IBM affirme que ces modèles de reconnaissance vocale sont deux fois plus rapides que les précédents leaders du classement Open ASR Leaderboard et qu'ils peuvent transcrire trois heures d'audio en une seconde. Sur des benchmarks internes portant sur des tâches agentiques et l'utilisation d'outils, le modèle Granite 4.2 30B obtient les meilleurs résultats dans les trois tests.

Tailles, entraînement et gestion du contexte

Granite 4.2 est disponible en trois tailles : 3 milliards, 8 milliards et 30 milliards de paramètres. IBM indique que l'entraînement de ces modèles a été réalisé depuis le début sur près de 15 trillions de tokens. Ils sont capables de traiter des contextes pouvant atteindre 512 000 tokens. Les modèles disposent de modes « pensée » et « non-pensée » permettant d'adapter l'utilisation des ressources à la nature de la tâche, et un mode « à faible effort » doit être proposé pour les requêtes simples.

Apprentissage agentique et compatibilité outils

Les variantes Granite 4.2 8B et 30B bénéficient d'un entraînement « agentic RL » qui leur permet d'apprendre à utiliser des outils, à écrire et exécuter du code, ainsi qu'à effectuer des recherches web dans des environnements de bac à sable. L'ensemble des modèles Granite 4.2 offre la compatibilité avec l'appel d'outils au format OpenAI et peut être utilisé avec les serveurs d'inférence vLLM ou SGLang.

Brief IA — L'actualité IA en français

L'essentiel de l'actualité de l'intelligence artificielle, décrypté et expliqué chaque jour.