Brief IA : LLM 0.32rc2 : Améliorations et nouvelles fonctionnalités dévoilées

LLM 0.32rc2 : Améliorations et nouvelles fonctionnalités dévoilées

Brief IA
Tom Levy·2 min·2 vues

La version 0.32rc2 de LLM, publiée le 30 juillet 2026, introduit le modèle GPT-5.6 Luna comme nouveau modèle par défaut, remplaçant GPT-4o mini, avec un coût de 0,20 $ par million de tokens d'entrée. De plus, une nouvelle commande permet d'exécuter des requêtes sur des points de terminaison OpenAI sans configuration préalable, renforçant ainsi la flexibilité des utilisateurs.

En bref
1La version 0.32rc2 de LLM introduit le modèle GPT-5.6 Luna comme nouveau modèle par défaut, remplaçant GPT-4o mini.
2GPT-5.6 Luna offre des performances améliorées mais à un coût plus élevé de 0,20 $ par million de tokens d'entrée.
3Une nouvelle commande permet d'exécuter des requêtes sur des points de terminaison OpenAI sans configuration préalable.
💡Pourquoi c'est importantCes mises à jour renforcent la flexibilité et l'efficacité des utilisateurs dans la gestion et l'exécution de modèles de langage avancés.
Le brief IA que lisent les pros

Tu codes avec l’IA ?

Outils, agents et nouveautés dev IA décryptés, chaque soir en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
L'analyse en français

La dernière mise à jour de LLM, la version 0.32rc2, apporte des améliorations notables en termes de fonctionnalités et de corrections de bugs. Publiée le 30 juillet 2026 à 22h52, elle suit de près la version RC1 et se distingue par deux ajouts majeurs.

Tout d'abord, le modèle par défaut pour les utilisateurs qui n'ont pas spécifié leur propre modèle est désormais GPT-5.6 Luna. Ce changement remplace l'ancien modèle par défaut, GPT-4o mini. GPT-5.6 Luna est un modèle plus récent et performant, bien qu'il soit légèrement plus coûteux. Le coût est de 0,20 $ par million de tokens d'entrée et 1,20 $ par million de tokens de sortie, comparé à 0,15 $ et 0,60 $ respectivement pour le modèle 4o mini. Les utilisateurs ont néanmoins la possibilité de revenir à GPT-4o mini ou de choisir GPT-5 nano, un modèle encore plus économique avec des coûts de 0,05 $ par million de tokens d'entrée et 0,40 $ par million de tokens de sortie.

La mise à jour introduit également une nouvelle commande llm [openai](/dossier/openai) endpoint. Cette fonctionnalité permet d'exécuter des requêtes, des discussions et de lister des modèles sur des points de terminaison compatibles avec OpenAI, sans nécessiter de configuration préalable d'un modèle. Les appels effectués via cette commande ne sont pas enregistrés, offrant ainsi une flexibilité accrue pour les utilisateurs.

En plus de ces nouvelles fonctionnalités, la mise à jour corrige un problème de dépendance, améliorant ainsi la stabilité et la performance globale de l'application. Cette commande a été ajoutée pour pallier l'absence d'un outil CLI évident pour tester des requêtes contre des points de terminaison imitant les OpenAI Chat Completions. Les utilisateurs peuvent même exécuter des requêtes sans installer LLM, grâce à une ligne de commande uvx qui permet de tester des modèles locaux de LM Studio.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires