LLM 0.32rc2 : Améliorations et nouvelles fonctionnalités dévoilées

Le brief IA que les pros lisent chaque soir
Les 7 actus IA du jour, décryptées en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
La dernière mise à jour de LLM, la version 0.32rc2, apporte des améliorations notables en termes de fonctionnalités et de corrections de bugs. Publiée le 30 juillet 2026 à 22h52, elle suit de près la version RC1 et se distingue par deux ajouts majeurs.
Tout d'abord, le modèle par défaut pour les utilisateurs qui n'ont pas spécifié leur propre modèle est désormais GPT-5.6 Luna. Ce changement remplace l'ancien modèle par défaut, GPT-4o mini. GPT-5.6 Luna est un modèle plus récent et performant, bien qu'il soit légèrement plus coûteux. Le coût est de 0,20 $ par million de tokens d'entrée et 1,20 $ par million de tokens de sortie, comparé à 0,15 $ et 0,60 $ respectivement pour le modèle 4o mini. Les utilisateurs ont néanmoins la possibilité de revenir à GPT-4o mini ou de choisir GPT-5 nano, un modèle encore plus économique avec des coûts de 0,05 $ par million de tokens d'entrée et 0,40 $ par million de tokens de sortie.
La mise à jour introduit également une nouvelle commande llm [openai](/dossier/openai) endpoint. Cette fonctionnalité permet d'exécuter des requêtes, des discussions et de lister des modèles sur des points de terminaison compatibles avec OpenAI, sans nécessiter de configuration préalable d'un modèle. Les appels effectués via cette commande ne sont pas enregistrés, offrant ainsi une flexibilité accrue pour les utilisateurs.
En plus de ces nouvelles fonctionnalités, la mise à jour corrige un problème de dépendance, améliorant ainsi la stabilité et la performance globale de l'application. Cette commande a été ajoutée pour pallier l'absence d'un outil CLI évident pour tester des requêtes contre des points de terminaison imitant les OpenAI Chat Completions. Les utilisateurs peuvent même exécuter des requêtes sans installer LLM, grâce à une ligne de commande uvx qui permet de tester des modèles locaux de LM Studio.
Brief IA — L'actualité IA en français
L'essentiel de l'actualité de l'intelligence artificielle, décrypté et expliqué chaque jour.