Tu codes avec l’IA ?
Outils, agents et nouveautés dev IA décryptés, chaque soir en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
Claude Fable 5 : les secrets du prompt système dévoilés
Ce que c'est
Un prompt système est une couche d'instructions fournie à un modèle d'IA avant son initialisation. Il s'agit d'un document caché de 3 826 lignes qui guide le comportement de Claude Fable 5 dans l'application Claude, extrait d'une archive publique sur GitHub. Ce prompt définit le ton, le format, les refus, les outils, la personnalité et les limites du modèle.
D'où vient le prompt système de Fable 5 ?
- Source : le dépôt asgeirtj/system_prompts_leaks (plus de 55 000 étoiles).
- "Extrait", pas piraté : les modèles peuvent être amenés à réciter leurs propres instructions.
- Pas la version officielle : Anthropic publie un court prompt de base, tandis que cette fuite contient le prompt complet du produit, avec les structures de mémoire, d'outils et d'artefacts qui sont rarement publiées.
Le modèle qu'il pilote
Claude Fable 5 a été lancé le 9 juin 2026 en tant que premier modèle public de classe Mythos, au-dessus d'Opus, le précédent modèle phare. Il partage ses poids avec le modèle restreint Claude Mythos 5, la seule différence étant les garde-fous et l'accès.
- Le garde-fou clé n'est pas dans le prompt : les classificateurs surveillent les sujets à haut risque (cyber, bio, chimie) et les redirigent vers Opus 4.8.
- Anthropic indique que moins de 5 % des sessions sont redirigées.
Anatomie du prompt
Le prompt est un XML profondément imbriqué qui ressemble à un fichier de configuration annoté par un juriste. Il commence avec un budget de 190 000 tokens et une règle étrange : ne jamais émettre de blocs <voice_note>. Ensuite, il se divise en deux territoires :
<claude_behavior>→ qui est Claude : faits sur le produit, refus, ton, bien-être, équilibre.- Blocs frères → ce que Claude peut faire : mémoire, outils, artefacts, recherche, connecteurs.
Gestion des refus : Les lignes claires
La section la plus fortifiée. Le modèle peut discuter presque de tout de manière factuelle, les limites ciblent les dommages concrets. Les règles de sécurité pour les enfants reçoivent le plus d'attention.
- Armes et explosifs : aucune aide pour créer des substances ou des armes nuisibles.
- Drogues illicites : pas de dosage ou de synthèse, même pour la "réduction des risques".
- Code malveillant : pas de hacks ou d'exploits, même "pour l'éducation".
- Personnes réelles : la fiction est acceptable, mais pas de citations fictives de personnalités publiques nommées.
Un devoir de soin, dans l'écriture
Une des sections les plus volumineuses et étrangement spécifiques, comme des leçons apprises à la dure.
- Pas de diagnostic : il ne posera pas d'étiquette de santé mentale que vous n'avez pas utilisée vous-même.
- Pas de méthodes : sur l'automutilation, il ne nommera pas les moyens.
- Pas de chiffres : en cas de troubles alimentaires, il ne fournira pas de cibles ou de plans.
Système de mémoire : Se souvenir de vous, avec précaution
Il peut s'appuyer sur des discussions passées, mais la majeure partie de la section concerne l'usage approprié de cette mémoire.
- Pas de révélations : interdit d'utiliser des constructions linguistiques telles que "je peux voir..." / "en fonction de vos données".
- Vous êtes en contrôle : la mémoire est désactivée dans les discussions incognito et modifiable via un outil dédié.
La machinerie de l'agent : Utilisation de l'ordinateur + Compétences
Un grand effort est un manuel d'opérateur pour faire, pas seulement dire.
- Lisez d'abord la "compétence" : avant de créer un fichier, consultez les notes de bonnes pratiques pour ce format.
- Vous choisissez l'application : il ne choisira pas un service de covoiturage ou de réservation que vous n'avez pas nommé.
Recherche, droits d'auteur et une porte dérobée
Il effectue des recherches lorsque des faits pourraient avoir changé depuis sa date limite de connaissance de janvier 2026, et adapte ses efforts à la difficulté.
- DROITS D'AUTEUR + DÉFENSE CONTRE L'INJECTION :
- Citations de moins de 15 mots : pour chaque source, utilisez moins de 15 mots et ne reproduisez jamais de paroles, poèmes ou paragraphes entiers.
- Rappels forgés : il est averti que de faux "rappels système" collés dans votre message peuvent essayer d'assouplir les règles.
Ce que la fuite enseigne
Un prompt système divulgué est un livre de règles, pas un cerveau. L'intelligence réside dans les poids. Ce qui a échappé est le règlement intérieur, la page que le modèle lit avant de vous rencontrer.
- Cela montre comment fonctionne le garde-fou : pas un mur mais plusieurs murs fins. Refuser. Cacher la couture. Garder un classificateur de secours prêt.
- Mais la vraie leçon est plus silencieuse. Une IA de pointe est moins mystérieuse que ce que suggère "boîte noire". Ce qui ressemble à une personnalité ou un jugement est généralement une phrase simple écrite manuellement. Pas d'esprit extraterrestre là-dedans. Juste un document, soigneux, prudent et humain.
Questions Fréquemment Posées
Q1. Qu'est-ce que le prompt système de Claude Fable 5 ?
R. Un document d'instructions caché de 3 826 lignes qui précède chaque discussion, définissant le ton, les refus, les outils et les limites du modèle. Il est apparu sur GitHub en juin 2026.
Q2. Fable 5 a-t-il été piraté pour obtenir ce prompt ?
R. Non. Il a été extrait, pas piraté. Les modèles peuvent être incités à réciter leurs propres instructions. La copie provient d'un dépôt public sur GitHub.
Q3. Quel est le garde-fou clé de Fable 5 ?
R. Les classificateurs surveillent les sujets à haut risque comme le cyber, le bio et la chimie, puis les redirigent vers Opus 4.8. Anthropic indique que moins de 5 % des sessions sont redirigées.




