Brief IA : Claude Code et Claude Tag : Anthropic redéfinit l'ingénierie

Claude Code et Claude Tag : Anthropic redéfinit l'ingénierie

Brief IA
Tom Levy·10 min·2 vues

Claude Tag, l'intégration Slack d'Anthropic, génère 65 % des PRs d'ingénierie produit, tandis que Claude Code privilégie la révision automatique pour les changements mineurs. De plus, le prompt système de Claude Code a été réduit de 80 % pour améliorer les performances, transformant ainsi la collaboration et le développement logiciel au sein des équipes.

En bref
1Claude Tag, l'intégration Slack d'Anthropic, génère 65 % des PRs d'ingénierie produit.
2Anthropic privilégie la révision automatique pour les changements mineurs de Claude Code.
3Le prompt système de Claude Code a été réduit de 80 % pour améliorer les performances.
💡Pourquoi c'est importantCes innovations d'Anthropic transforment la manière dont les équipes collaborent et optimisent le développement logiciel.
Le brief IA que lisent les pros

Tu veux les meilleurs outils IA avant les autres ?

On teste et on décrypte les nouveaux outils IA chaque soir, en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
L'analyse en français

Une discussion au coin du feu avec Cat et Thariq de l'équipe Claude Code

Ce mois-ci, lors de la AI Engineer World’s Fair, j'ai eu l'opportunité de modérer une discussion passionnante avec Cat Wu et Thariq Shihipar, membres éminents de l'équipe Claude Code d'Anthropic. Nous avons abordé divers sujets, notamment Claude Code, Claude Tag, Fable, la sécurité des agents de codage, les évaluations de performance, ainsi que la conception et l'utilisation interne de ces outils par Anthropic.

La session complète est désormais disponible sur YouTube. Ce qui suit est une version éditée de la transcription, enrichie de liens supplémentaires et de mes propres commentaires en gras.

Notes clés

  • Claude Tag, la nouvelle intégration collaborative de Slack de Claude, représente désormais 65 % des PRs d'ingénierie produit pour l'équipe Claude Code.

  • Claude Code déploie d'abord des fonctionnalités aux employés d'Anthropic et ne lance que celles qui montrent une rétention des utilisateurs au sein de ce groupe.

  • Les changements critiques apportés à Claude Code sont toujours examinés manuellement, mais l'équipe s'appuie de plus en plus sur la révision automatique du code pour les "couches extérieures" du produit.

  • Ajouter des exemples à un prompt système n'est plus la meilleure pratique pour des modèles comme Fable 5 ou même Opus 4.8. Le prompt système de Claude Code a récemment été réduit de 80 %.

  • De même, des listes de "ne pas faire X et ne pas faire Y" peuvent réduire la qualité des résultats des derniers modèles.

  • Le terme utilisé chez Anthropic pour désigner l'auto-utilisation est "ant fooding".

  • Anthropic croit fermement en leur mode automatique, qu'ils considèrent comme une technologie habilitante pour Claude Tag.

  • Thariq conseille de compenser les effets indésirables des agents de codage en étant "plus ambitieux" dans le travail que vous entreprenez.

  • Fable est compétent pour éditer des vidéos, et Thariq l'a utilisé pour monter sa propre vidéo de lancement.

  • La culture de travail d'Anthropic (en interne) en public est essentielle à leur succès, comme le montre leur utilisation de Claude Tag dans leurs canaux Slack publics.

Comment votre travail quotidien a-t-il changé au cours de l'année passée ?

Simon : Claude Code est sorti en février de l'année dernière — il a moins d'un an et demi, et c'était à l'origine juste un point sur le lancement de Claude Sonnet 3.7. Comment votre travail quotidien a-t-il changé au cours de l'année passée, maintenant que nous avons ces agents de codage qui travaillent réellement pour nous ?

Cat : Je me souviens quand nous avons d'abord lancé Claude Code et Sonnet 3.7, vous deviez lui donner une tâche et surveiller de près chaque petite chose qu'il essayait de faire. Je lisais chaque invite de permission très attentivement. Je disais souvent non — non, non, non, avez-vous vérifié ce fichier ? Avez-vous vérifié cet autre fichier ? Et maintenant, c'est incroyable avec chaque génération de modèle. Je sens que nous avons tous eu l'occasion de prendre du recul et de déléguer beaucoup plus de l'implémentation banale à Claude. Cela nous a libérés beaucoup de temps pour penser à un travail plus créatif, comme : quelle est la bonne expérience que nous devrions offrir à nos utilisateurs, maintenant que nous savons que Claude Code peut en implémenter beaucoup ? Et maintenant avec Fable, c'est un changement d'étape totalement différent. Nous voyons pour beaucoup de nos cas d'utilisation que vous pouvez réellement réaliser un grand nombre de fonctionnalités avec Fable maintenant.

Thariq : Je me souviens du premier message que j'ai reçu à propos de Claude Code. Un de mes meilleurs amis m'a dit : "Tu dois essayer Claude Code." C'était à peu près au moment où Opus 4 est sorti, et je l'ai essayé et je me suis dit : "Oh, mince. Je dois travailler chez Anthropic maintenant." Et c'était Opus 4 — un excellent modèle, mais vous lisiez des invites de permission. C'est un peu fou à quel point nous avons de l'amnésie, où je me dis, oh, le mode automatique a toujours été là, non ? Je ne me souviens même pas d'avoir appuyé sur oui et autoriser. Pour moi, la grande chose sur laquelle j'essaie de me concentrer est que nous devons produire un travail de meilleure qualité que jamais auparavant. Les résultats sont incroyablement de haute qualité. Je l'ai utilisé pour monter des vidéos, et je me dis, d'accord, cela doit répondre aux exigences très strictes de notre équipe de marque dans quelques heures, sinon nous ne pouvons tout simplement pas le faire. C'est ainsi que j'essaie de m'adapter avec Fable : le meilleur travail que nous ayons jamais fait, plus rapidement que jamais.

Quelle partie de l'ingénierie logicielle conventionnelle ne tient plus ?

Simon : Quelle est une partie de l'ingénierie logicielle conventionnelle qui était vraie il y a un an et que vous ne pensez plus valable dans ce nouveau monde ?

Cat : Un des plus grands changements que nous constatons dans les compétences en ingénierie : il y a deux ans, il était assez typique pour un chef de produit d'aller parler à un tas de clients, de s'aligner pendant six mois avec des équipes interfonctionnelles sur un PRD, et d'écrire une spécification détaillée sur exactement comment nous allons implémenter cela avant que la première ligne de code ne soit écrite. Maintenant, les choses sont complètement inversées. Pour beaucoup d'ingénieurs, l'encouragement que je donnerais aux gens dans la salle est de développer davantage votre sens des affaires et votre sens du produit sur ce que nous devrions construire, car le délai entre avoir une idée et la construire est tellement plus court — il est passé de six à douze mois à peut-être même une semaine. Cela signifie que nous devons tous avoir un meilleur goût sur ce qui vaut la peine d'être construit, ce qui influencera réellement les entreprises sur lesquelles nous travaillons. Donc, il y a une augmentation de la valeur du goût produit et du sens des affaires, et un peu moins sur l'exécution dans la plupart des domaines de produits. Bien sûr, pour l'infrastructure, il y a toujours une très forte emphase sur le fait de s'assurer que tous les détails sont corrects.

Thariq : Pour moi, c'est que les réécritures sont désormais bonnes.

Simon : La pire chose que vous puissiez faire est maintenant en fait acceptable !

Thariq : Exactement. Tout le discours sur le "Mythical Man-Month" — ne jamais réécrire — je suis maintenant pour la réécriture. Si vous avez une bonne suite de tests — et je pense que la réécriture vous oblige à vous assurer que vous avez une bonne suite de tests — mais je pense que ce que les gens sous-estiment, c'est qu'une base de code est une spécification, et peut-être que c'est la seule copie de la spécification que vous avez, car personne ne connaît chaque partie de la base de code. Vous pouvez prendre cela comme un artefact et le distiller ou créer d'autres versions. Nous avons réécrit Bun en Rust et cela fonctionne très bien — c'est en ligne pour moi en ce moment.

Simon : Vous ne déployez pas encore Claude Code sur Bun-in-Rust, n'est-ce pas ?

Thariq : En interne, nous l'avons fait.

(En fait, il semble qu'Anthropic a commencé à déployer Claude Code sur Bun-in-Rust pour tout le monde le 17 juin.)

Que font les non-ingénieurs avec Claude Tag ?

Simon : Le autre grand lancement récemment était Claude Tag — cela fait quoi, une semaine maintenant, au moins pour le reste d'entre nous. Je comprends qu'il est beaucoup utilisé chez Anthropic par des non-ingénieurs. Que font les non-ingénieurs avec Claude Tag ?

Cat : Claude Tag est un Claude qui vit dans les outils de collaboration de votre équipe. Nous l'avons lancé la semaine dernière dans Slack. La différence avec Claude Tag, c'est qu'il est multijoueur par défaut. Une fois que vous ajoutez Claude Tag à un canal Slack, vous pouvez intervenir, vos coéquipiers peuvent intervenir, et vous pouvez collaborer ensemble sur la PR. L'autre grande différence est qu'il est proactif plutôt que réactif. Vous pouvez dire à Claude Tag : "Hé, surveille chaque rapport de bogue dans ce canal, mets en place une PR pour le corriger, et tague l'ingénieur qui a touché cette partie de la base de code," et il le fera pour toute la durée de vie du canal sans que vous ayez à le taguer manuellement. Et le troisième grand changement est que nous avons ajouté une mémoire d'équipe à cela. Si vous dites à Claude Tag vos préférences dans le canal, il s'en souviendra pour chaque message futur. Si vous voulez toujours qu'il débogue les pannes mais que vous ne voulez pas qu'il débogue les avertissements, dites-le simplement en langage naturel dans le canal et il s'en souviendra pour vous et tous les autres membres de votre équipe.

En interne, nous considérons Claude Tag comme l'évolution de Claude Code. Nous voyons cela comme un grand changement dans notre manière de travailler en interne. Claude Tag représente actuellement 65 % de nos PRs d'ingénierie produit.

Simon : Pour l'ensemble d'Anthropic, ou juste pour Claude Code ?

Cat : Cela concerne uniquement notre équipe d'ingénierie produit — notre version interne de Claude Tag représente 65 % de nos PRs produit en ce moment. Et c'est un changement énorme ; c'est plus de 50 % de nos PRs. La manière dont nous voyons les gens diviser le travail entre Claude Code et Claude Tag est la suivante : Claude Code est toujours le meilleur endroit pour vos tâches les plus complexes, lorsque vous itérez de manière interactive avec l'agent. Mais Claude Tag est excellent pour travailler de manière proactive en votre nom, donc vous n'avez plus besoin de lancer manuellement Claude Code pour tous les rapports de bogues qui surgissent pour les fonctionnalités sur lesquelles vous travaillez.

Thariq : Et pour les cas non liés au codage : par exemple, avant cette discussion, nous avons demandé à Claude Tag : "Hé, quand Fable sera-t-il lancé ?" Nous voulions nous assurer de le coordonner avec l'annonce. Claude Tag chercherait dans notre Slack et verrait qui a dit quoi. En tant que moteur de recherche pour votre entreprise, c'est vraiment précieux. Il a tout le contexte pour votre produit, donc vous pouvez lui poser des questions liées aux métriques — souvent lorsque vous prenez des décisions, vous voulez qu'elles soient éclairées par ce que disent les métriques, donc vous le connectez à votre magasin d'événements. J'ai vu notre équipe marketing faire des choses comme : "Hé, parle-moi de cette fonctionnalité." Ils ne sont pas programmeurs, mais Claude est un programmeur — il peut cloner la base de code et dire : "Voici la fonctionnalité, voici à quoi cela ressemble, voici un enregistrement de moi utilisant la fonctionnalité." Cela permet une large variété de choses, et je pense que nous sommes encore au début de la découverte de cela.

Claude Tag comme couche collaborative d'équipe

Simon : L'un des problèmes que j'ai rencontrés avec les agents de codage est que je comprends comment les utiliser en tant qu'individu, mais je ne suis pas vraiment clair sur la manière de les utiliser dans un environnement d'équipe. Il semble que Claude Tag soit votre réponse actuelle à cette couche collaborative d'équipe pour ces outils.

Cat : Exactement. Et un grand pourcentage de nos sessions sont en fait multijoueurs en ce moment. Peut-être que je dis : "Hé, je pense que nous devrions implémenter cette nouvelle fonctionnalité dans Cowork," et je vais taguer Claude Tag pour faire un premier passage. Ensuite, je dirai à Claude Tag : "Partage un enregistrement de ta mise en œuvre finale," et je taguerai le design pour qu'il jette un œil. Ils vont l'ajuster, puis le passer à l'ingénierie pour le finaliser et le déployer.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires