Brief IA : Claude Code et Claude Tag : Anthropic redéfinit l'ingénierie

Claude Code et Claude Tag : Anthropic redéfinit l'ingénierie

Brief IA
Tom Levy·10 min·10 vues

Claude Tag, l'intégration Slack d'Anthropic, génère 65 % des PRs d'ingénierie produit, tandis que Claude Code privilégie la révision automatique pour les changements mineurs. De plus, le prompt système de Claude Code a été réduit de 80 % pour améliorer les performances, transformant ainsi la collaboration et le développement logiciel au sein des équipes.

En bref
1Claude Tag, l'intégration Slack d'Anthropic, génère 65 % des PRs d'ingénierie produit.
2Anthropic privilégie la révision automatique pour les changements mineurs de Claude Code.
3Le prompt système de Claude Code a été réduit de 80 % pour améliorer les performances.
💡Pourquoi c'est importantCes innovations d'Anthropic transforment la manière dont les équipes collaborent et optimisent le développement logiciel.
Le brief IA que lisent les pros

Tu veux les meilleurs outils IA avant les autres ?

On teste et on décrypte les nouveaux outils IA chaque soir, en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
L'analyse en français

Une discussion au coin du feu avec Cat et Thariq de l'équipe Claude Code

Ce mois-ci, lors de la AI Engineer World’s Fair, un modérateur a eu l'opportunité de mener une discussion passionnante avec Cat Wu et Thariq Shihipar, membres éminents de l'équipe Claude Code d'Anthropic. Divers sujets ont été abordés, notamment Claude Code, Claude Tag, Fable, la sécurité des agents de codage, les évaluations de performance, ainsi que la conception et l'utilisation interne de ces outils par Anthropic.

La session complète est désormais disponible sur YouTube. Ce qui suit est une version éditée de la transcription, enrichie de liens supplémentaires et de commentaires en gras.

Notes clés

  • Claude Tag, la nouvelle intégration collaborative de Slack de Claude, représente désormais 65 % des PRs d'ingénierie produit pour l'équipe Claude Code.

  • Claude Code déploie d'abord des fonctionnalités aux employés d'Anthropic et ne lance que celles qui montrent une rétention des utilisateurs au sein de ce groupe.

  • Les changements critiques apportés à Claude Code sont toujours examinés manuellement, mais l'équipe s'appuie de plus en plus sur la révision automatique du code pour les "couches extérieures" du produit.

  • Ajouter des exemples à un prompt système n'est plus la meilleure pratique pour des modèles comme Fable 5 ou même Opus 4.8. Le prompt système de Claude Code a récemment été réduit de 80 %.

  • De même, des listes de "ne pas faire X et ne pas faire Y" peuvent réduire la qualité des résultats des derniers modèles.

  • Le terme utilisé chez Anthropic pour désigner l'auto-utilisation est "ant fooding".

  • Anthropic croit fermement en leur mode automatique, qu'ils considèrent comme une technologie habilitante pour Claude Tag.

  • Thariq conseille de compenser les effets indésirables des agents de codage en étant "plus ambitieux" dans le travail entrepris.

  • Fable est compétent pour éditer des vidéos, et Thariq l'a utilisé pour monter sa propre vidéo de lancement.

  • La culture de travail d'Anthropic (en interne) en public est essentielle à leur succès, comme le montre leur utilisation de Claude Tag dans leurs canaux Slack publics.

Comment le travail quotidien a-t-il changé au cours de l'année passée ?

Simon : Claude Code est sorti en février de l'année dernière — il a moins d'un an et demi, et c'était à l'origine juste un point sur le lancement de Claude Sonnet 3.7. Comment votre travail quotidien a-t-il changé au cours de l'année passée, maintenant que nous avons ces agents de codage qui travaillent réellement pour nous ?

Cat : Elle se souvient quand ils ont d'abord lancé Claude Code et Sonnet 3.7, il fallait lui donner une tâche et surveiller de près chaque petite chose qu'il essayait de faire. Elle lisait chaque invite de permission très attentivement. Elle disait souvent non — non, non, non, avez-vous vérifié ce fichier ? Avez-vous vérifié cet autre fichier ? Et maintenant, c'est incroyable avec chaque génération de modèle. Elle sent que l'équipe a eu l'occasion de prendre du recul et de déléguer beaucoup plus de l'implémentation banale à Claude. Cela leur a libéré beaucoup de temps pour penser à un travail plus créatif, comme : quelle est la bonne expérience à offrir aux utilisateurs, maintenant que Claude Code peut en implémenter beaucoup ? Et maintenant avec Fable, c'est un changement d'étape totalement différent. Ils voient pour beaucoup de leurs cas d'utilisation qu'il est possible de réaliser un grand nombre de fonctionnalités avec Fable maintenant.

Thariq : Il se souvient du premier message qu'il a reçu à propos de Claude Code. Un de ses meilleurs amis lui a dit : "Tu dois essayer Claude Code." C'était à peu près au moment où Opus 4 est sorti, et il l'a essayé et s'est dit : "Oh, mince. Je dois travailler chez Anthropic maintenant." Et c'était Opus 4 — un excellent modèle, mais il fallait lire des invites de permission. C'est un peu fou à quel point ils ont de l'amnésie, où il se dit, oh, le mode automatique a toujours été là, non ? Il ne se souvient même pas d'avoir appuyé sur oui et autoriser. Pour lui, la grande chose sur laquelle il essaie de se concentrer est qu'ils doivent produire un travail de meilleure qualité que jamais auparavant. Les résultats sont incroyablement de haute qualité. Il l'a utilisé pour monter des vidéos, et il se dit, d'accord, cela doit répondre aux exigences très strictes de leur équipe de marque dans quelques heures, sinon ils ne peuvent tout simplement pas le faire. C'est ainsi qu'il essaie de s'adapter avec Fable : le meilleur travail qu'ils aient jamais fait, plus rapidement que jamais.

Quelle partie de l'ingénierie logicielle conventionnelle ne tient plus ?

Simon : Quelle est une partie de l'ingénierie logicielle conventionnelle qui était vraie il y a un an et que vous ne pensez plus valable dans ce nouveau monde ?

Cat : Un des plus grands changements constatés dans les compétences en ingénierie : il y a deux ans, il était assez typique pour un chef de produit d'aller parler à un tas de clients, de s'aligner pendant six mois avec des équipes interfonctionnelles sur un PRD, et d'écrire une spécification détaillée sur exactement comment ils allaient implémenter cela avant que la première ligne de code ne soit écrite. Maintenant, les choses sont complètement inversées. Pour beaucoup d'ingénieurs, l'encouragement qu'elle donnerait aux gens dans la salle est de développer davantage leur sens des affaires et leur sens du produit sur ce qu'ils devraient construire, car le délai entre avoir une idée et la construire est tellement plus court — il est passé de six à douze mois à peut-être même une semaine. Cela signifie qu'ils doivent tous avoir un meilleur goût sur ce qui vaut la peine d'être construit, ce qui influencera réellement les entreprises sur lesquelles ils travaillent. Donc, il y a une augmentation de la valeur du goût produit et du sens des affaires, et un peu moins sur l'exécution dans la plupart des domaines de produits. Bien sûr, pour l'infrastructure, il y a toujours une très forte emphase sur le fait de s'assurer que tous les détails sont corrects.

Thariq : Pour lui, c'est que les réécritures sont désormais bonnes.

Simon : La pire chose que vous puissiez faire est maintenant en fait acceptable !

Thariq : Exactement. Tout le discours sur le "Mythical Man-Month" — ne jamais réécrire — il est maintenant pour la réécriture. Si vous avez une bonne suite de tests — et il pense que la réécriture vous oblige à vous assurer que vous avez une bonne suite de tests — mais il pense que ce que les gens sous-estiment, c'est qu'une base de code est une spécification, et peut-être que c'est la seule copie de la spécification que vous avez, car personne ne connaît chaque partie de la base de code. Vous pouvez prendre cela comme un artefact et le distiller ou créer d'autres versions. Ils ont réécrit Bun en Rust et cela fonctionne très bien — c'est en ligne pour lui en ce moment.

Simon : Vous ne déployez pas encore Claude Code sur Bun-in-Rust, n'est-ce pas ?

Thariq : En interne, ils l'ont fait.

(En fait, il semble qu'Anthropic a commencé à déployer Claude Code sur Bun-in-Rust pour tout le monde le 17 juin.)

Que font les non-ingénieurs avec Claude Tag ?

Simon : Le autre grand lancement récemment était Claude Tag — cela fait quoi, une semaine maintenant, au moins pour le reste d'entre nous. Il est compris qu'il est beaucoup utilisé chez Anthropic par des non-ingénieurs. Que font les non-ingénieurs avec Claude Tag ?

Cat : Claude Tag est un Claude qui vit dans les outils de collaboration de votre équipe. Ils l'ont lancé la semaine dernière dans Slack. La différence avec Claude Tag, c'est qu'il est multijoueur par défaut. Une fois que vous ajoutez Claude Tag à un canal Slack, vous pouvez intervenir, vos coéquipiers peuvent intervenir, et vous pouvez collaborer ensemble sur la PR. L'autre grande différence est qu'il est proactif plutôt que réactif. Vous pouvez dire à Claude Tag : "Hé, surveille chaque rapport de bogue dans ce canal, mets en place une PR pour le corriger, et tague l'ingénieur qui a touché cette partie de la base de code," et il le fera pour toute la durée de vie du canal sans que vous ayez à le taguer manuellement. Et le troisième grand changement est qu'ils ont ajouté une mémoire d'équipe à cela. Si vous dites à Claude Tag vos préférences dans le canal, il s'en souviendra pour chaque message futur. Si vous voulez toujours qu'il débogue les pannes mais que vous ne voulez pas qu'il débogue les avertissements, dites-le simplement en langage naturel dans le canal et il s'en souviendra pour vous et tous les autres membres de votre équipe.

En interne, ils considèrent Claude Tag comme l'évolution de Claude Code. Ils voient cela comme un grand changement dans leur manière de travailler en interne. Claude Tag représente actuellement 65 % de leurs PRs d'ingénierie produit.

Simon : Pour l'ensemble d'Anthropic, ou juste pour Claude Code ?

Cat : Cela concerne uniquement leur équipe d'ingénierie produit — leur version interne de Claude Tag représente 65 % de leurs PRs produit en ce moment. Et c'est un changement énorme ; c'est plus de 50 % de leurs PRs. La manière dont ils voient les gens diviser le travail entre Claude Code et Claude Tag est la suivante : Claude Code est toujours le meilleur endroit pour vos tâches les plus complexes, lorsque vous itérez de manière interactive avec l'agent. Mais Claude Tag est excellent pour travailler de manière proactive en votre nom, donc vous n'avez plus besoin de lancer manuellement Claude Code pour tous les rapports de bogues qui surgissent pour les fonctionnalités sur lesquelles vous travaillez.

Thariq : Et pour les cas non liés au codage : par exemple, avant cette discussion, ils ont demandé à Claude Tag : "Hé, quand Fable sera-t-il lancé ?" Ils voulaient s'assurer de le coordonner avec l'annonce. Claude Tag chercherait dans leur Slack et verrait qui a dit quoi. En tant que moteur de recherche pour votre entreprise, c'est vraiment précieux. Il a tout le contexte pour votre produit, donc vous pouvez lui poser des questions liées aux métriques — souvent lorsque vous prenez des décisions, vous voulez qu'elles soient éclairées par ce que disent les métriques, donc vous le connectez à votre magasin d'événements. Il a vu leur équipe marketing faire des choses comme : "Hé, parle-moi de cette fonctionnalité." Ils ne sont pas programmeurs, mais Claude est un programmeur — il peut cloner la base de code et dire : "Voici la fonctionnalité, voici à quoi cela ressemble, voici un enregistrement de moi utilisant la fonctionnalité." Cela permet une large variété de choses, et ils pensent qu'ils sont encore au début de la découverte de cela.

Claude Tag comme couche collaborative d'équipe

Simon : L'un des problèmes rencontrés avec les agents de codage est qu'il est compris comment les utiliser en tant qu'individu, mais il n'est pas vraiment clair sur la manière de les utiliser dans un environnement d'équipe. Il semble que Claude Tag soit leur réponse actuelle à cette couche collaborative d'équipe pour ces outils.

Cat : Exactement. Et un grand pourcentage de leurs sessions sont en fait multijoueurs en ce moment. Peut-être qu'elle dit : "Hé, je pense que nous devrions implémenter cette nouvelle fonctionnalité dans Cowork," et elle va taguer Claude Tag pour faire un premier passage. Ensuite, elle dira à Claude Tag : "Partage un enregistrement de ta mise en œuvre finale," et elle taguera le design pour qu'il jette un œil. Ils vont l'ajuster, puis le passer à l'ingénierie pour le finaliser et le déployer.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires