J’aide les équipes à tirer vraiment parti de leurs agents de code
Je suis Theo Martin, ancien Tech Lead de l’équipe Core AI chez Akeneo. J’interviens dans les équipes qui utilisent un agent de code, un outil comme Claude Code (celui d’Anthropic), Codex ou Cursor qui lit, modifie et lance le code d’un projet à la demande. Des développeurs, et aussi des product managers et des designers, pour qui l’agent devient pertinent à son tour.
Trois situations où l’on m’appelle
L’agent échoue
Il se trompe sur vos tickets et vous ne savez pas pourquoi. Je regarde sur vos propres tâches ce qu’il réussit, ce qu’il rate et ce qui fait la différence : un contexte qui n’est écrit nulle part, un moyen de vérifier qui manque, une consigne qui le bride. Deux tâches proches pour nous peuvent être loin pour lui, et la carte de ce qu’il sait faire se dessine sur vos tickets, pas sur un exemple.
L’adoption ne prend pas
Vous êtes lead ou CTO, les outils sont payés et distribués, et vos développeurs s’en servent peu ou pas. C’est presque un diagnostic de comportement : un premier essai raté qui a convaincu que ça ne marche pas, un premier succès qui a convaincu qu’on avait tout compris, une identité de développeur, un outil longtemps interdit. Le mélange change d’une équipe à l’autre, je cherche d’abord lequel est le vôtre, puis je convaincs vos développeurs sur leur propre code.
Apprendre à mieux s’en servir
Vous l’utilisez déjà et vous voulez aller plus loin. On part d’un modèle mental de ce qu’est un LLM, de ce qu’il sait et de ce qu’on ne lui a pas écrit (il n’était pas au stand-up), pour le brancher à Jira, Confluence ou Slack et le laisser chercher son contexte plutôt que le lui copier-coller. Ça sert aux développeurs, et autant aux PM et aux designers.
Fin août 2026 j’ai lu 269 repos publics fichier par fichier pour savoir qui possède les fichiers qui pilotent leurs agents. PostHog ne passe pas par CODEOWNERS (le fichier GitHub qui dit qui doit relire quoi) : la propriété y est déclarée dans un fichier owners.yaml qui ne bloque aucun merge. Elastic, sur Kibana, fait l’inverse et met ses tech leads propriétaires de /AGENTS.md et de /.claude/, donc leur review est demandée à chaque changement.
Ce que je fais
Neuf ans de ML et de systèmes LLM en production, dont trois ans et demi chez Amazon sur le pricing européen. Ensuite Tech Lead de l’équipe Core AI d’Akeneo, un SaaS B2B, où la plateforme d’inférence que j’ai architecturée servait toutes les équipes produit et, derrière elles, des centaines de retailers enterprise et des dizaines de millions d’attributs produit générés chaque mois.
C’est là que j’ai poussé les agents de code dans mon équipe dès leur sortie, donné des cours à plusieurs équipes, et convaincu des gens qui ont ensuite convaincu les leurs à leur tour. J’y ai aussi fait la bascule de l’outil vers le harness (l’ensemble des consignes, outils et vérifications qu’on met autour du modèle), avec des CLAUDE.md, les fichiers d’instructions que l’agent lit, tenus dans le repo et revus comme du code. Je m’en sers tous les jours, à raison de centaines de milliards de tokens.
J’ai travaillé dans des repos de grands comptes, dont un groupe du CAC 40 : de vrais repos d’entreprise, pas des démos.
Le NDA fait que je ne parle ni du client, ni de son secteur, ni de sa stack. La méthode se raconte entièrement, les artefacts non, et je préfère le dire avant l’appel plutôt que pendant.
Tester plutôt que croire
Un exemple de ce que j’appelle tester. Un fichier .env contient les mots de passe et les clés d’accès d’un projet, on ne veut pas que l’agent le lise, et Claude Code permet d’écrire une règle qui interdit sa lecture. Au 5 octobre 2026, cette règle couvre l’outil de lecture de l’agent, mais aussi cat, head, tail, sed et les redirections, depuis la version 2.1.257 du 1er septembre. Elle ne couvre pas un grep -r lancé depuis le dossier, ni un script qui ouvre le fichier lui-même. Pour une vraie garantie il faut le sandbox, une enceinte que le système d’exploitation impose aux commandes de l’agent, quoi que dise le texte de la commande.
Je raconte l’état plutôt que la règle, parce qu’il aura bougé quand vous lirez ceci. Une règle de sécurité posée sur le texte d’une commande est une aide, jamais une frontière, et elle se retest à chaque version sur votre repo.
À quoi ressemble le travail
Ce qui s’écrit pendant une mission, ce sont des règles tenues dans le repo et revues comme du code. Le CLAUDE.md de ce site en est un, lisible en entier sur GitHub, en voici un extrait :
## Modifier le build
`build.py` tient en 300 lignes et se lit de haut en bas. Il n'a qu'une dépendance externe, `markdown`. Entre une astuce élégante et trois lignes évidentes, écrire les trois lignes. Un ajout qui ferait dépasser le budget de lignes est le signe qu'il faut retirer autre chose, pas augmenter le budget.
Un marqueur laissé non substitué dans une page produite fait échouer le build. Inventer un marqueur dans un gabarit sans l'alimenter dans `build.py` casse donc le déploiement, ce qui est le comportement voulu.
Sur mon propre repo, passer un CLAUDE.md de 108 à 30 lignes a donné le même résultat sur mon banc de test : 22 cas sur 22 avant et après, contre 2 sur 16 sans aucun fichier. Le banc est petit et son juge est une règle simple, je le dis. La longueur ne change rien, l’absence si, et c’est le genre de chose qui se mesure chez soi en une heure.
Quatre formats
Si vous cherchez une formation Claude Code au catalogue, deux jours en salle sur un projet d’exemple, ce n’est pas ce que je vends, et j’ai relevé les prix publics de ceux qui le font dans un article à part. J’arrive dans votre repo, sur vos tickets, et ce qui s’écrit pendant la journée y reste, le déroulé est sur la page de la formation.
Audit du setup agentique
1 500 € HT par jour, forfait de deux à quatre jours
Je regarde ce qui est écrit pour l’agent dans votre repo, ce qui s’applique encore quand il change d’outil, ce qui bloque un merge et où part la facture. Vous repartez avec un playbook écrit et un plan à 90 jours, exécutable sans moi.
Atelier intra sur votre repo
2 500 € HT par jour, facturé au jour et jamais par tête
Une journée sur votre propre code et vos vrais tickets, avec vos développeurs aux claviers plutôt que moi.
Office hours
300 €/h HT, ou 1 400 € HT par mois pour quatre sessions
Une heure avec vos leads sur le problème du moment, écran partagé, y compris en fin de journée.
Build d’un système d’agents
7 500 € HT la semaine, deux semaines minimum
Quand ce qu’il vous faut n’est pas un avis mais du code livré, un agent branché dans votre produit, un socle d’évaluation qui dit si les réponses sont bonnes, un RAG qui tient la charge, une plateforme d’inférence qui ne tombe pas. Je code, vos développeurs relisent le code et les CLAUDE.md qui pilotent l’agent, tout vit dans votre repo.