Après 2 ans de codage assisté par l'IA, j'ai automatisé la seule chose qui a réellement amélioré la qualité : la programmation par paires d'IA.

DEV - 16/02
Après près de 2 ans de développement assisté par l'IA — de ChatGPT 3.5 à Claude Code — j'ai continué à frapper...

Après près de 2 ans de développement assisté par l'IA — de ChatGPT 3.5 à Claude Code — j'ai continué à rencontrer le même problème : chaque modèle fait des erreurs qu'il ne peut pas détecter. Inspiré par la programmation en binôme et par Ralph Loop, j'ai construit un flux de travail à deux agents dans lequel un agent écrit et un autre révise. La semaine dernière, un PR entièrement rédigé par les deux agents a été fusionné dans un projet Electron open source de 15 000 étoiles après 3 séries de commentaires des responsables. Je n'écris pas TypeScript.

Les problèmes que je n'arrêtais pas de trouver

Je fais de la programmation assistée par IA depuis presque 2 ans maintenant. J'ai commencé avec ChatGPT 3.5 pour générer des extraits de code, je suis passé par Claude, Cursor, TRAE et je suis finalement tombé amoureux de Claude Code. Dès le début, j’ai remarqué que chaque modèle et chaque agent avait ses propres problèmes caractéristiques. Pas de bugs aléatoires – des modèles d'échec cohérents :

Claude Code ignore la gestion des erreurs lorsque le contexte devient long. Il est brillant en architecture mais devient négligent en matière de code défensif dans les tours ultérieurs. Le Codex sur-ingénierie les abstractions mais détecte les cas extrêmes que Claude rate. Gemini a du mal avec des modifications complexes multi-fichiers. Le curseur a des problèmes de dépendance au contexte - fonctionne très bien dans une petite portée, se confond entre les fichiers.

La gravité varie, mais le schéma est le même : un seul agent ne peu...
[Courte citation de 8% de l'article original]

Loading...