NXL Forge.Pendant que le marché rédige — nous livrons
00Blog

Notes Odoo, IA, méthode.

Actualité Odoo le mardi, technique Odoo le jeudi, IA appliquée au développement le reste de la semaine. Filtrer par thème ou rechercher ci-dessous.

5 articles pour « benchmarks »

IA & Codage31 août 2026· 5 min de lecture

Le code IA sort plus vite, sa revue prend cinq fois plus de temps

Les assistants font écrire plus vite, mais la relecture reste humaine. Les études 2026 de Faros AI et LinearB montrent un temps de revue qui explose et des pull requests plus grosses. Pour une PME, la capacité de relecture devient le vrai plafond de livraison.

IArevue de codeproductivité développeurdette technique
IA & Codage25 août 2026· 4 min de lecture

Quand l’agent de code annonce « terminé » à tort

Un agent de code qui annonce « terminé » n’a pas forcément résolu la tâche. Deux études publiées en 2026 chiffrent ces fausses réussites, souvent invisibles car le code passe les tests. Pour une PME, le coût réel se déplace vers la correction humaine.

agents de codefiabilitéIArevue de code
IA & Codage6 juillet 2026· 5 min de lecture

SWE-bench à 95 % : ce que le score d'un agent de code ne dit pas

Un éditeur affiche 95 % sur SWE-bench pour vendre son agent de code. Ce benchmark est pourtant saturé et contaminé, au point qu'OpenAI a cessé de le publier début 2026. On explique comment lire ces scores avant de choisir un outil.

agents de codebenchmarksSWE-benchoutillage dev
IA & Codage8 juin 2026· 4 min de lecture

Le code que les agents IA produisent vieillit mal

Un benchmark publié cette semaine mesure ce que devient le code des agents IA après dix itérations. Verdict : il se dégrade quand le code humain, lui, reste stable. Conséquences pour qui maintient du logiciel Odoo dans la durée.

IA et codageagents IAbenchmarksdette technique
IA & Codage9 mars 2026· 4 min de lecture

Les agents de codage passent à l'échelle industrielle

Skill-creator avec des evals, Copilot CLI en v1.0, GPT-5.4 dans Copilot : la semaine a été chargée côté outillage. Ce qui change concrètement pour les équipes qui shipent.

claude-codegithub-copilotagent-teamsmcp