Le fait Le benchmark MirrorCode d'Epoch AI teste si un modele peut recreer un programme complet sans voir le code original. Claude Opus 4.7 mene avec 56% de reussite, reconstruisant un toolkit de 16 000 lignes en 14 heures. Mais tous les modeles echouent sur les taches les plus complexes (source).
Et alors, lundi matin 14 heures pour 16 000 lignes. Meme a 56% de reussite, le ratio cout/temps est deja viable pour du prototypage. Le plafond est clair : les projets complexes restent hors de portee. Mais ton MVP, lui, est dans la zone.
pour du prototypage et du code utilitaire. Pas pour ton produit coeur.
Sourcé Source
Le contexte Ce signal vient de l'édition du 2026-06-27, où il est remis dans la sélection du jour.