Des chercheurs viennent de confirmer ce que la sécu soupçonnait depuis deux ans. Les modèles de langage ne savent pas faire la différence entre leurs propres instructions systèmes et le texte qu'un utilisateur leur envoie. Pas "difficilement". Pas "dans certains cas". Structurellement. (simonwillison.net)
Le pire : ce n'est même pas une question de balises. Les modèles se fient au style du texte plus qu'aux marqueurs `<system>` ou `<user>`. Tu colles un paragraphe qui ressemble à une réflexion interne du modèle, il le traite comme tel. Point.
Ce que ça change pour toi lundi matin : si tu construis un produit avec un LLM en front (chatbot client, assistant interne, agent), ton prompt système n'est pas un coffre-fort. C'est un post-it collé sur la porte. N'importe quel input un peu malin peut le contourner.
La conséquence de second ordre, celle que personne ne pose : chaque boîte qui vend de l'"IA autonome" ou des "agents" aujourd'hui empile des couches de logique sur une fondation qui ne sait pas distinguer un ordre légitime d'une injection. On construit des gratte-ciel sur du sable. Tant que ce problème n'est pas résolu au niveau du modèle, la surface d'attaque grandit avec chaque fonctionnalité qu'on ajoute.
La bonne réaction : traiter ton LLM comme un stagiaire brillant mais crédule. Ne jamais lui donner accès à des actions critiques sans validation humaine. Et arrêter de croire que les balises de rôle sont une frontière de sécurité.
Le fait Le projet Inferra veut créer un marché de dérivés sur le compute : des futures perpétuels sur des puces spécifiques (H100, H200, B200, MI300X), avec pricing par oracle et mécanismes de liquidation réels. Devnet stress test terminé, mainnet annoncé. (reddit.com/r/artificial)
Et alors Si tu scales une charge IA, tu sais que le marché GPU ressemble à l'immobilier parisien : opaque, verrouillé par les gros, imprévisible pour les petits. Un marché à terme donnerait un vrai prix de référence et permettrait de hedger ses coûts compute à l'avance au lieu de prier. Le problème : la liquidité. Un marché sans volume, c'est un carnet d'ordres vide.
Le fait Satya Nadella alerte sur la concentration du pouvoir IA entre quelques entreprises et appelle à des modèles moins chers, plus accessibles. (reddit.com/r/artificial)
Et alors Le CEO de la boîte qui a investi massivement dans OpenAI te met en garde contre la concentration. C'est comme un promoteur immobilier qui dénonce la spéculation. Le message est juste. Le messager est cocasse. Retiens quand même le signal sous-jacent : même les géants sentent que le modèle actuel — quelques fournisseurs, prix élevés, accès fermé — ne tient pas. Si tu bâtis ton business sur un seul fournisseur d'IA, c'est le moment de diversifier.
Le fait Tous les benchmarks actuels testent l'IA quand l'utilisateur est assis, prêt, concentré. Personne ne mesure la performance des modèles dans les cas d'usage ambiants : voix en temps réel, lunettes connectées, véhicules autonomes. (reddit.com/r/artificial)
Et alors Si tu choisis un modèle pour un produit temps réel (standard vocal, agent terrain), les scores des leaderboards ne te disent rien. Ce qui compte : latence, robustesse au bruit, capacité à gérer l'interruption. Aucun benchmark standard ne mesure ça. Teste toi-même dans les vraies conditions. Les classements, c'est de la déco.
(l'idée, pas un produit)
Tu construis un produit avec un LLM exposé à des utilisateurs. Comment tu gères le risque d'injection ?
Un modèle qui ne sait pas qui lui parle, c'est un employé qui exécute les ordres de n'importe qui dans le couloir. Utile, mais pas autonome.
Si cette édition t'a fait gagner 20 minutes de veille, transfère-la à un fondateur qui en a besoin.
SOURCES UTILISÉES :
[S1] https://simonwillison.net/2026/Jun/22/prompt-injection-as-role-confusion/#atom-everything
[S2] https://www.reddit.com/r/artificial/comments/1ucje6a/gpu_access_is_still_broken_in_2026_and_someones/
[S3] https://www.reddit.com/r/artificial/comments/1ucet7o/the_outreach_system_my_friend_used_to_generate/
[S4] https://www.reddit.com/r/artificial/comments/1uci32k/you_cant_call_it_progress_microsoft_ceo_satya/
[S5] https://www.reddit.com/r/artificial/comments/1ucvrir/did_we_only_ever_test_ai_when_the_user_was_ready/
[S6] https://www.reddit.com/r/artificial/comments/1ucu0gy/what_are_people_doing_with_local_models/