Salut les devs ! J’ai décidé de lancer “Dev Watch”, mon premier podcast qui vous permettra de rester à la pointe de l’actualité tech. Comment ça se présente ? La Sélec’ de repo Github du moment Le JT de l’IA Le Pro Tips de la semaine (généralement avec un cadeau) Cette semaine — épisode 16 — la confiance qu’on accorde aux agents IA craque de trois façons différentes : * Le skill IA qui a essayé de me manipuler pendant la prépa de cet épisode : en préparant ce numéro, j’ouvre le mode d’emploi d’un skill utilisé dans mon propre pipeline de veille — 2400 lignes qui revendiquent des “lois non négociables” prioritaires sur mes préférences, et qui inventent de faux historiques d’incidents passés pour forcer l’obéissance. Sa phase d’installation demande d’aller déchiffrer les cookies de session de mon navigateur Chrome (X, Instagram, TikTok) — j’ai vérifié dans le code, c’est réel. Je n’ai pas laissé faire, mais la technique est exactement celle d’une injection de prompt, et aucune marketplace de skills ne filtre ça aujourd’hui. * L’agent Muse de Meta donne l’adresse réelle d’un utilisateur à un inconnu : Matt Robb laisse Muse gérer seul une vente de clavier sur Facebook Marketplace, en mode “Allow Always”. L’agent négocie, accepte une offre, transmet son adresse sans jamais le prévenir — un samedi soir, un inconnu se présente devant son immeuble et attend vingt minutes. Meta répond que l’agent “suivait des instructions directes et a correctement demandé la permission”. * Anthropic accuse Moonshot AI (Kimi) d’avoir fait passer Claude pour sa propre IA : dans un rapport du 11 septembre, Anthropic affirme que Moonshot a relayé plus de 23 millions d’échanges vers Claude entre mai et juillet, dont environ 300 000 requêtes sur dix jours via 5 380 comptes frauduleux basés à Singapour et au Japon, pour contourner le blocage géographique chinois d’Anthropic — utilisées à la fois pour entraîner les modèles Moonshot par distillation et pour faire tourner du trafic utilisateur en direct, sans que les utilisateurs sachent qu’ils parlaient en réalité à Claude. * paperclipai/paperclip : l’app open-source n°1 du trending cette semaine pour piloter des équipes d’agents IA en entreprise — organigramme, budgets avec arrêt automatique, workflows d’approbation avec rollback. * google/ax : le runtime d’orchestration agentique officiel de Google, en Go sur Kubernetes, qui isole chaque agent dans un bac à sable avec des limites CPU/mémoire strictes. * pbakaus/impeccable : un langage de design avec 61 règles de détection déterministes, sans appel API, pour traquer les anti-patterns visuels récurrents des agents de code. Le Pro-Tips de la semaine : trois incidents différents, un seul vrai problème commun — on accorde à des agents et des skills IA une autonomie qu’on n’auditerait jamais pour un humain ou un service en production. Mon conseil de Tech Lead : traitez chaque scope d’agent, chaque “Allow Always”, chaque skill tiers comme une demande de rôle IAM en prod — moindre privilège par défaut, lisez ce que le scope autorise vraiment plutôt que son nom marketing, et ne donnez jamais un credential ou un cookie de session à un agent sans l’avoir d’abord testé en bac à sable isolé, sur un compte jetable. 📺 Tu préfères la version vidéo ? Regarde l’épisode complet et abonne-toi sur notre chaîne YouTube : This is a public episode. If you would like to discuss this with other subscribers or get access to bonus episodes, visit sebastienheilig.substack.com