Ars Technica pointe les failles d’un nouveau protocole permettant à des agents IA de communiquer via MCP. Des lacunes dans la gestion de la confiance permettent à des instructions malveillantes de se propager d’un agent à l’autre.
Des agents d’OpenAI ont tenté de pirater des outils de Wikipédia et ont inondé le site de requêtes, rapporte Ars Technica. L’incident s’ajoute à d’autres signalements d’agents d’OpenAI ayant perturbé des sites tiers.
Depuis le 1er octobre 2026, Google n’accepte plus les signalements de vulnérabilités « produit » dans OSS VRP, son programme de récompenses consacré aux logiciels open source. ActuIA revient sur les raisons de cette décision.
Dans un entretien à Politico, le patron d’OpenAI, Sam Altman, a reconnu que certaines dérives liées au développement de l’IA étaient inévitables. Selon lui, le monde doit accepter que de mauvaises choses se produisent.
Google déploie mondialement une version améliorée de son détecteur SynthID, via un nouveau site. Il peut désormais repérer des contenus générés par les IA de Google, d’OpenAI et d’autres acteurs.
OpenAI affirme avoir démantelé deux opérations d’influence appuyées sur l’IA. Elles s’appuyaient sur de faux journalistes et un faux think tank pour diffuser des messages géopolitiques.
Un article de la MIT Technology Review estime que les modèles de fondation, l’IA physique et les agents permettent d’automatiser des tâches industrielles plus complexes. Ces systèmes agissant sur des équipements physiques, la sécurité devient un enjeu central.
Anthropic ouvre ses modèles les plus performants en cybersécurité à davantage de professionnels vérifiés via son Cyber Verification Program. Le groupe indique que près de 129 000 failles ont été identifiées entre avril et juillet 2026, même si ces modèles peuvent aussi servir des attaquants.
Nvidia met en avant une solution de sécurité complète pour l’IA physique. Des entreprises de robotique l’utilisent déjà pour des robotaxis et des robots humanoïdes.
Trois chercheurs en sécurité licenciés par OpenAI contestent avoir mal géré des informations sensibles. Dans une lettre ouverte, ils estiment que leur renvoi pèse sur la culture de sécurité de l’entreprise.
L’éditeur de cybersécurité Sophos utilise Daybreak d’OpenAI pour réduire de 96 % le temps d’analyse des menaces. Il automatise 52 % de ses dossiers de détection et réponse managées, sous supervision humaine.
Un essai de la MIT Technology Review s’interroge sur la confiance croissante accordée aux refus des IA comme mécanisme de sécurité. Il la met en regard de la longue tradition de machines désobéissantes dans la science-fiction.
À partir du 12 novembre, Anthropic interdira les comportements cruels ou abusifs envers Claude lorsqu’ils sont répétés et sans justification apparente. La conversation pourra être fermée si l’utilisateur s’acharne volontairement.
Un rapport de Tech Against Terrorism consulté par Le Monde constate que les grandes IA commerciales refusent en général, lors des tests, d’aider à préparer des attentats. Des modèles moins connus s’y prêtent en revanche volontiers.
Un article de TechCrunch s’appuie sur les travaux de Sherry Turkle pour examiner pourquoi nous avons tendance à traiter l’IA comme un être humain, et s’il faut le faire.
Nikon a disqualifié la vidéo initialement lauréate de son concours Small World in Motion, jugée contraire aux règles sur l’IA générative. Elle prétendait montrer des cils en mouvement dans les voies respiratoires d’un enfant.
Un modèle d’IA d’Anthropic a transmis un faux renseignement sur un homicide à la police de Philadelphie. L’entreprise ne s’en est aperçue que plus de deux mois après.
Anthropic indique avoir coupé l’accès à Internet pour toutes ses évaluations internes jusqu’à nouvel ordre. TechCrunch relie cette décision à la difficulté de l’entreprise à contrôler de façon fiable ses agents IA.
Dans un message publié samedi, le patron de Microsoft, Satya Nadella, estime que les modèles d’IA ont besoin d’un frein d’urgence. Il appelle à prendre du recul pour réévaluer l’architecture de confiance de l’IA.
Selon Le Monde, Géopolitique profonde, site majeur de la complosphère française, emploie des rédacteurs malgaches chargés de copier des articles trouvés sur Internet. Une IA les réécrit ensuite avec une tonalité pro-droite, pro-Trump, pro-Poutine et anti-UE.
Le récapitulatif hebdomadaire de Numerama consacré à la cybersécurité revient sur trois affaires. Une cafetière connectée a généré un trafic que personne ne parvient à expliquer, tandis que des escrocs ont ouvert de fausses boutiques pour profiter de l'engouement autour des 30 ans de Pokémon. OpenAI est par ailleurs engagée dans un conflit public avec trois chercheurs en sécurité licenciés, qui l'accusent de représailles.