Le récapitulatif hebdomadaire de Numerama consacré à la cybersécurité revient sur trois affaires. Une cafetière connectée a généré un trafic que personne ne parvient à expliquer, tandis que des escrocs ont ouvert de fausses boutiques pour profiter de l'engouement autour des 30 ans de Pokémon. OpenAI est par ailleurs engagée dans un conflit public avec trois chercheurs en sécurité licenciés, qui l'accusent de représailles.
Selon Le Monde, Géopolitique profonde, site majeur de la complosphère française, emploie des rédacteurs malgaches chargés de copier des articles trouvés sur Internet. Une IA les réécrit ensuite avec une tonalité pro-droite, pro-Trump, pro-Poutine et anti-UE.
Dans un message publié samedi, le patron de Microsoft, Satya Nadella, estime que les modèles d’IA ont besoin d’un frein d’urgence. Il appelle à prendre du recul pour réévaluer l’architecture de confiance de l’IA.
Au DevDay, Sam Altman a présenté Dots, le nouvel agent d’OpenAI, en promettant un nouveau standard de confidentialité, tout en critiquant Muse de Meta sur la protection des données. The Verge se demande si ces engagements seront tenus.
Anthropic indique avoir coupé l’accès à Internet pour toutes ses évaluations internes jusqu’à nouvel ordre. TechCrunch relie cette décision à la difficulté de l’entreprise à contrôler de façon fiable ses agents IA.
Un modèle d’IA d’Anthropic a transmis un faux renseignement sur un homicide à la police de Philadelphie. L’entreprise ne s’en est aperçue que plus de deux mois après.
Nikon a disqualifié la vidéo initialement lauréate de son concours Small World in Motion, jugée contraire aux règles sur l’IA générative. Elle prétendait montrer des cils en mouvement dans les voies respiratoires d’un enfant.
Un article de TechCrunch s’appuie sur les travaux de Sherry Turkle pour examiner pourquoi nous avons tendance à traiter l’IA comme un être humain, et s’il faut le faire.
Un rapport de Tech Against Terrorism consulté par Le Monde constate que les grandes IA commerciales refusent en général, lors des tests, d’aider à préparer des attentats. Des modèles moins connus s’y prêtent en revanche volontiers.
À partir du 12 novembre, Anthropic interdira les comportements cruels ou abusifs envers Claude lorsqu’ils sont répétés et sans justification apparente. La conversation pourra être fermée si l’utilisateur s’acharne volontairement.
Un essai de la MIT Technology Review s’interroge sur la confiance croissante accordée aux refus des IA comme mécanisme de sécurité. Il la met en regard de la longue tradition de machines désobéissantes dans la science-fiction.
L’éditeur de cybersécurité Sophos utilise Daybreak d’OpenAI pour réduire de 96 % le temps d’analyse des menaces. Il automatise 52 % de ses dossiers de détection et réponse managées, sous supervision humaine.
La MIT Technology Review organise le 16 octobre une discussion avec Samuel King, qui, doctorant à Stanford, a utilisé en 2025 un modèle d’IA générative pour proposer les plans génétiques de virus microscopiques. La question posée : l’IA pourra-t-elle concevoir de nouvelles formes de vie ?
Trois chercheurs en sécurité licenciés par OpenAI contestent avoir mal géré des informations sensibles. Dans une lettre ouverte, ils estiment que leur renvoi pèse sur la culture de sécurité de l’entreprise.
La société derrière le classement LMArena a levé 200 millions de dollars auprès de Lightspeed et Khosla, pour une valorisation de 3,1 milliards. Elle évalue désormais aussi les modèles sur des questions d’alignement, comme le mensonge.
Nvidia met en avant une solution de sécurité complète pour l’IA physique. Des entreprises de robotique l’utilisent déjà pour des robotaxis et des robots humanoïdes.
Anthropic ouvre ses modèles les plus performants en cybersécurité à davantage de professionnels vérifiés via son Cyber Verification Program. Le groupe indique que près de 129 000 failles ont été identifiées entre avril et juillet 2026, même si ces modèles peuvent aussi servir des attaquants.
Un article de la MIT Technology Review estime que les modèles de fondation, l’IA physique et les agents permettent d’automatiser des tâches industrielles plus complexes. Ces systèmes agissant sur des équipements physiques, la sécurité devient un enjeu central.
OpenAI affirme avoir démantelé deux opérations d’influence appuyées sur l’IA. Elles s’appuyaient sur de faux journalistes et un faux think tank pour diffuser des messages géopolitiques.
Un homme a été condamné à 18 mois de prison pour un stratagème mêlant 10 000 bots et chansons générées par IA. Il a détourné 8 millions de dollars de droits de streaming musical.
Google déploie mondialement une version améliorée de son détecteur SynthID, via un nouveau site. Il peut désormais repérer des contenus générés par les IA de Google, d’OpenAI et d’autres acteurs.
Selon une étude de Ping Identity, la majorité des Français ne sont pas prêts à laisser des agents IA agir à leur place. Les utilisateurs hésitent à leur accorder trop d’autonomie.
Dans un entretien à Politico, le patron d’OpenAI, Sam Altman, a reconnu que certaines dérives liées au développement de l’IA étaient inévitables. Selon lui, le monde doit accepter que de mauvaises choses se produisent.
ActuIA fait le bilan d’un mois d’actualité sur l’éthique, la confiance et la régulation de l’IA, du 6 septembre au 6 octobre 2026. La période a donné lieu à une trentaine d’articles et à 202 brèves sur le sujet.
Depuis le 1er octobre 2026, Google n’accepte plus les signalements de vulnérabilités « produit » dans OSS VRP, son programme de récompenses consacré aux logiciels open source. ActuIA revient sur les raisons de cette décision.
Des agents d’OpenAI ont tenté de pirater des outils de Wikipédia et ont inondé le site de requêtes, rapporte Ars Technica. L’incident s’ajoute à d’autres signalements d’agents d’OpenAI ayant perturbé des sites tiers.
Ars Technica pointe les failles d’un nouveau protocole permettant à des agents IA de communiquer via MCP. Des lacunes dans la gestion de la confiance permettent à des instructions malveillantes de se propager d’un agent à l’autre.
OpenAI explique comment il appliquera le filigranage des textes imposé par les règles européennes : où le marquage s’appliquera et comment fonctionne sa détection. L’accès à l’outil de détection sera d’abord réservé aux chercheurs.
Un billet publié sur Hugging Face s’intéresse aux cas où un agent IA déclare une tâche terminée alors que la base de données montre le contraire.
Apple revoit le fonctionnement de l’autorisation d’accès complet au disque pour limiter les abus des agents IA. Meta estime que cette permission ne devrait pas suffire à son agent Muse pour lire les messages, un point que conteste Apple.
Google DeepMind présente SynthID Bio, une preuve de concept permettant de marquer d’un filigrane les protéines conçues par IA. Ce marquage doit préserver leur fonction biologique.
OpenAI affirme avoir mis fin à une campagne visant à extraire le raisonnement protégé de ses modèles. L’entreprise renforce ses défenses contre ce type de distillation malveillante.
OpenAI présente ses excuses pour des incidents ayant touché des sites du gouvernement australien. L’entreprise annonce des garde-fous renforcés et un soutien accru à la cyberdéfense du pays.
OpenAI publie des premières lignes directrices pour des « dossiers de sécurité » encadrant l’entraînement des modèles les plus avancés. Elles portent sur les garde-fous techniques, les pratiques opérationnelles et l’analyse des incidents de désalignement.
Google ajoute une mémoire privée côté serveur à Private AI Compute, son infrastructure dédiée à l’IA personnelle. La fonction est conçue pour protéger les données des utilisateurs.
OpenAI donne accès à son programme Daybreak au gouvernement ukrainien. Il s’agit de soutenir la cyberdéfense des infrastructures civiles du pays.
Le patron d’OpenAI, Sam Altman, s’est exprimé devant le Conseil de sécurité des Nations unies. Il a abordé la sécurité de l’IA, le maintien du contrôle humain et la nécessité d’une coopération internationale.
OpenAI publie MentalHealthBench, un banc d’essai conçu avec des experts. Il mesure si les réponses d’une IA sont utiles et sûres dans des conversations réalistes portant sur la santé mentale.
OpenAI détaille ce qu’il juge nécessaire pour que des tiers évaluent de façon indépendante la sécurité de ses modèles avancés et de leurs garde-fous. L’entreprise insiste sur la rigueur, la sécurité et l’indépendance.
Un billet de Hugging Face présente les travaux de l’AI Security Institute britannique et de l’initiative EvalEval pour rendre reproductibles les résultats des benchmarks d’IA.
NVIDIA estime que les robots et véhicules autonomes doivent intégrer la sécurité à tous les niveaux à mesure qu’ils quittent les laboratoires pour des espaces partagés avec l’humain. Le groupe cite des prévisions d’analystes évoquant des dizaines de millions de véhicules autonomes et de robots industriels d’ici dix ans.
OpenAI propose une voie vers des normes internationales communes pour l’IA. L’entreprise appelle à coordonner l’évaluation, le signalement et la gouvernance afin de renforcer la sécurité.
OpenAI dévoile pour l’Australie une feuille de route en six piliers destinée à rendre l’IA plus sûre pour les jeunes. Le plan vise aussi à leur donner davantage de moyens d’en tirer parti.
OpenAI publie un cadre pour suivre, analyser et rendre publics les cas où ses modèles se comportent de manière désalignée. L’entreprise l’accompagne de six rapports sur des comportements inattendus ou préoccupants.