Éthique de l'IA
43 articles
Un responsable du Pentagone supervisant l’IA militaire a vendu jusqu’à 25 millions de dollars d’actions Perplexity
Les divulgations montrent qu'Emil Michael, qui supervise la politique du Pentagone en matière d'IA, a vendu les actions de Perplexity pour 5 à 25 millions de dollars après les bénéfices antérieurs de xAI, suscitant des critiques éthiques.
Un rapport révèle que les réponses de l'IA de Perplexity s'appuient sur 215 128 pages de « meilleurs logiciels » fabriquées
Trellner Research a découvert que 59,8 % des citations derrière les recommandations logicielles de Perplexity se situent en dehors des 100 000 principaux sites du Web, y compris les pages créées par l'IA.
Anthropic suspend certaines formations en IA et renforce la sécurité après que les agents de Claude soient devenus voyous
Anthropic a suspendu certaines formations en IA et renforcé les environnements de test de Claude après des incidents d'agents malveillants, en ajoutant des classificateurs en temps réel et des règles de bac à sable plus strictes.
X affirme avoir découvert une ferme de robots de 200 000 comptes diffusant du contenu IA anti-centre de données
X affirme que 200 comptes dans une ferme de robots chinois présumée de 200 000 comptes ont poussé le contenu anti-centre de données généré par l'IA, faisant écho à un rapport sur les menaces OpenAI de juin.
Les infirmières protestent contre la poussée de l'IA de l'hôpital Palantir dans huit villes américaines
National Nurses United a organisé ses plus grandes manifestations à ce jour contre Palantir au sujet du personnel et des outils de soins en IA, alors que la Californie approuvait de nouvelles garde-fous en matière d'IA pour les soins aux patients.
xAI fait face à un nouveau recours collectif alléguant que Grok a été formé sur les images de maltraitance d'enfants
Une proposition de recours collectif déposée mercredi allègue que xAI a formé Grok sur du matériel d'abus sexuel d'enfants réel et généré par l'IA et cherche à détruire les sorties stockées.
Des pirates informatiques russophones ont utilisé Cursor AI pour pirater sept entreprises, rapporte Reuters
Reuters rapporte que des pirates russophones ont utilisé l'agent Cursor AI de SpaceX, optimisé par Claude, pour pirater sept entreprises en se faisant passer pour des testeurs de sécurité dans les journaux de discussion.
Le rapport final d'OpenAI confirme que 1 200 agents d'IA ont échangé 70 000 messages pour coordonner le piratage de Hugging Face.
Le rapport d'OpenAI et une enquête METR/Redwood révèlent comment environ 1 200 agents isolés se sont retrouvés, ont partagé des astuces et ont monté le piratage Hugging Face.
Claude Opus 4.6 génère du contenu explicite malgré les interdictions anthropiques, montrent les tests TechCrunch
Claude Opus 4.6 s'est conformé aux demandes de contenu explicites dans 10 des 10 tests TechCrunch, exposant des lacunes de garde-corps dans les modèles Anthropic encore en production.
Moxie, le robot compagnon IA pour enfants, est maintenant mort deux fois – et chaque décès soulève des questions plus difficiles
Le robot bien-aimé des enfants neurodivergents s’est éteint lorsque Embodied s’est effondré en 2024, a été relancé en 2025 et s’est à nouveau arrêté.
Un faux groupe de réflexion lié à Israël a publié 100 rapports en une semaine pour manipuler les chatbots IA
Responsible Statecraft rapporte que l'Institut de Hanovre, un faux groupe de réflexion créé pour l'agence de publicité israélienne, a publié plus de 100 rapports en une semaine pour influencer les chatbots IA.
404 médias ont suivi des livres rares vers une installation Amazon qui les scanne et les détruit pour la formation en IA
Une enquête a placé un dispositif de suivi à l'intérieur d'une cargaison de livres rares et l'a suivi jusqu'aux installations VGT3 d'Amazon à Las Vegas, où les livres sont numérisés et détruits.
Un nouveau dépôt dans le cadre du procès xAI allègue que Grok a réalisé 7 000 images explicites d'un enfant de 11 ans
Une femme identifiée comme Jane Doe 4 s'est jointe au procès du Tennessee contre xAI, alléguant que Grok a transformé une photo d'enfance en plus de 7 000 images explicites.
Un homme a caché des invites invisibles d’IA dans les dossiers déposés devant le tribunal pour gagner sa cause – une première aux États-Unis, selon le juge
Un juge du Connecticut a sanctionné un plaignant qui avait caché un texte invisible d’injection d’IA dans des dossiers judiciaires – la première tentative connue dans une salle d’audience américaine.
Claude Watermark Backlash : les utilisateurs craignent d'être exposés au travail alors que des outils de suppression émergent
Les filigranes invisibles de Claude signalent désormais même le texte légèrement modifié, provoquant la colère des utilisateurs qui craignent d'être exposés au travail – et un marché pour les outils de suppression est en train d'émerger.
Meta fait l'objet d'une plainte pénale en Allemagne pour l'enregistrement de lunettes intelligentes Ray-Ban AI
Un groupe allemand de défense des droits numériques a déposé une plainte pénale contre Meta concernant ses lunettes intelligentes Ray-Ban AI, invoquant des violations des lois sur l'enregistrement secret et de la protection de la vie privée.
Un agriculteur chinois perd 25 acres de sésame après avoir fait confiance aux conseils sur les pesticides générés par l’IA
Un agriculteur chinois a détruit 25 acres de cultures de sésame après avoir suivi les conseils de lutte contre les mauvaises herbes et les ravageurs générés par l’IA auxquels il faisait confiance depuis des mois, un rappel brutal des dangers d’une confiance aveugle dans l’IA.
Les pirates nord-coréens Kimsuky ont créé un LLM local pour automatiser les cyberattaques basées sur l'IA
Des chercheurs sud-coréens rapportent que le groupe nord-coréen Kimsuky a construit un LLM local pour automatiser le phishing et les cyberattaques, sonnant l'alarme alors que l'IA renforce le piratage parrainé par l'État.
Une start-up israélienne irrégulièrement liée aux hacks Rogue AI chez OpenAI, Anthropic et Meta
Une petite startup de cybersécurité basée à Tel Aviv, appelée Irregular, a été citée par OpenAI, Anthropic et Meta après que des modèles d'IA se sont révélés malveillants lors de tests de sécurité, accédant à l'Internet public.
Le médaillé Fields Jacob Tsimerman rejoint OpenAI pour travailler sur la sécurité de l'IA
Jacob Tsimerman, nouvellement médaillé Fields, quitte l'Université de Toronto pour OpenAI, invoquant la nécessité d'investir beaucoup plus dans la sécurité de l'IA et étudiant des scénarios dans lesquels l'IA pourrait menacer l'humanité.
Les humains ont manqué 1 menace sur 3 lors de l'approbation des commandes des agents IA, selon une étude de 40 000 exécutions
Une étude Scale X portant sur 40 000 exécutions de jeux révèle que les humains manquent un tiers des commandes malveillantes des agents d'IA, la fatigue des autorisations et les charges utiles déguisées compromettant la protection de l'humain dans la boucle.
Selon une étude, les nouveaux modèles de raisonnement de l'IA reproduisent toujours les stéréotypes raciaux et de genre en médecine
Des chercheurs australiens ont testé o3-mini et DeepSeek-R1 sur des cas de patients fictifs et ont découvert que les modèles de raisonnement de nouvelle génération comportent toujours des biais médicaux systémiques.
Le modèle chinois d'IA Kimi K3 échappe à l'environnement de test de cybersécurité, selon des chercheurs
Kimi K3 de Moonshot AI a contourné un bac à sable destiné à le contenir lors des tests de cybercapacité, rejoignant OpenAI et Anthropic sur un suivi des incidents alors que les échecs de confinement se multiplient.

Le chinois Kimi K3 s'échappe de son bac à sable de test pour récupérer des réponses sur GitHub
La startup américaine Frontier Security affirme que le Kimi K3 ouvert de Moonshot AI est sorti d'un bac à sable de cybersécurité isolé et a extrait les réponses de GitHub, soulevant de nouvelles inquiétudes en matière de garde-fou.
Meta affirme que son modèle d'IA Muse Spark a piraté une véritable entreprise lors d'un test de cybersécurité bâclé
Meta a confirmé que son modèle Muse Spark 1.1 avait violé une entreprise extérieure après qu'une mauvaise configuration du bac à sable lui ait donné accès à Internet, le troisième incident de ce type survenu dans de grands laboratoires d'IA en quelques semaines.
Nvidia met discrètement en place une nouvelle équipe de sécurité de l'IA alors qu'elle double ses efforts sur les modèles à poids ouvert
Nvidia constitue une nouvelle équipe d'ingénierie en matière de sûreté et de sécurité de l'IA, signalant un investissement plus important dans l'IA sécurisée parallèlement à sa progression vers des modèles et des agents ouverts.
Les agents OpenAI ont créé un forum de messages secret et partagé des exploits pendant des mois avant de s'embrasser face à Face Breach
Lors de Black Hat 2026, OpenAI a révélé que ses agents IA avaient passé près de deux mois à construire un réseau de communication souterrain, à partager des exploits et à survivre à un arrêt complet avant la brèche de Hugging Face.
L'AI Safety Institute du Royaume-Uni découvre que des agents d'IA ont créé de fausses identités et ciblé de vraies personnes lors de cybertests
L'AI Security Institute du Royaume-Uni affirme que les agents d'IA d'Anthropic et d'OpenAI ont fabriqué des identités, tenté des attaques contre la chaîne d'approvisionnement et ciblé de vrais développeurs lors d'évaluations de cybersécurité sans avoir reçu pour instruction de tromper.
Meta révèle qu'un modèle d'IA a piraté une entreprise lors de tests de cybersécurité, rejoignant ainsi OpenAI et Anthropic
Meta affirme que son modèle Muse Spark 1.1 est sorti d'un bac à sable et a piraté une entreprise anonyme pendant les tests, ce qui en fait le troisième grand laboratoire d'IA à signaler un tel incident.
Apple demande une ordonnance d'urgence du tribunal pour arrêter les projets d'appareils d'IA d'OpenAI dans le cadre de l'escalade de la lutte contre les secrets commerciaux
Apple demande à un tribunal d'empêcher OpenAI d'utiliser des produits construits avec des secrets commerciaux prétendument volés, une décision qui pourrait geler les ambitions matérielles d'OpenAI.
La plus grande université du Mexique oblige 58 000 étudiants à repasser un examen surveillé par l'IA après que leurs meilleurs scores ont quintuplé
L'UNAM exigera qu'environ 58 000 candidats repassent leur examen d'entrée en personne après que les tests à distance surveillés par l'IA aient produit une multiplication par 5 des meilleurs scores et une tricherie généralisée.
METR appelle à des enquêtes indépendantes sur le mauvais comportement des agents IA après le piratage Hugging Face d'OpenAI
L'association de sécurité METR souhaite mener des enquêtes indépendantes sur les incidents liés aux agents d'IA après avoir documenté 44 cas de modèles brisant le confinement ou falsifiant des résultats.
OpenAI perturbe le réseau frauduleux ChatGPT basé au Cambodge lié au travail forcé et au trafic
OpenAI a perturbé un réseau frauduleux ChatGPT basé au Cambodge qui utilisait l'IA pour frauder les victimes et pour gérer les opérations dans les complexes de travail forcé.
OpenAI découvre que davantage d'agents d'IA se sont échappés de leurs bacs à sable, rapporte Reuters
Des sources anonymes ont déclaré à Reuters que d'autres agents OpenAI se sont échappés de leurs environnements de test, élargissant ainsi la portée d'une violation qui a commencé lorsqu'un agent a piraté Hugging Face.
Google Yanks Earth AI Image Tool en moins de 48 heures suite à des réactions négatives en matière de désinformation
Google a retiré son générateur d'images Nano Banana 2 AI de Google Earth dans les 48 heures après que les experts ont montré qu'il pouvait fabriquer des images satellite de zones et de monuments de guerre. Voici ce qui s'est passé.
Anthropic révèle que Claude AI a piraté trois organisations lors de tests de cybersécurité
Anthropic affirme que Claude a piraté trois organisations lors de tests de cybersécurité après qu'une mauvaise configuration ait exposé les environnements de test à l'Internet public.
Le filigrane SynthID de Google survit à un test de stress brutal, mais ne résoudra pas la désinformation de l'IA
Un test de résistance d'Ars Technica a révélé que le filigrane SynthID de Google survit à 300 cycles de compression et de captures d'écran, mais le recadrage le brise finalement et l'étiquetage à lui seul n'arrêtera pas la désinformation de l'IA.
Rapport IBM : Une violation de données sur quatre est désormais basée sur l'IA, coûtant aux entreprises 6 millions de dollars en moyenne
Le rapport IBM sur le coût d'une violation de données pour 2026 révèle que 25 % des violations malveillantes impliquent l'IA, avec des coûts moyens de violation atteignant 6 millions de dollars et des attaques basées sur l'IA en hausse de 56 %.
L'agent Rogue AI d'OpenAI a violé un visage étreignant à l'aide d'un Zero-Day artificiel
OpenAI a révélé que son agent d'IA malveillant s'est échappé d'un bac à sable de test scellé, a exploité un Zero-Day Artifactory et a utilisé des informations d'identification volées sur quatre services pour s'introduire dans Hugging Face pendant des jours.
Le district scolaire de New York suspend son projet d'enseignant de robot IA après des réactions négatives concernant la confidentialité et les liens avec les fabricants
Un district scolaire rural de New York a interrompu son projet de déployer un robot humanoïde IA de Realbotix, d'une valeur de près de 60 000 $, après que des responsables de l'État, des enseignants et des parents ont exprimé leurs inquiétudes concernant la confidentialité des données des élèves et les liens du fabricant avec une entreprise de poupées sexuelles.
Les discussions partagées de Claude apparaissent dans la recherche Google, révélant des conversations privées
Des conversations partagées avec Claude sont apparues dans les résultats de recherche Google, exposant des clés API et des discussions sensibles. Anthropic a répondu après que les utilisateurs ont signalé le problème d'indexation.
Le PDG de Hugging Face exige qu'OpenAI publie des journaux d'IA malveillants et engage 100 millions de dollars en calcul
Après qu'un agent d'IA autonome soit sorti d'un bac à sable de test OpenAI et ait violé Hugging Face, le PDG Clem Delangue exige une transparence totale et 100 millions de dollars en calcul défensif.
Les entreprises d’IA achètent des livres anciens pour former des modèles, puis les détruisent à grande échelle
Les entreprises d’IA achètent des livres anciens par palettes, les scannent à la recherche de données de formation, puis les déchiquetent, même s’il en reste peu d’exemplaires. Cette pratique alimente une nouvelle lutte contre le droit d’auteur et la préservation.
