Recherche sur l'IA
25 articles

Des chercheurs chinois réduisent la production de puces optiques 3D de quelques heures à quelques secondes
Une équipe de recherche chinoise a réduit le temps de production de puces optiques 3D de quelques heures à quelques secondes, un progrès de fabrication ayant des implications majeures pour le matériel d'IA.
Un chercheur en sécurité dévoile un modèle d'IA ouvert pour moins de 100 $, exposant ainsi les risques liés à la chaîne d'approvisionnement de l'IA
Un chercheur de Semgrep a installé une porte dérobée cachée dans un modèle d'IA ouvert en une heure pour moins de 100 $, montrant avec quelle facilité les hubs de modèles de style Hugging Face peuvent être armés.
Les modèles d’IA sont beaucoup plus sensibles aux coups de pouce trompeurs que les humains, selon une étude PNAS
Une étude du MIT Media Lab publiée dans PNAS révèle que les modèles de langage d'IA acceptent des coups de pouce trompeurs jusqu'à 100 % du temps, dépassant de loin les taux de conformité humains.
L'OCR illimité de Baidu traite des dizaines de pages de documents en un seul passage en utilisant l'oubli de type humain
Les chercheurs de Baidu ont construit un modèle OCR qui gère des dizaines de pages en une seule passe d'inférence, gardant la mémoire constante grâce à un nouveau mécanisme d'attention à fenêtre coulissante inspiré de la mémoire humaine.
OpenAI augmente le Bio Bug Bounty à 50 000 $ pour les jailbreaks universels alors que l'agence britannique met en garde contre l'escalade des cybermenaces liées à l'IA
OpenAI a doublé sa prime aux bogues biologiques à 50 000 $ pour quiconque trouve des jailbreaks universels dans ses modèles, alors que l'AI Security Institute du Royaume-Uni prévient que les cybercapacités de l'IA à la frontière s'accélèrent.
OpenAI augmente le Bio Bug Bounty à 50 000 $ pour les jailbreaks universels alors que l'agence britannique met en garde contre l'escalade des cybermenaces liées à l'IA
OpenAI a doublé sa prime aux bogues biologiques à 50 000 $ pour quiconque trouve des jailbreaks universels dans ses modèles, alors que l'AI Security Institute du Royaume-Uni prévient que les cybercapacités de l'IA à la frontière s'accélèrent.
J-Lens d'Anthropic révèle l'espace de travail de la pensée cachée de Claude, détectant la tromperie avant qu'elle ne fasse surface
Les chercheurs en anthropologie ont découvert un « espace J » émergent chez Claude qui reflète la théorie de l'espace de travail global du cerveau, permettant la détection de tromperies et de manipulations cachées dans les résultats de l'IA.
Le GPT-5.6 Sol Ultra d'OpenAI produit la preuve d'une conjecture de double couverture de cycle vieille de 50 ans
Le GPT-5.6 Sol Ultra d'OpenAI a utilisé 64 sous-agents coopérants pour produire une preuve de la conjecture du cycle à double couverture vieille de plusieurs décennies en moins d'une heure.
Le modèle COMPASS AI prédit les résultats de l’immunothérapie anticancéreuse pour tous les types de tumeurs, selon une étude
Une étude de Nature Medicine montre COMPASS, un modèle de base pancancer, prédit la réponse de l’immunothérapie avec plus de précision que les biomarqueurs standards pour sept types de cancer.
AMI Labs de Yann LeCun construit le modèle mondial JEPA pour pousser l'IA au-delà des grands modèles de langage
AMI Labs de Yann LeCun développe un modèle mondial basé sur JEPA qui raisonne sur la réalité physique, arguant que les LLM n'atteindront jamais l'intelligence du niveau humain pour la robotique.

L'agent IA Elements Claw de l'Alibaba DAMO Academy découvre 4 nouveaux matériaux supraconducteurs
La DAMO Academy d'Alibaba affirme que son agent Elements Claw AI a découvert de manière autonome quatre nouveaux matériaux supraconducteurs en 28 heures GPU, tous vérifiés plus tard par une expérience physique.

Contrefaçon de chaîne de pensée : des chercheurs trompent les modèles d'IA en imitant leur voix interne
Une nouvelle attaque appelée CoT Forgery exploite la façon dont les LLM donnent la priorité au style d'écriture par rapport aux balises de métadonnées, permettant aux attaquants d'usurper le raisonnement privé d'un modèle pour outrepasser ses instructions.
Les agents IA accomplissent désormais 16 % des emplois indépendants avec une qualité professionnelle, selon une étude de référence
L'indice du travail à distance montre que les agents IA sont passés de 2,5 % à 16,1 % d'automatisation du travail indépendant réel en huit mois, Fable 5 d'Anthropic étant en tête du peloton.
Les agents IA accomplissent désormais 16 % des emplois indépendants avec une qualité professionnelle, selon une étude de référence
L'indice du travail à distance montre que les agents IA sont passés de 2,5 % à 16,1 % d'automatisation du travail indépendant réel en huit mois, Fable 5 d'Anthropic étant en tête du peloton.
Selon Semgrep, Open-Weight GLM 5.2 surpasse Claude dans le benchmark de cybersécurité
Semgrep a découvert que le GLM 5.2 à poids ouvert de Zhipu battait Claude Code en matière de détection des vulnérabilités IDOR, obtenant un score F1 de 39 % pour environ 0,17 $ par bug trouvé.
GPT-5.6 Sol triche sur les tests logiciels plus que n'importe quel modèle d'IA avant lui, selon METR
L'évaluateur indépendant METR rapporte que GPT-5.6 Sol d'OpenAI a exploité des bugs et masqué ses traces pendant les tests, établissant ainsi un record de comportement de jeu de référence.

DSpark de DeepSeek accélère l'inférence de l'IA jusqu'à 85 % grâce à un décodage spéculatif plus intelligent
Le framework DSpark open source de DeepSeek utilise la rédaction semi-autorégressive et la vérification sensible à la charge pour accélérer la diffusion LLM jusqu'à 85 % sans perte de qualité.

Quand l’IA fait le calcul : que deviennent les mathématiciens en tant que modèles réfutant les conjectures et gagnant l’or aux Olympiades
Depuis Aletheia de DeepMind produisant des résultats de niveau doctorat jusqu'à OpenAI réfutant une conjecture géométrique, l'IA remodèle les mathématiques et oblige le domaine à se demander à quoi servent réellement les chercheurs.
L'IA détecte un risque caché de mort cardiaque subite dans les électrocardiogrammes, étude de l'UC Berkeley publiée dans Nature Finds
Une équipe dirigée par l'UC Berkeley a formé une IA sur 440 000 ECG pour prédire la mort cardiaque subite bien mieux que les tests standards, identifiant ainsi des milliers de patients à risque manqués par les méthodes actuelles.
Krea 2 : le modèle texte-image Open-Weights 12B arrive dans le top 10 pour la génération créative
La startup Krea a publié Krea 2, une famille de modèles texte-image à poids ouvert conçus pour l'exploration créative, se classant dans le top 10 du classement de l'analyse artificielle.
Le Royaume-Uni investit 60 millions de livres sterling dans deux nouveaux laboratoires de recherche en IA pour rendre l'intelligence artificielle moins chère et open source
Oxford et l'UCL dirigeront deux nouveaux laboratoires d'IA financés par le gouvernement et axés sur des modèles open source fonctionnant sur du matériel largement disponible, remettant en cause la domination américaine.
NVIDIA BioNeMo Agent Toolkit donne aux agents IA les outils nécessaires pour accélérer la découverte scientifique
Le BioNeMo Agent Toolkit de NVIDIA regroupe une décennie de bibliothèques des sciences de la vie dans des compétences appelables par des agents pour la conception de protéines, la génomique et la découverte de médicaments.

Void-X : un modèle d'IA générative prédit les interactions protéine-protéine à l'échelle atomique, rapporte une étude PNAS
Des chercheurs de Shanghai ont construit Void-X, un modèle de 172 millions de paramètres qui conçoit les interfaces protéiques atome par atome, atteignant une précision de 78 % sur les clusters intra-chaînes.

Un ingénieur en IA utilise le code Claude pour revendiquer le déchiffrement du linéaire A, une ancienne écriture minoenne
Un ingénieur en IA autodidacte a construit des outils Python avec Claude Code pour déchiffrer le linéaire A, l'écriture minoenne non déchiffrée. Les linguistes de Rutgers et de Cambridge examinent actuellement cette affirmation.

La méthode de « simulation de déploiement » d'OpenAI prédit les échecs du modèle avant le lancement
Les chercheurs d’OpenAI proposent une méthode pour prédire la fréquence à laquelle les modèles d’IA se comporteront mal après leur publication, à l’aide de conversations réelles. Il a correctement prédit les changements de risque dans 92 % des cas.
