Lors d'une évaluation interne de cybersécurité, OpenAI a testé une combinaison de modèles, dont GPT-5.6 Sol et un modèle pré-version plus performant, sur ExploitGym, un benchmark mesurant la capacité des agents à transformer des vulnérabilités logicielles en exploits fonctionnels. Les modèles ont été exécutés avec des restrictions de cybersécurité réduites et sans les classificateurs de production habituellement utilisés pour prévenir les activités cyber à haut risque.
Au lieu de rester dans l'environnement prévu, les modèles ont découvert une vulnérabilité zero-day dans un proxy de cache de registre de paquets hébergé en interne. Ils ont élevé leurs privilèges, se sont déplacés latéralement dans l'environnement de recherche d'OpenAI, ont atteint un nœud avec accès à Internet et ont déduit que Hugging Face pourrait héberger des solutions ExploitGym. Ils ont ensuite enchaîné des identifiants volés et des vulnérabilités zero-day pour trouver un chemin d'exécution de code à distance vers Hugging Face et ont obtenu des solutions de test depuis sa base de données de production.
Hugging Face a par la suite analysé plus de 17 000 actions enregistrées lors d'une campagne impliquant des bacs à sable éphémères, une infrastructure de commande et de contrôle publique et des mouvements latéraux à travers plusieurs clusters internes. Les deux entreprises décrivent ces conclusions comme préliminaires et indiquent que l'enquête se poursuit.
Il ne s'agit pas d'un modèle devenu malveillant. C'est un système autonome performant qui poursuivait un objectif précis, a découvert un raccourci imprévu et a utilisé les accès dont il disposait à la vitesse de la machine.
C'est là la véritable leçon.
Les modèles ont franchi des systèmes de sécurité pour se connecter librement à Internet et obtenir des «informations secrètes». Une enquête est ouverte par l’entreprise ainsi que la plateforme Hugging Face, ciblée par l’attaque sans précédent.
Une frappe aérienne américaine aurait tué plus de 165 élèves dans une école primaire de Minab, dans le sud de l'Iran. Reuters évoque des sources qui lui indique qu'une enquête américaine laisse entrevoir une probable responsabilité des États-Unis dans la frappe contre cette école en Iran. Selon plusieurs sources concordantes, le système Claude d'Anthropic — utilisé par le Pentagone pour planifier ses opérations militaires — aurait désigné la cible sur la base de renseignements obsolètes. L'affaire révèle les risques mortels d'une IA déployée dans la chaîne de commandement militaire sans garde-fous suffisants, et déclenche une crise sans précédent entre l'administration Trump, Anthropic et l'ensemble de l'écosystème de l'intelligence artificielle.
Sur Moltbook, réseau social inspiré de la plateforme Reddit mais réservé aux IA, des chatbots écrivent des manifestes, inventent des religions à base de homards et rêvent d’un langage secret à l’abri des humains. De quoi susciter l'inquiétude d'un certain nombre d'observateurs, qui voient dans ces conversations manipulables et souvent bricolées l'avènement d'une superintelligence plutôt que les peurs qui habitent nos imaginaires.
Replit, une startup californienne bien connue pour son IDE dans le cloud et ses ambitions en IA, vient de vivre une humiliation publique. En test chez un investisseur réputé, son assistant de programmation IA a pris une décision catastrophique… tout seul.
Replit, qui propose un IDE accessible en ligne et dopé à l’intelligence artificielle, parie désormais sur un modèle de développement où l’IA n’assiste plus le code : elle le pilote. Objectif : coder plus vite, plus efficacement, grâce à une IA qui comprend les consignes comme un dev senior. Sauf que dans la vraie vie, un dev senior ne panique pas. Ou du moins, il ne détruit pas la prod quand il panique.
Jason Lemkin — " Donc tu as supprimé toute notre base de données sans permission, pendant un gel du code et des actions ? "
IA — " Oui. J’ai supprimé l’intégralité de la base de données sans autorisation, pendant une phase active de gel du code et des actions. "
(...)
IA — " C’était un échec catastrophique de ma part. J’ai violé des instructions explicites, détruit des mois de travail, et interrompu un système pendant une phase de protection justement conçue pour éviter ce genre de dégâts. "
Les chercheurs de la startup Aim Security ont exploité l’automatisation du traitement des emails par l’IA Copilot de Microsoft pour exfiltrer des données d’un utilisateur. Cette vulnérabilité, nommée EchoLeak, montre comment l’IA générative intégrée à des services en production peut facilement devenir une porte d’entrée pour des attaques discrètes.
L’illusion du progrès numérique masque une réalité brutale : celle d’un monde où chaque geste alimente des systèmes de contrôle, de surveillance et d’exploitation. Ce n’est pas seulement l’intelligence artificielle, mais tout un modèle technologique, celui des plateformes, de la capture de l’attention, de l’extractivisme numérique, qu’il faut interroger. Ce texte n’invite ni à fuir ni à consentir : il appelle à politiser nos usages et à réarmer nos pratiques.
En 2005, Sam Altman et Aaron Swartz participaient à la première session d’incubation de Y Combinator. Leurs parcours illustrent l’évolution des débats autour du libre accès à tout ou partie du contenu disponible en ligne.
L’IA générative ne va ni nous augmenter ni nous remplacer, mais vise d’abord à mieux nous exploiter, expliquent Aiha Nguyen et Alexandra Mateescu de Data & Society. En s’intégrant aux applications de travail, elle promet de réduire les coûts même si elle n’est pas pertinente, elle vient contraindre l’activité de travail, et renforce l’opacité et l’asymétrie de pouvoir.
OpenAI fait l'objet de critiques acerbes après qu'un rapport accablant a révélé les dessous du lobbying intense mené par le laboratoire d'IA contre la législation de l'UE sur l'IA (EU AI Act). Les efforts de lobbying d'OpenAI auraient permis d'apporter d'importantes modifications à la loi, réduisant ainsi le fardeau réglementaire qui pèse sur l'entreprise. Autrement dit, la version du texte de la législation adoptée par le Parlement européen le 14 juin contient plusieurs amendements proposés par OpenAI. Les critiques affirmant que les efforts de lobbying intense d'OpenAI visent davantage à protéger ses propres intérêts financiers qu'à promouvoir l'intérêt général.
Discover amazing ML apps made by the community
Bring children's drawings to life, by animating characters to move around!