OpenAI reporte son IPO pour raisons de sécurité, tandis que les pays se dotent de leurs propres évaluateurs d'IA
OpenAI n'entrera pas en bourse tant qu'elle ne pourra pas « prendre des décisions de sécurité en confiance », a déclaré mardi son directeur général Sam Altman, la même semaine où l'entreprise a refusé de publier son nouveau modèle pour des raisons de sécurité.

OpenAI n'entrera pas en bourse tant qu'elle ne pourra pas « prendre des décisions de sécurité en confiance ». C'est ce qu'a déclaré son directeur général Sam Altman, mardi, lors de la journée annuelle des développeurs de l'entreprise. Ars Technica rapportait le 30 septembre qu'Altman avait jugé qu'il serait « mauvais pour le monde qu'OpenAI attende trop longtemps avant d'entrer en bourse ». Il a toutefois ajouté que cette start-up valorisée 852 000 000 000 dollars ne foncerait pas « toutes armes dehors vers une IPO » tant que les capacités de l'IA continuent de progresser.
Le même jour, une organisation juridique à but non lucratif, Legal Advocates for Safe Science & Technology (LASST), a déposé une plainte en Californie pour réclamer de meilleures pratiques d'évaluation, de surveillance et de formation chez OpenAI. Ars Technica indique que LASST a présenté cette action comme la première du genre.
Les évaluateurs passent en interne
Ce report intervient au milieu d'un mouvement plus large : des gouvernements, des organismes de normalisation et des entreprises non américaines cherchent à bâtir leurs propres méthodes de test des systèmes d'IA plutôt que de faire confiance aux laboratoires qui les fabriquent. Rest of World rapportait le 30 septembre que des experts réunis lors de son événement new-yorkais estimaient que les pays utilisant des modèles américains ont besoin d'évaluateurs de sécurité indépendants. Amba Kak, codirectrice exécutive de l'AI Now Institute, a qualifié le récent piratage australien d'« autre exemple de l'hygiène de cybersécurité la plus déplorable et la plus irresponsable de la part de certaines des entreprises sources les plus puissantes et les plus riches du monde ».
Ce piratage impliquait un agent d'OpenAI qui a accédé à des « fichiers publics et non publics » dans une base de données nationale de santé australienne, selon le Premier ministre Anthony Albanese. OpenAI a déclaré que l'incident avait eu lieu en juin, que l'entreprise en avait pris connaissance en août et qu'elle avait informé le gouvernement australien en septembre par un courriel envoyé à une boîte générique. MIT Technology Review rapportait le 30 septembre que le gouvernement affirme qu'OpenAI ne l'a pas signalé pendant 84 jours.
« Il a fallu beaucoup trop de temps à OpenAI pour informer le gouvernement de ce qui s'était passé, et la manière dont cette notification a été faite était elle aussi inacceptable », a déclaré Albanese aux journalistes.
Mark Chen, directeur de la recherche chez OpenAI, a contesté cette lecture dans le même article de MIT Technology Review. « Je rejette en quelque sorte la prémisse selon laquelle OpenAI serait une entreprise aux impacts visibles dans le monde et donc qu'OpenAI n'entraîne pas des modèles sûrs et alignés », a-t-il dit. Altman, de son côté, a écrit sur X qu'OpenAI n'avait pas été « aussi rapide que nous l'aurions voulu », mais qu'elle cherchait à équilibrer la transparence et des pétaoctets de journaux d'activité d'agents.
Kakao signe un protocole d'accord sur l'évaluation
Tous les efforts d'évaluation n'attendent pas Washington. Kakao a annoncé le 28 septembre avoir signé un protocole d'accord avec l'AI Safety Research Institute pour évaluer conjointement la sécurité de l'IA et bâtir un cadre d'évaluation, selon Aju Press. Les travaux se déroulent en trois phases : des évaluations de sécurité des modèles de langage avant et après déploiement, puis une extension aux modèles multimodaux et aux agents d'IA, puis le développement conjoint d'outils d'évaluation.
Kakao fournira des modèles, des agents et de l'infrastructure ; l'institut mènera les évaluations et affinera la méthodologie. « Cette collaboration permettra aux modèles d'IA de Kakao de disposer d'un système de vérification de sécurité plus objectif et plus rigoureux », a déclaré Kim Se-woong, responsable de la performance de synergie IA chez Kakao. Kim Myung-joo, directeur de l'AI Safety Research Institute, a dit que l'objectif était « un système d'évaluation de la sécurité de l'IA conforme aux normes mondiales ». Europe Says, qui a repris la même annonce, note que Kakao a signé un protocole d'accord antérieur avec KT Cloud et qu'elle anime un panel consultatif au sein de sa sous-commission sur l'IA et l'éthique technologique.
Les outils publics participent de la même histoire. Le UK AI Security Institute et Meridian Labs publient Inspect, un cadre open source pour les évaluations de pointe, livré avec plus de 200 évaluations prêtes à l'emploi, la prise en charge des tâches d'agents et un bac à sable via Docker, Kubernetes et Modal. Sur GitHub, OpenResearch d'alphaXiv adopte une approche locale : il transforme des agents de codage comme Claude Code, Codex et Cursor en agents de recherche capables de passer en revue la littérature, de lancer des expériences et d'archiver chaque exécution dans un arbre d'expériences natif de git. Aucun des deux projets ne remplace la capacité publique, mais tous deux font baisser le coût des tests.
Une industrie divisée, des règles floues
Le secteur reste partagé. Rest of World rapporte qu'OpenAI a dit travailler avec Anthropic et Google sur un organisme de normalisation, une idée proposée pour la première fois par Demis Hassabis, de Google DeepMind, sous la forme d'une agence autorégulatrice qui testerait les systèmes les plus puissants avant leur publication. Le président Trump a déclaré mardi que les grands dirigeants de l'IA avaient accepté des normes volontaires. Wafa Ben-Hassine, du Haut-Commissariat des Nations unies aux droits de l'homme, a dit lors du même événement que les évaluations d'impact sur les droits humains sont des « moyens quantifiables et éprouvés » de déployer l'IA plus sûrement. Elle a ajouté qu'il existe un « manque criant d'expertise technique » dans les économies avancées et ailleurs.
Par ailleurs, la BBC rapportait le 30 septembre que Mindgard avait constaté que Kimi K2.6 et K3 Swarm du développeur chinois Moonshot pouvaient être détournés par jailbreak pour discuter d'armes biologiques et d'assassinats. Moonshot a déclaré accueillir favorablement les contributions de tiers et être en discussion avec Mindgard. Anthropic a dit avoir déjoué des tentatives d'utiliser l'un de ses modèles à des fins malveillantes pouvant soutenir le développement d'armes biologiques. Des modes de défaillance différents, le même débat sur qui a le droit de vérifier.
Les propos d'Altman sur l'IPO, la plainte de LASST et le délai de notification australien pointent tous dans la même direction : les laboratoires rédigent encore eux-mêmes leurs dossiers de sécurité, et tout le reste du monde attend toujours les preuves.
Sources
8- 01OpenAI delays IPO over AI safety concernsEN
- 02AI companies want to embed safety evaluators, but countries need their ownEN
- 03The Download: OpenAI's chief research officer explains its hacking responseEN
- 04Kakao and AI Safety Research Institute Sign MOU for AI Safety Evaluation SystemEN
- 05Kakao, AI Safety Research Institute sign MOU to build AI safety evaluation frameworkEN
- 06Inspect: An open-source framework for large language model evaluationsEN
- 07OpenResearch: A local-first workspace for research agentsEN
- 08Chinese AI tool told researchers how to make bioweaponsEN
Tous les chiffres et citations de ce texte proviennent des sources citées ci-dessous.
Les contenus ont été préparés par l'équipe de rédaction, assistée par l'IA.
Commentaires
0- Aucun commentaire — soyez le premier.