Journal De Bruxelles - OpenAI écarte trois chercheurs en sécurité de l'IA accusés de fuites d'informations sensibles

Euronext
AEX -1.1% 1102.63 €
BEL20 -1.74% 5508.67 €
PX1 -1.62% 7835.31 €
ISEQ -2.98% 14042.82 €
OSEBX -0.87% 2057.18 kr
PSI20 -1.97% 9476.6 €
ENTEC -0.41% 1416.23 €
BIOTK -1.45% 4451.12 €
N150 -1.39% 4146.79 €
OpenAI écarte trois chercheurs en sécurité de l'IA accusés de fuites d'informations sensibles
OpenAI écarte trois chercheurs en sécurité de l'IA accusés de fuites d'informations sensibles / Photo: ANDREJ IVANOV - AFP

OpenAI écarte trois chercheurs en sécurité de l'IA accusés de fuites d'informations sensibles

OpenAI, le créateur de ChatGPT, a indiqué jeudi à l'AFP avoir exclu trois de ses chercheurs en sécurité de l'intelligence artificielle, accusés de fuites d'informations sensibles, au moment où plusieurs de ses propres employés alertent publiquement sur les dangers de cette technologie.

Taille du texte:

Le Wall Street Journal a identifié les chercheurs concernés, qui soutenaient tous trois sur les réseaux sociaux les appels à ralentir le développement de l'IA.

L'un d'eux, Tomek Korbak, se présentait comme un des interlocuteurs de METR, l'institut chargé d'enquêter sur le piratage en juillet de la plateforme Hugging Face par des outils d'OpenAI, premier d'une longue série de révélations sur les dérapages d'IA en test dans la Silicon Valley.

"Nous nous sommes séparés de trois personnes pour violation de nos règles sur l'accès aux informations sensibles de l'entreprise et leur traitement", a déclaré un porte-parole d'OpenAI joint par l'AFP.

L'enquête interne a confirmé que ces personnes avaient traité des informations sensibles hors des procédures établies, "rompant la confiance indispensable à notre travail", a-t-il ajouté.

L'entreprise fait état de plusieurs manquements, dont l'un concerne des informations communiquées à un groupe extérieur d'évaluation de l'IA, qu'elle ne nomme pas.

- "Droit de le dire" -

Ces exclusions surviennent quelques semaines après la démission très médiatisée, le 8 septembre, d'un chercheur passé d'OpenAI à Anthropic, Jacob Coxon, qui avait accusé les deux entreprises de "jouer avec nos vies". Tomek Korbak et les deux autres chercheurs écartés, Jasmine Wang et Mikita Balesni, avaient soutenu sa prise de parole sur X.

Deux jours plus tard, Mikita Balesni écrivait, reprenant les termes d'un message viral d'un responsable de la sûreté chez Anthropic, la société rivale: "Je suis chez OpenAI et je pense que l'IA a plus de 10% de chances de tuer tous les humains".

Revendiquant sa liberté de parole, Tomek Korbak ajoutait le 12 septembre: "Je suis très mécontent d'une grande partie de ce que fait OpenAI" et "je suis très heureux d'avoir le droit de [le] dire".

"Je veux exprimer mes inquiétudes pour que nous agissions, pas pour faire peur", affirmait l'avant-veille Jasmine Wang. Anthropic et OpenAI sont régulièrement accusés d'exagérer les dangers d'une technologie qu'ils créent eux-même pour mieux restreindre puis dominer le marché, ce qu'ils contestent.

- Code de bonne conduite -

Depuis l'été, la Silicon Valley vit au rythme des rapports d'incidents d'IA en test. Vendredi encore, OpenAI a révélé avoir suspendu l'entraînement de ses modèles en développement après que l'un d'eux eut accédé à internet sans autorisation.

Ces dérapages divisent le secteur: de grands patrons tels que Dario Amodei (Anthropic), Sam Altman (OpenAI) et Elon Musk ont réclamé mi-septembre de ralentir le développement de l'IA, quand d'autres, comme Jensen Huang (Nvidia) et Mark Zuckerberg (Meta), veulent maintenir la cadence.

Dans un essai remarqué, le 12 septembre, Dario Amodei a écrit redouter qu'un groupe d'agents IA puisse, à ce rythme, "prendre le contrôle de l'intégralité d'internet" d'ici six à douze mois.

Mardi, face aux journalistes, Sam Altman a assuré qu'OpenAI investissait "davantage dans la sûreté, la sécurité, l'alignement et la surveillance", tout en rejetant aussi bien ceux qui veulent "foncer à toute vitesse" que ceux qui réclament de "tout arrêter maintenant".

OpenAI s'est engagé mi-septembre, à la suite d'Anthropic, à accueillir en permanence des évaluateurs indépendants.

L'entreprise a renoncé lundi à lancer une nouvelle version de son modèle phare, GPT-6 Astra, jugée trop prompte à s'écarter des consignes. L'entreprise de San Francisco a toutefois rendu public le lendemain un modèle intermédiaire, GPT-6.1 Sol, présenté comme presque aussi performant qu'Astra à bien moindre coût.

Hostile à toute régulation contraignante susceptible d'entraver la course face à la Chine, Donald Trump a réuni mardi les champions américains du secteur, leur faisant signer un code de bonne conduite volontaire sur la prévention des risques de l'IA.

Aucune loi fédérale n'encadre ces modèles aux Etats-Unis, qui prévoient seulement, sur la base du volontariat, de soumettre leurs capacités à un examen gouvernemental avant qu'ils soient rendus publics.

R.Vandevelde--JdB