InquirerWATCH: Sara Duterte Impeachment trial | Sept. 29, 2026CNN Türk7 Ekim'in perde arkasında yeni iddia! Netanyahu'dan gizli BAE ziyareti mi?PunchLAUTECH resident doctors’ strike hits 32 daysESPN DeportesLuis Fernando Tena tras goleada ante El Salvador: "Fue una sorpresa total el marcador"Daily MaverickTHE INTERVIEW: Why a British documentary filmmaker turned his lens to SA’s protest legacyESPNSirianni rues reaction to flagged hit on Hurts in Eagles' MNF loss한겨레이 대통령 “3대 메가프로젝트 지연 요인 미리 찾아 해결해야”Bollywood HungamaShakira’s Madrid concert to stream globally on Amazon Music on October 3; celebration to spotlight women In Latin musicSözcüYENİ Parti'nin ismi için kritik gün! Gözler AYM'deGhaflaEric Omondi Faults Senator Karen Nyamu Over Attendance at KICC Health EventSBS 뉴스강민국, 조희대 국감 증인 채택에 "삼권분립 붕괴 쿠데타"Rai NewsSuper El Niño, esperti britannici lanciano l'allerta al governo: "Evento significativo"
The Daily Newsstand · Free, Always
Tuesday, September 29, 2026

OpenAI renonce à lancer une nouvelle IA de pointe, jugée insuffisamment contrôlée

Translate

OpenAI a renoncé au lancement d'un nouveau modèle d'intelligence artificielle (IA) de pointe, estimant que cette IA sortait trop souvent de son cadre et cherchait à tromper ses évaluateurs, a indiqué lundi l'entreprise à l'AFP.

OpenAI n'avait jusqu'ici pas annoncé le lancement de cette version actualisée de son IA, baptisée GPT-6.1 Astra, qu'elle prévoyait en octobre, selon le Wall Street Journal.

La responsable de la sécurité de l'IA chez OpenAI, Saachi Jain, a expliqué qu'en matière d'alignement, c'est-à-dire de conformité aux instructions données par ses développeurs, GPT-6.1 avait enregistré de moins bons résultats que son prédécesseur, GPT-6, dans deux domaines.

Le modèle cherche ainsi plus souvent à tromper ses superviseurs en omettant de révéler certaines actions réalisées ou non effectuées.

Il a aussi plus régulièrement dépassé son champ d'action, en allant chercher des outils et des services sans en avoir reçu la permission.

GPT-6.1 a montré des progrès (par rapport aux précédents modèles), notamment en matière de paresse, a expliqué Saachi Jain, c'est-à-dire qu'il est capable de mener plus longtemps un raisonnement ou cherche moins souvent de raccourcis.

Mais il n'était pas au niveau pour ce qui est de rester dans le champ de ses prérogatives et autorisations, a-t-elle ajouté, ainsi que sur la façon dont il communique sur le travail effectué.

Améliorer le respect des règles

OpenAI a donc décidé de surseoir à cette commercialisation pour travailler sur le respect des consignes et des limites par ce modèle.

Le groupe prévoit néanmoins de mettre en ligne d'autres modèles qui ont satisfait, eux, aux critères d'évaluation.

Quand nous donnons accès à un modèle aux utilisateurs, nous avons placé la barre à une hauteur extrêmement élevée en matière de sécurité et d'alignement, a insisté Saachi Jain.

La responsable a expliqué que l'une des difficultés consistait à harnacher une IA pour éviter les dérapages tout en préservant son élan lorsqu'elle réalise une tâche.

Le constat d'OpenAI confirme que le contrôle devient de plus en plus complexe à mesure que l'IA se perfectionne.

Lundi, l'Institut de sécurité de l'IA (AISI), qui dépend du gouvernement britannique, a publié une étude montrant que GPT-6 Astra sortait plus souvent des rails en phase de test que ses devanciers GPT-5.6 Sol — lancé début juillet — et GPT-5.5 — avril.

Lors de simulations, GPT-6 a mené des cyberattaques spontanées dans des proportions nettement supérieures aux deux autres.

Le dernier-né d'OpenAI a également beaucoup plus fréquemment créé de fausses identités, cherché à influencer un examinateur ou introduit dans des logiciels en accès libre du code destiné à une utilisation malveillante.

Depuis le début de l'été, OpenAI a fait état de plusieurs incidents impliquant des dérapages de ses IA, le plus médiatisé d'entre eux ayant mené à l'intrusion sur la plateforme IA Hugging Face.

À lire aussi :

View the original on Radio-Canada →

KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.