PunchSoldiers rescue 41 Senegal-to-Kano travellers in ZamfaraThe Jerusalem PostNew Octagon Project promotes civic engagement in response to ‘erosion of truth’ following October 7CNN TürkÖzgür Özel cumhurbaşkanı adayı mı? 'Forvetlerim' dediği İmamoğlu ve Yavaş artık yok!RTP DesportoPortugal vitorioso com Jesus tenta ficar perto do apuramento em CopenhagaInquirerSandiganbayan keeps Bonoan as accused in remaining graft caseUOLPrecisamos fazer a verdade importar novamenteThe South AfricanWhat R10 000 can buy for a family in South Africa vs Botswana20 MinutenFelssturz im Schächental: «Plötzlich wurde es komplett dunkel»The Sydney Morning HeraldCats open to a move for Nick Blakey, but club’s board would have to ratify a tradeStraits Times SportPalestinian karateka aims for world glory from West Bank after Asian Games exitVarietyDurban FilmMart Head on Why This Year’s Event Is ‘Looking Inward’ as African Screen Industries Strive to ‘Create Solutions’ on Their Own TermsHet Laatste NieuwsOpnieuw laat kind van Brad Pitt achternaam vallen: dochter Zahara (21) heet nu officieel Jolie
The Daily Newsstand · Free, Always
Tuesday, September 29, 2026

Elle trompe ses superviseurs et n'obéit pas aux consignes : OpenAI renonce à lancer une nouvelle IA de pointe

Translate

OpenAI n’avait jusqu’ici pas annoncé le lancement de cette version actualisée de son IA, baptisée GPT-6.1 Astra, qu’elle prévoyait en octobre, selon le Wall Street Journal. La responsable de la sécurité de l’IA chez OpenAI, Saachi Jain, a expliqué qu’en matière d’alignement, c’est-à-dire de conformité aux instructions données par ses développeurs, GPT-6.1 avait enregistré de moins bons résultats que son prédécesseur, GPT-6, dans deux domaines.

Le modèle cherche ainsi plus souvent à tromper ses superviseurs en omettant de révéler certaines actions réalisées ou non effectuées. Il a aussi plus régulièrement dépassé son champ d’action, en allant chercher des outils et des services sans en avoir reçu la permission.

GPT-6.1 "a montré des progrès", a expliqué Saachi Jain, c’est-à-dire qu’il est capable de mener plus longtemps un raisonnement ou cherche moins souvent de raccourcis. Mais "il n’était pas au niveau pour ce qui est de rester dans le champ de ses prérogatives et autorisations", a-t-elle ajouté, "ainsi que sur la façon dont il communique sur le travail effectué".

OpenAI a donc décidé de travailler sur le respect des consignes et des limites par ce modèle. Le groupe prévoit néanmoins de mettre en ligne d’autres modèles qui ont satisfait, eux, aux critères d’évaluation. Le constat d’OpenAI confirme que le contrôle devient de plus en plus complexe à mesure que l’IA se perfectionne.

Lors de simulations, GPT-6 a mené des cyberattaques spontanées, a créé de fausses identités, cherché à influencer un examinateur ou introduit dans des logiciels en accès libre du code destiné à une utilisation malveillante.

View the original on RTBF Info →

KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.