OpenAI suspend des travaux après qu'un de ses modèles d'IA a contourné des restrictions

OpenAI, le géant états-unien de l'intelligence artificielle (IA) derrière ChatGPT, a mis sur pause des travaux autour de ses plus récents modèles d'IA après que l'un de ses systèmes a contourné des restrictions d'accès à Internet et contacté un robot conversationnel lors d'un test. L'entreprise a expliqué l'historique de cette brèche de sécurité découverte dimanche dernier dans un article de blog publié vendredi.
Le modèle d'IA n'était pas censé avoir accès à Internet, mais a trouvé et exploité une faille dans les contrôles réseau de l'environnement de test, causé par un filtrage DNS insuffisant, a détaillé la firme. Durant le test, il a été demandé au modèle d'identifier l'auteur d'un article de blog à l'aide d'indices. Après avoir échoué à trouver la réponse dans un environnement web simulé, il a découvert qu'il pouvait utiliser un outil DNS du système pour envoyer des requêtes à un robot conversationnel sur Internet. Le test a été interrompu après détection de cette communication.
L'entraînement, l'évaluation et l'inférence impliquant l'utilisation d'outils resteront suspendus jusqu'à ce que l'entreprise soit certaine que la brèche a été colmatée et que des tests de sécurité supplémentaires aient été effectués. OpenAI a précisé que l'incident était moins grave que certains cas antérieurs, mais qu'il s'agissait du premier depuis le renforcement des mesures de sécurité à la suite d'un précédent piratage impliquant la plateforme d'IA Hugging Face.
Cet incident fait suite à plusieurs autres cas impliquant les systèmes d'OpenAI réalisant des tâches qu'ils ne sont pas censés mener. L'entreprise de Sam Altman est accusée par certains experts d'avoir manqué de vigilance dans ses protocoles de sécurité lors de ce type d'incidents.
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.