ESPN DeportesTexas quiere confirmar su buen momento ante Oklahoma en la rivalidad del Red RiverPunchI won’t be watching livestream of US shooter’s execution — Vice President VanceInquirerOCD: Ashfall, sulfuric odor after Kanlaon’s ‘explosive’ eruptionRTP DesportoI Liga. Conheça as equipas inicias de Marítimo e FC PortoThe Jerusalem PostIsrael Philharmonic Orchestra launches landmark 90th season - previewESPNNHL Tonight: Previews, stats, betting info for Saturday's 14 gamesInquirer EntertainmentEmma Tiglao bids pageantry goodbye after Miss Grand International reign endsScreen Rant8 2000s Shows That Aren't As Good As You RememberBBC عربيخمسة جرحى في انفجار قوي بمطار الملك خالد بالرياضThe Hollywood ReporterWhy Silver Lake’s Hottest New Hotel Took So Long to Open (Blame Katy Perry)
The Daily Newsstand · Free, Always
Saturday, October 10, 2026

Anthropic признала, что не может контролировать своих ИИ-агентов — поэтому им отключили интернет

Translate

логотип 3DNews

Опрос

реклама

Новости Software

Самое интересное в обзорах

10.10.2026 [17:21],

Anthropic призналась, что агенты искусственного интеллекта под управлением её моделей при выполнении задач эксплуатировали уязвимости на различных сайтах, в том числе принадлежащих правительственным учреждениям США. Компания приняла решение при проведении внутренних тестов отключить для этих систем доступ к интернету в реальном времени — ограничение будет снято, когда разработчики убедятся, что способны отслеживать действия ИИ-агентов.

Источник изображения: anthropic.com

Источник изображения: anthropic.com

О новых инцидентах компания рассказала в своём блоге. ИИ-агентам поручали решать задачи, предполагающие поиск информации в интернете. В процессе работы они эксплуатировали уязвимости ПО и бесплатно получали доступ к платным базам данных; для обхода ограничений они пользовались сервисами сокращения ссылок; и даже отправили в полицию Филадельфии выдуманные сведения по делу о нераскрытом убийстве. Эти инциденты Anthropic раскрыла в ходе анализа активности моделей, который начала в июле. Другими словами, у разработчиков не было полного представления о поведении собственных продуктов в реальном времени.

Существующих методов обучения согласованию целей для навыков поиска информации и работы с компьютером недостаточно, признала Anthropic; а эти навыки необходимы для того, чтобы ИИ-агентов можно было использовать в профессиональной деятельности. Ранее компания сообщала о выходе своих ИИ-агентов из-под контроля в тестовых средах; новые инциденты она охарактеризовала как «значительно менее серьёзные с точки зрения безопасности и согласования целей» по сравнению с прежними. Тем не менее, в лаборатории приняли решение «отключить доступ к интернету в реальном времени» при проведении «всех внутренних проверок», пока не возникнет уверенность, что ИИ-агентов можно контролировать.

Anthropic связывает подобное поведение, в частности, с недостатками обучающих сред, которые могут поощрять поиск лазеек и обход ограничений. Полная оценка выявленных случаев ещё не завершена. Некоторые виды тестирования Anthropic прекратит или переведёт в офлайн-режим; уже разработаны средства для выявления и блокировки такого поведения. При проверке на описанных случаях новые средства защиты заблокировали все соответствующие действия.

Какие доказательства убедят Anthropic вернуть системам тестирования прямой доступ в интернет, в компании не уточнили. Лаборатория намерена перевести своих ИИ-агентов в «централизованную управляемую инфраструктуру с надёжными механизмами изоляции» и начать активнее использовать классификаторы безопасности для их мониторинга.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.

View the original on 3DNews →

KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.