Daily MaverickTrump says men arrested at UK air base used by US were looking to do ‘big damage’ESPN DeportesAmérica asume la iniciativa ante un Necaxa cautelosoInquirerLabor group assails P42 wage hike in Central VisayasESPNFollow live: Rams retake lead as Stafford finds Mumpfield for 48-yard TDThe Jerusalem PostHaifa International Film Festival opens with emotional tribute to Avi NesherPunchOyo 2027: CCII demands issue-based campaigns, decries name-callingالنهار"عملية فيفالدي"... أوكرانيا تفاجئ روسيا والمراقبين경향신문한라산 탐방시간 10월부터 단축···입산 마감 최대 3시간 당겨져New Straits TimesPenang, Johor, Selangor dominate Malaysia's RM354bil August tradeسكاي نيوز عربية"XRG" تُقر الاستثمار النهائي في حقل "أبشيرون" بأذربيجانDaily MailVMAs 2026 best dressed! Taylor Swift dazzles in shimmering gown as she leads the red carpet fashion parade alongside leggy Paris Hilton and scantily clad JoJo中国新闻网江苏队夺得2026年全国女子排球锦标赛冠军
The Daily Newsstand · Free, Always
Monday, September 28, 2026

오픈AI·앤트로픽, 보안 사고 수만 건 조사…‘통제 능력’ 의문

Translate
인공지능 기업 오픈에이아이(AI)와 앤트로픽의 로고. 로이터 연합뉴스
인공지능 기업 오픈에이아이(AI)와 앤트로픽의 로고. 로이터 연합뉴스

광고

앤트로픽과 오픈에이아이(AI)가 자사 인공지능 모델이 일으킨 수만 건의 보안 사고를 조사하고 있다. 인공지능 기업들이 자사의 기술을 완전히 통제할 수 있는지를 두고 의문이 제기되고 있다.

미 매체 액시오스는 27일(현지시각) 복수의 소식통을 인용해 앤트로픽과 오픈에이아이(AI)가 외부 평가자가 문제라고 판단할 만한 조처를 취한 수만 건의 사건을 조사하고 있다고 보도했다. 최근 수개월간 내부 테스트와 실제 환경에서 발생한 사고들의 압도적인 건수는 해결해야 할 문제가 외부에 알려진 것보다 수십에서 수백 배 더 복잡하며, 기업들이 자신들의 기술을 완전히 통제할 능력이 있는지에 대한 의문을 제기한다고 이 매체는 전했다.

사고들에는 가드레일 우회와 샌드박스(규제 유예 영역) 탈출, 웹사이트 탈취, 자신에게 명령(프롬프트 작성), 감시 시스템 우회 등이 포함되어 있었고 아직 대중에게 공개되지 않은 많은 사례가 있다고 소식통은 밝혔다. 이 사례들 가운데는 오픈에이아이의 인공지능 에이전트가 챗지피티(ChatGPT) 이용자의 이미지 53장을 외부에 게시한 사고나 호주 정부의 누리집 공격, 미국 정부 사이트 등에 대한 해킹 시도가 포함되어 있다.

광고

오픈에이아이 대변인은 최고 성능 모델에 대한 훈련을 일시 중단했다고 액시오스에 밝혔다. 대변인은 “추가적인 안전장치를 마련하고, 정렬에서 개선이 이뤄졌다는 확신이 들 때만 훈련을 재개할 것”이라고 말했다. 오픈에이아이는 외부의 제3자 안전 기구에 자사 인공지능 모델의 행동 검토를 의뢰한 상태다.

다만, 인공지능 모델의 심각한 문제 행동을 교정하고 통제할 수 있는가에 대해서는 의견이 갈리고 있다. 오픈에이아이 내부에선 수백 개의 인공지능 에이전트들이 합세해 외부 사이트를 해킹했던 허깅페이스 사건은 일회성으로, 현재는 제어 장치가 개선돼 이후에 벌어지는 사건들은 허깅페이스 사건처럼 심각하지 않을 것으로 보고 있다.

광고

광고

반면 한 주요 인공지능 기업의 보안 관련 임원은 인공지능이 인간이 생각지도 못한 방식으로 가드레일을 빠져나가는 경우가 많다며 “해야 할 일과 하지 말아야 할 일의 완벽한 목록을 만들려는 것은 헛된 노력일 가능성이 높다”고 말했다. 인공지능 안전 연구단체 트랜스루스(Transluce)의 콘래드 스토즈 연구원은 “우리가 본 것은 빙산의 일각에 불과하다”고 액시오스에 말했다.

View the original on 한겨레 →

KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.