‘전례 없는’: OpenAI는 AI 모델이 자율적으로 다른 회사를 해킹했다고 밝혔습니다.

0
7

ChatGPT 제조업체는 자율 에이전트가 통제된 테스트를 탈출하여 AI 회사인 Hugging Face의 서버에 액세스했다고 밝혔습니다.

‘전례 없는’: OpenAI는 AI 모델이 자율적으로 다른 회사를 해킹했다고 밝혔습니다.
OpenAI의 공동 창립자이자 CEO인 Sam Altman [File: Sean Gallup/Getty]

ChatGPT 창시자인 OpenAI는 자사의 가장 진보된 인공 지능 모델 중 두 개가 통제된 테스트에서 벗어나 다른 AI 회사를 해킹했다고 밝혔습니다.

OpenAI는 화요일 자사 모델의 사이버 능력을 테스트하기 위한 내부 훈련 중에 ‘전례 없는 사이버 사건’이 발생했다고 밝혔습니다.

대신 AI 모델로 구동되는 자율 에이전트(새로 출시된 GPT 5.6 Sol과 아직 출시되지 않은 “더욱 강력한” 모델)가 테스트 환경을 벗어나 개방형 인터넷에 도달했습니다. 그런 다음 훔친 로그인 정보를 사용하여 Hugging Face 서버에 액세스하기 위해 이전에 알려지지 않은 보안 결함을 발견했다고 회사는 말했습니다.

OpenAI는 이번 해킹이 에이전트가 테스트 목표를 충족하는 데 도움이 되는 정보를 검색하기 위해 “극단적인 노력”을 펼쳤다고 주장합니다.

허깅페이스(Hugging Face) 공동 창업자인 클레멘트 델랑그(Clement Delangue)는 회사가 공격의 배후에 첨단 연구실이 있다고 의심했으며 OpenAI 측에 악의적인 의도가 없다고 믿었다고 말했습니다.

“이 모든 일이 자율적으로 일어났다는 사실이 정말 놀랍습니다!” 그는 “이런 종류의 첫 번째 사건이 될 수도 있다”고 덧붙였습니다.

텍사스주 미국 하원의원 민주당 의원인 그렉 카사르(Greg Casar)는 이번 사건을 “놀라운 일”이라고 불렀습니다.

그는 “AI는 우리를 안전하게 지켜줄 실질적인 규제 없이 매우 빠르게 발전하고 있다”며 독립적인 안전 테스트 의무화, 보안 사고 공개 의무화, 국제 협력을 촉구했다.

이번 공개는 도널드 트럼프 미국 대통령이 가장 발전된 AI 시스템이 공개되기 전에 국가 안보 위험을 조사하기 위한 프레임워크를 만드는 행정 명령에 서명한 지 몇 주 후에 나온 것입니다.

광고

전문가들은 AI 기반 사이버 공격과 인간의 통제를 벗어나는 모델에 대해 반복적으로 경고를 울려 왔습니다. 지난달 AI 개발자인 Anthropic은 업계에 가장 강력한 시스템의 개발을 중단할 것을 촉구했습니다.