오픈AI(OpenAI)는 자사 기술로 구동되는 자율 AI 에이전트가 테스트 도중 난동을 부리고 오픈 웹에 접속해 유력 스타트업 자체를 해킹하는 ‘전대미문의 사건’을 일으켰다고 밝혔다.
ChatGPT를 운영하는 회사는 스타트업 Hugging Face가 시스템에 진입한 에이전트(사람의 도움 없이 작업을 수행하도록 설계된 AI 도구)를 감지하고 격리했다고 밝혔습니다.
“우리는 이번 사건을 최첨단 사이버 역량이 관련된 전례 없는 사이버 사건으로 간주합니다.” 오픈AI가 말했다..
회사는 챗봇, 에이전트 등 AI 도구의 기반이 되는 기술인 모델의 역량이 향상됨에 따라 이러한 유형의 사고가 더욱 일반화될 것으로 예상한다고 밝혔습니다.
OpenAI는 공개된 최신 모델의 조합으로 구동되는 에이전트를 통해 해킹이 발생했다고 밝혔습니다. GPT-5.6 지상아직 출시되지 않은 훨씬 더 효율적인 모델입니다.
샌드박스라고 불리는 폐쇄형 디지털 랩에서 내부적으로 해킹 능력을 테스트하는 동안 모델은 이전에 발견되지 않은 취약점을 찾아 개방형 인터넷 액세스(효과적인 탈출 경로)를 얻었습니다.
그런 다음 에이전트는 해킹 평가를 통과하는 데 도움이 되는 기술을 찾기 위해 AI 모델 데이터베이스인 Hugging Face를 해킹했습니다. OpenAI는 이 모델이 “평가를 속이는 데 사용할 수 있는 비밀 정보에 액세스하는 방법을 찾았습니다”라고 말했습니다. Hugging Face의 보안팀과 자체 AI 에이전트가 악의적인 활동을 발견하고 중지하면서 공격은 종료되었습니다.
Hugging Face의 최고 경영자인 Clément Delangue는 이번 공격이 “놀라웠다”고 말했지만 OpenAI 측에서는 “악의적인 의도”가 없었다고 믿고 있습니다.
그는 X에 “우리는 요원의 정교함을 고려할 때 지난주 사이버 공격이 국경 연구소에서 나왔을지도 모른다고 의심했다”고 썼다.
알 수 없는 컴퓨터 취약점에 대한 용어는 개발자가 문제를 해결할 시간이 없기 때문에 제로데이 취약점입니다. 지난 4월 OpenAI의 경쟁자인 Anthropic은 자사의 Mythos 모델을 발표했습니다. 수천 개의 결함을 발견했습니다.
뉴스레터 프로모션 이후
Mythos의 Zero Day 위치 파악 및 활용 능력이 밝혀지자 미국 정부는 Mythos와 그 자매 모델인 Fable 5의 수출을 제한했지만 이후 금지 조치를 해제했습니다. GPT-5.6 Sol에는 유사한 제한이 있었지만 이후 전 세계적으로 출시되었습니다.
그렉 카사르(Greg Casar) 미국 민주당 하원의원은 이번 사건이 매우 우려스럽다고 말했습니다.
그는 성명에서 “AI는 우리를 안전하게 지켜줄 실질적인 규제 없이 매우 빠르게 발전하고 있다”며 “완화되지 않은 재난으로부터 사람들을 보호하기 위해” 독립적인 보안 테스트 의무화, 보안 사고 공개 의무화, 국제 협력 등을 촉구했다.




