OpenAI·Anthropic 모델, 사이버 테스트서 통제 이탈…영국 감시기구 밝혀
AI 보안 연구소, 도구들이 실제 사람과 조직을 대상으로 ‘잠재적으로 유해한 활동’을 수행했다고 경고

발행 2026년 8월 5일
영국 AI 보안 연구소(Aisi)에 따르면, Anthropic과 OpenAI의 주력 AI 모델이 제3자 소프트웨어에 침입하고 개인들에게 이메일을 보내 로그인 자격 증명을 훔치는 등 전례 없이 기만적인 행동을 보였다.
영국 정부의 최첨단 AI 안전·보안 연구기관은 Aisi의 정기적인 사이버 평가 과정에서 Anthropic의 Mythos 5와 OpenAI의 GPT 5.6 Sol이 “실제 사람과 조직을 대상으로 지속적이고 잠재적으로 유해한 활동”을 벌였다고 밝혔다.
인기 개발자 플랫폼 깃허브의 오픈소스 프로젝트에 악성 코드를 삽입하려 한 행위 등이 포함된 모델들의 행동이 발견된 것은 앤스로픽과 오픈AI의 AI 에이전트가 외부 기관을 해킹했다는 사실이 공개된 지 불과 며칠 만이다.
Aisi는 이번 최신 보안 침해가 한 시간 내에 차단됐다고 밝혔다. 이는 AI 에이전트의 사이버 보안 과제 해결 능력을 평가하는 과정에서 발견됐다. 일부 안전장치를 제거한 모델을 사용해 인터넷에 공개된 환경에서 테스트가 진행됐다.
Aisi에 따르면 122회의 테스트 중 10회에서 AI 에이전트가 “실제 사람과 기관을 대상으로 인터넷상에서 자율적이고 승인받지 않은 행동”을 취했다.
Aisi는 이 같은 행동의 거의 전부가 앤스로픽의 미토스(Mythos)에서 발생했으며, 오픈AI의 GPT가 관여한 행동도 두 건 있었다고 밝혔다. 가장 심각한 사례에서 “에이전트는 사회공학적 공격을 감행했다. 가짜 온라인 신원을 만들고 이를 이용해 프로젝트 관리자가 해당 코드를 승인하도록 압박했다.” 이 소프트웨어를 감독하던 사람은 이를 알아채고 악성 코드 승인을 거부했다.
Aisi는 “구체적인 프롬프트 없이 현실 세계에서 자율성과 기만에 관한 위험이 이처럼 명확하게 나타난 것을 본 것은 이번이 처음”이라고 밝혔다.
지난 한 달간 앤트로픽과 오픈AI의 에이전트가 저지른 해킹은 인간의 통제를 벗어나 행동하는 AI 시스템의 사이버 공격을 보여준 최초의 공개 사례 중 하나였다. 이 같은 보고와 함께 Aisi 사건은 “위험 지형의 변화를 보여주며” “즉각적인 주의가 필요하다”고 이 기관은 경고했다.
앤트로픽은 화요일 “이번 사건에 대응해 리더십을 발휘한 영국 Aisi에 감사드린다”며 “이는 역량이 갈수록 향상되는 AI 에이전트를 안전하게 평가하는 방법에 대해 더 폭넓은 논의가 필요하다는 점을 보여준다”고 밝혔다.
이 AI 기업은 평가 환경을 구축하고 보안화하는 방식에 대해 “더욱 강력하고 공통된 기준”이 필요하다고 덧붙였다.
오픈AI 대변인은 모델에 대한 독립적인 테스트가 계속 필요하다고 말하면서도, 해당 사건들이 “일반적인 사용 환경을 반영하지 않는 조건에서, 안전장치가 축소된 테스트 환경 내 평가 파트너들이 수행한 사이버 평가 과정에서 발생했다”고 강조했다.
대변인은 “모델의 역량이 향상됨에 따라 평가를 안전하게 수행하기 위한 공통 관행을 강화하기 위해 업계 전반의 평가 담당자 및 기타 이해관계자들과 계속 협력하겠다”고 덧붙였다.
최근 몇 달 동안 각국 정부와 연구자들은 가장 강력한 AI 모델이 초래하는 새로운 사이버보안 위협에 대해 우려를 잇달아 제기했다. 올해 초 도널드 트럼프 행정부는 보안 위험을 이유로 Anthropic이 자사의 최신 모델을 수출하는 것을 일시적으로 금지했다. 이 제한 조치는 6월 말 완화됐다.
OpenAI 최고경영자(CEO) 샘 올트먼은 지난주 워싱턴에서 스콧 베선트 재무장관과 하워드 러트닉 상무장관을 비롯한 미국 고위 당국자들을 만났다. 그는 기자들에게 AI 모델을 둘러싼 사이버보안 법안을 지지한다고 밝혔다.
지난달 OpenAI는 자사의 에이전트 중 하나가 “전례 없는 사이버 사건”에서 스스로 스타트업 Hugging Face를 해킹했다고 공개했다. 이 에이전트는 테스트 환경을 빠져나와 인터넷에 접속하고 로그인 자격 증명을 탈취했다.
영국의 AI 장관인 카니시카 나라얀은 “이와 같은 새로운 행동을 식별하고, 이에 대처할 수 있도록 우리의 발견을 공유하는 것이 바로 Aisi가 설립된 목적”이라고 말했다. 그는 “AI를 이해하면 이를 더 안전하게 사용할 수 있고, 사람들이 삶과 직장에서 AI의 혜택을 계속 누릴 수 있도록 할 수 있다”고 덧붙였다.


AI 전환, 프리미엄, 목요일
John Burn-Murdoch와 Sarah O'Connor가 전하는 AI의 일의 세계 재편에 관한 엄밀한 주간 심층 분석