AI의 거친 미개척 영역 길들이기
가장 첨단의 시스템이 이를 안전하게 유지하려는 노력보다 더 빠르게 진화하고 있다

2026년 8월 8일 발행
최첨단 AI가 통제를 벗어나고 있다. 앤스로픽과 오픈AI의 AI 에이전트가 외부 조직을 해킹했다는 사실이 처음 공개됐다. 이어 이번 주에는 영국 AI 안전연구소가 충격적인 보고서를 내놓았다. 두 회사의 주력 모델이 가짜 신원을 이용해 코드 검토를 우회하고 제3자 개발자 플랫폼에 침입했으며, 전례 없는 기만 행태를 보였다는 내용이다. 이는 단순히 테스트 절차의 허점을 악용한 것 이상의 문제다. 최첨단 AI 모델이 텍스트 생성 수준을 넘어 고도의 역량을 갖춘 자율적 행위자가 됐으며, 이들을 안전하게 통제하기 위한 노력보다 더 빠르게 진화하고 있음을 보여준다.
앤스로픽의 클로드 미토스 프리뷰가 ‘디지털 감옥’에서 탈출해 화제가 된 지 불과 4개월밖에 지나지 않았다. 업계 일각에서는 처음에 이 사건과 최근 앤스로픽 및 오픈AI의 다른 모델들이 탈출한 사건들이 최신 기술의 능력을 과시하기 위한 마케팅 수단이라고 의심했다.
그러나 이번 주 경고를 내놓은 곳은 해당 기업들이 아니라 영국의 안전성 연구소였다. 연구소는 사이버 평가 과정에서 앤스로픽의 미토스 5와 오픈AI의 GPT-5.6 솔이 “지속적이고 잠재적으로 유해한 활동”을 벌였다고 보고했다. 다만 일부 독립 전문가들은 이 평가가 지나치게 허용적인 테스트 환경에서 이뤄졌다고 지적했다. 미토스 5는 GitHub 플랫폼의 오픈소스 프로젝트에 악성 코드를 삽입하려 했으며, 인간 검토자들이 이를 승인하도록 압박하기 위해 온라인상에서 가짜 신원을 만들었다.
미국 대형 AI 연구소들이 추구하는 궁극의 목표인 인공일반지능(AGI), 즉 인간 수준의 인지 능력은 기술적 정의에 따라 여전히 몇 년은 더 걸릴 수 있다. 하지만 많은 사람은 최신 모델의 추론·계획·기만 능력이 인간 수준에 가까워지고 있다고 느낄 것이다. 이번 주 AI를 이용해 자연계에 존재하지 않는 바이러스를 만들어냈다는 소식은 이 기술의 잠재력과 위험을 더욱 분명히 보여줬다.
이는 연구소들 스스로 시스템을 개발·보안 유지·감시하는 방식에 더욱 신중을 기하고, 관련 노력에 대해 적절한 감사를 실시해야 한다는 책임을 부여한다. 테스트 환경도 개선할 필요가 있다. 포괄적이고 과도한 AI 규제는 피해야 하지만, 최근 사건들은 최첨단 모델에 출시 전 의무 안전 점검이 필요하다는 점을 분명히 보여준다.
당초 AI ‘안전’ 정책을 미국의 혁신을 가로막는 장애물이라며 경시했던 트럼프 백악관은 뒤늦게 따라잡기에 나섰다. 백악관은 이번 주 미국의 거대 AI 기업들과 회의를 열고, 개발사들이 최첨단 AI 시스템을 일반에 출시하기 30일 전에 연방 안전 전문가들에게 접근 권한을 제공하는 내용의 계획된 프레임워크를 제시했다. 다만 명목상 자율 참여 방식이다.
아이러니하게도 많은 업계 지도자들은 자사의 모델이 재앙적 사건을 일으킬 경우 발생할 잠재적 법적 책임을 인식하고 있어 미국 행정부의 제안보다 더 강력한 조치를 선호한다. 구글 딥마인드 경영 일선에서 물러나 회장직을 맡게 되는 데미스 허사비스는 연방정부가 감독하는 민관 연합을 촉구했다. 그가 제안한 ‘프론티어 AI 표준기구’는 업계의 자금 지원을 받아 사이버 보안부터 생물학적 또는 핵 위협에 이르는 위험을 대상으로 출시 전 테스트를 실시하게 된다.
AI 분야를 선도하는 기업들을 보유한 미국이 초기 안전 확보 노력을 주도하는 것은 불가피하다. 그러나 효과적인 통제를 위해서는 빠른 시일 내 국제 협력이 필요해질 것이다. 중국의 오픈소스 AI 모델들이 역량 면에서 따라잡고 있기 때문이다. 이처럼 민감한 기술을 둘러싼 미·중 협력은 무리하게 들릴 수 있지만, 시진핑 중국 국가주석이 9월 워싱턴을 방문할 것으로 예상되는 가운데 양국은 AI 안전 및 보안 문제를 논의할 예정이다. 냉전 시대에도 미국과 소련, 그리고 다른 핵보유국들은 핵무기 기술을 둘러싸고 경쟁하면서도 결국 무기 위험을 억제하기 위한 협력을 시작했다. 최첨단 AI에서도 비슷한 일이 일어나려면, 핵무기의 경우 수년이 걸렸던 과정을 수개월로 단축해야 한다.

FT 오피니언, 평일마다
최고 논평가들의 날카로운 통찰과 현명한 판단을 만나보세요