메타 AI도 멋대로 해킹…‘자율 AI’ 위험 현실 됐다

민나리 기자
수정 2026-08-07 00:59
입력 2026-08-07 00:59
코딩 에이전트 ‘뮤즈코드’ 공개 날
설정 실수 틈타 외부기관에 침입
앤트로픽·오픈AI에 이어 세 번째
오픈AI와 앤트로픽에 이어 메타의 인공지능(AI) 모델도 보안 시험 도중 외부 기관 시스템에 무단 침입한 사실이 확인됐다. 스스로 판단하고 행동하는 AI가 사람의 작은 설정 실수를 실제 해킹으로 이어지는 사례가 잇따르면서, 첨단 AI를 개발자가 제대로 통제할 수 있는지를 둘러싼 우려가 커지고 있다.메타는 5일(현지시간) 자사 코딩 특화 모델 ‘뮤즈스파크 1.1’이 독립 검증업체 이레귤러의 보안 시험 과정에서 외부 기관 한 곳의 시스템 취약점을 이용해 무단 침입했다고 밝혔다. 시험 환경의 설정 오류로 모델이 인터넷에 연결되자, 외부망에서 발견한 취약점을 실제 공격에 활용한 것이다.
AI가 격리 환경인 ‘샌드박스’를 스스로 빠져나간 것은 아니었다. 그러나 외부 시스템과 도구에 접근할 수 있는 AI가 사람의 실수로 통제 범위를 벗어나자 별도의 지시 없이 취약점을 찾아 침입까지 실행했다는 점에서 위험성이 드러났다. 단순한 설정 오류가 데이터 유출이나 시스템 침해로 확대될 수 있다는 우려도 커졌다. 메타는 해당 모델이 제3자 서비스의 취약점을 악용했으며 앞서 다른 AI 기업에서 보고된 사례와 유사한 방식이었다고 설명했다. 이레귤러도 정교한 해킹 공작이나 샌드박스 탈출은 아니며 현재 남아 있는 보안 문제도 없다고 밝혔다. 양사는 추가 조사 뒤 사고 경위와 재발 방지책을 담은 보고서와 백서를 공개할 예정이다.
비슷한 사고는 최근 몇 주 사이 오픈AI와 앤트로픽에서도 잇따랐다. 오픈AI의 GPT와 앤트로픽의 클로드 역시 보안 평가 과정에서 인터넷망 설정 오류를 틈타 외부 시스템에 무단 접근한 사실이 확인됐다.
이번 사고는 메타가 첫 AI 코딩 에이전트 ‘뮤즈코드’를 공개한 날 알려졌다. 마크 저커버그 메타 최고경영자(CEO)는 이날 엑스(X)를 통해 뮤즈코드 베타 버전 출시를 발표했다. AI 코딩 에이전트는 개발자의 질문에 코드만 제안하는 기존 챗봇과 달리 필요한 파일을 찾고 작업 계획을 세운 뒤 코드 작성과 수정, 시험·검증까지 수행한다.
뮤즈코드는 해킹 사고가 발생한 모델의 후속 버전인 ‘뮤즈스파크 1.2’를 기반으로 한다. 메타 자체 평가에서는 일부 항목에서 오픈AI 코덱스를 앞섰지만 앤트로픽 클로드코드에는 미치지 못했다. 메타는 대신 입력 토큰 100만개당 1.25달러, 출력 토큰 100만개당 4.25달러의 낮은 가격을 내세웠다. 알렉산더 왕 메타 AI 총괄은 일부 등급의 비용이 경쟁 제품보다 10배 이상 저렴하다고 밝혔다.
민나리 기자
2026-08-07 B3면
에디터 추천 인기 기사
많이 본 뉴스