AI 기업 ‘최강 모델’ 전문가에 개방… 사이버 공격 전에 취약점 찾아낸다

민나리 기자
수정 2026-10-08 00:27
입력 2026-10-08 00:27
앤트로픽, 접근권 3단계 나눠 운영
미스트랄 ‘라지 4’ 佛정부 기관 제공
모의 침투·코드 분석 등 방어 강화
인공지능(AI)의 사이버 공격 능력이 빠르게 커지면서 AI 기업들이 최신 모델의 강력한 기능을 보안 전문가에게 먼저 열어주고 있다. 위험한 기능을 모두 막아두기보다 공격자가 악용하기 전에 방어자가 같은 능력으로 취약점을 찾아내게 하겠다는 전략이다.앤트로픽은 6일(현지시간) 보안 전문가를 대상으로 운영해온 프로그램을 확대한다고 밝혔다. 주요 소프트웨어·인프라 운영기관에 고성능 모델 ‘클로드 미토스’를 제공해 취약점을 찾게 한 ‘프로젝트 글래스윙’과, 검증된 보안팀에 오퍼스·소넷의 일부 제한을 풀어준 프로그램을 하나로 합친다. 접근권은 방어·레드팀·특수 등 3단계로 나눈다. 악성코드 분석부터 모의 침투, 전력·통신·금융망 같은 핵심 인프라 점검까지 허용 범위가 단계마다 다르다.
프랑스 미스트랄도 같은 날 비슷한 조치를 내놨다. 새 모델 ‘미스트랄 라지 4’를 오는 27일 오픈웨이트로 공개하기 전에 사이버보안 전문가와 정부기관에 먼저 제공한다. 이들에게는 일반 이용자보다 제한을 덜 건 모델을 제공해 공격·방어 능력을 시험하도록 한다. 오픈웨이트 모델은 공개되면 이용자가 직접 내려받아 자체 장비에서 돌릴 수 있어 개발사가 사용 방식을 계속 통제하기 어렵다.
AI 기업들이 보안 전문가에게 제한을 풀어주는 것은 최신 모델의 사이버 능력이 그만큼 커졌기 때문이다. 앤트로픽이 오퍼스 5.5에 모의 공격 과제 50건을 맡긴 결과 일반 이용 환경에서는 모두 첫 단계에서 막혔다. 보안 전문가용 레드팀 권한을 주자 34건은 공격 절차를 끝까지 수행했다. 같은 모델이라도 어떤 작업을 허용하느냐에 따라 할 수 있는 일이 크게 달라지는 셈이다. 방어에 활용했을 때의 성과도 적지 않았다. 글래스윙 참여기관들은 지난 4~7월 AI로 최소 12만 9000건의 소프트웨어 취약점을 찾아냈다. 이 가운데 3만 3000건 이상은 고위험 또는 치명적 수준으로 분류됐다. 앤트로픽이 강한 사이버 기능을 검증된 보안조직에도 열어주려는 근거다.
최근 국내 금융권 공격에 활용된 것으로 지목된 중국산 보안 에이전트 ‘ARTEX’도 AI의 이런 양면성을 보여준다. ARTEX는 자체 AI 모델이 아니라 GPT·클로드·딥시크 등을 불러 시스템 탐색이나 응용프로그램인터페이스(API) 호출 같은 작업을 이어가는 도구다. 국내 보안업계는 새로운 해킹 기법이라기보다 기존 탐색·반복 조회 등에 AI 자동화가 더해진 형태로 보고 있다. 공격에 드는 시간과 인력을 줄여 기존 수법을 더 빠르게 반복할 수 있게 했다는 것이다.
다만 방어 쪽은 사정이 조금 다르다. 고성능 모델의 고급 기능은 누구나 바로 쓸 수 있는 게 아니다. 삼성전자·SK하이닉스·SK텔레콤 등 국내 기업도 기존 글래스윙 참여사로 알려져 있지만 최신 모델을 실제 보안 업무에 어디까지 활용하고 있는지는 공개되지 않았다. 앤트로픽도 기관과 사용 목적을 심사해 접근 수준을 달리한다. 지난 6월에는 미국 정부의 수출통제로 국내 참여 기업의 미토스 접근이 한때 막혔다가 이후 규제가 풀리기도 했다.
민나리 기자
2026-10-08 B4면
에디터 추천 인기 기사
많이 본 뉴스