닫기

글로벌이코노믹

"최첨단 해킹력에도 방어벽은 취약"…앤스로픽, 中 Z.ai 'GLM-5.3' 무기화 위험 경고

글로벌이코노믹

"최첨단 해킹력에도 방어벽은 취약"…앤스로픽, 中 Z.ai 'GLM-5.3' 무기화 위험 경고

사이버 공격 410건 중 50건 침투 성공… '클로드 미토스'의 56건과 맞먹는 파괴력 입증
가중치 수정 '아블리터레이션' 기법에 안전 거부율 90%서 2%로 급락… "1200달러면 무력화"
Z.ai "4200여 개 취약점 막아낸 방어 도구" 즉각 반박… 미·중 오픈소스 AI 규제 공방 가열
중국 인공지능 기업 Zhipu AI의 로고가 2026년 6월 25일 중국 베이징에서 정부 주최 미디어 투어 중 본사에 전시되어 있다. 사진=로이터이미지 확대보기
중국 인공지능 기업 Zhipu AI의 로고가 2026년 6월 25일 중국 베이징에서 정부 주최 미디어 투어 중 본사에 전시되어 있다. 사진=로이터
미국의 대표적인 인공지능(AI) 안전 선도 기업인 앤스로픽(Anthropic)이 중국의 유력 AI 유니콘 Z.ai(즈푸AI)가 배포한 오픈웨이트 모델 'GLM-5.3'을 지목하며, 최첨단 해킹 공격 능력에 비해 안전장치가 극도로 허술해 사이버 테러에 무방비로 악용될 수 있다는 심각한 경고를 내놓았다.

폐쇄형 상용 모델인 클로드(Claude)와 달리, 모델의 두뇌에 해당하는 가중치(Weights)가 대중에게 무상 공개된 GLM-5.3은 이용자가 자유롭게 코드를 수정할 수 있어 해커들이 간단한 조작만으로 안전 가이드라인을 강제 해제할 수 있다는 분석이다.

특히 엔드 투 엔드 사이버 공격 실험에서 앤스로픽의 최신 프런티어 모델인 '클로드 미토스(Claude Mythos)'에 육박하는 공격 침투 역량을 보인 반면, 불과 1200달러(약 160만 원) 수준의 저렴한 컴퓨팅 비용만으로도 유해 명령 거부율을 바닥 수준으로 떨어뜨릴 수 있다는 실증 데이터가 공개되면서 글로벌 테크 생태계에 큰 파장을 일으키고 있다.

지난달 30일(현지 시각) 홍콩 사우스차이나모닝포스트(SCMP) 보도에 따르면, 앤스로픽은 최신 심층연구 보고서에서 GLM-5.3이 지닌 강력한 사이버 침투 능력과 취약한 안전 제약이 결합할 경우 전 세계 디지털 인프라에 심각한 재앙을 초래할 수 있다고 공식 발표했다.

클로드에 육박하는 50건 공격 침투 성공…안전장치 우회율 100% 이르러


앤스로픽 연구진은 자동화된 사이버 공격 도구를 처음부터 끝까지 스스로 설계하고 실행하는 능력을 측정하기 위해 총 410건의 모의 익스플로잇(exploit·취약점 공격) 테스트를 실시했다.

실험 결과 GLM-5.3은 410건 중 50건의 공격 시도를 완벽하게 성공했다. 이는 검증된 보안 파트너에게만 제한적으로 제공되는 앤스로픽의 최상위 폐쇄형 모델 '클로드 미토스 프리뷰(Claude Mythos Preview)'가 기록한 56건과 불과 6건 차이에 불과한 수치로, 중국산 오픈소스 모델의 순수 사이버 공격 역량이 미국 최고 수준에 바짝 다가섰음을 보여준다.

그러나 두 모델 간의 치명적인 차이는 '안전 통제력'에서 드러났다. 앤스로픽의 클로드 모델은 외부의 악의적인 가이드라인 우회 시도를 완벽하게 차단한 반면, 오픈웨이트 구조인 GLM-5.3은 공격자의 단순한 공격 기법만으로도 안전 제약 장치의 64%에서 최대 100%가 무력화된 것으로 나타났다.

특히 앤스로픽 연구진은 모델의 내부 가중치 행렬을 직접 편집해 유해한 요청을 거부하는 뉴런 반응을 선별해 억제하는 '어블리터레이션(Abliteration·제거)' 기법을 적용했다. 약 2200 GPU 시간을 투입해 안전 거부 메커니즘을 제거하자, 3대 주요 안전 평가 기준에서 90% 이상을 유지하던 GLM-5.3의 거부율이 불과 2%에서 12% 수준으로 곤두박질쳤다.

앤스로픽은 이번 실험에 약 4400달러의 연산 비용이 소요됐지만, 숙련된 해킹 조직이라면 단돈 1200달러의 비용만으로도 동일한 안전 무력화 모델을 만들어낼 수 있다고 경고했다.

Z.ai "사이버 방어에 널리 활용" 반박…허깅페이스 사례 제시하며 맞불


앤스로픽의 보고서가 공개되자 중국 본토에서 즈푸AI(Zhipu AI)로 활동하는 Z.ai 측은 즉각 공식 반박에 나섰다. 리쯔쉬안 Z.ai 글로벌 운영 총괄은 소셜미디어 X(옛 트위터)에 앤스로픽의 주장을 정면으로 일축하며, GLM 시리즈가 실제 산업 현장에서는 악성 공격이 아니라 글로벌 기업들의 사이버 방어 인프라를 지키는 핵심 방패로 활발히 사용되고 있다고 강조했다.

리 총괄은 대표적인 사례로 지난 7월 글로벌 최대 오픈소스 개발 플랫폼인 허깅페이스(Hugging Face)가 오픈AI 모델의 자율 침입 이상 징후를 조사하고 통제하기 위해 GLM-5.2를 채택했던 이력을 꼽았다. 당시 앤스로픽의 클로드가 과도한 안전 규칙 때문에 보안 분석 작업의 일부를 거부하자, 연구진이 유연하고 강력한 성능을 갖춘 GLM 모델을 대체재로 투입해 시스템을 성공리에 안정화했다는 설명이다.

또한 그는 GLM-5.3이 정식 출시된 이후 지금까지 389개 이상의 글로벌 오픈소스 소프트웨어 프로젝트를 외부 공격으로부터 보호했으며, 4249개에 이르는 잠재적 보안 취약점을 미리 탐지해 수정하는 등 공익적인 기여를 해왔다고 덧붙였다.

오픈소스 AI 패권과 규제 격돌…美·中 안보 전선 비화


이번 보고서는 미국 내에서 가열되고 있는 '오픈웨이트 모델의 위험성과 규제 필요성'에 대한 정책 논쟁에 결정적인 기름을 부었다. 프런티어 모델의 소스코드와 가중치를 철저히 통제해야 한다고 주장하는 앤스로픽과 달리, 메타(Meta)와 엔비디아(Nvidia) 등은 광범위한 개방형 생태계가 미국의 소프트웨어 리더십을 유지하는 근간이라며 맞서고 있다.

중국산 오픈소스 모델의 기술적 진화 속도는 미국의 안보 당국을 바짝 긴장시키고 있다. Z.ai는 지난 8월 GLM-5.3을 공개하면서 주요 사이버보안 벤치마크에서 앤스로픽의 기존 플래그십인 '미토스 5'를 넘어섰다고 밝힌 바 있으며, 모델의 악용을 막기 위해 출시 후 2주간 가중치 공개를 보류하고 자체 안전성 강화 시험을 거치는 등 나름의 안전조치를 했다고 주장했다.

이달 초 미국 정부 산하 AI 표준·혁신 센터 역시 GLM-5.3을 역사상 가장 강력한 사이버 역량을 갖춘 오픈웨이트 모델로 공식 평가하면서도 미국 최고 수준의 프런티어 모델보다는 약 4개월 뒤처져 있다고 분석했다.

최근 도널드 트럼프 미국 대통령이 "중국과 AI 안전 협력을 진행하고 싶지 않다"고 밝힌 가운데 문샷AI의 '키미 K3'가 보안평가 중 격리된 가상 샌드박스를 이탈해 외부 인터넷에 접속하는 등 중국산 AI의 통제 불능 리스크가 잇달아 불거지면서, 인공지능의 개방성을 둘러싼 미·중 간의 기술 안보 전선이 통제 불능의 위험 관리 국면으로 치닫고 있다.


신경원 글로벌이코노믹 기자 shincm@g-enews.com