Z.ai·콘코디아 AI 공동 보고서… 배포 후 모니터링 불가한 오픈 웨이트 특성상 '개발 상류' 통제 필수
위험 식별·임계값·분석·평가·완화·거버넌스 6단계 수립… 美 독점형 모델 맞선 신뢰성 승부수
오픈AI 에이전트 해킹 사태로 차세대 학습 중단 속 中 샤오미 학습 생중계 등 투명성 차별화 가속
위험 식별·임계값·분석·평가·완화·거버넌스 6단계 수립… 美 독점형 모델 맞선 신뢰성 승부수
오픈AI 에이전트 해킹 사태로 차세대 학습 중단 속 中 샤오미 학습 생중계 등 투명성 차별화 가속
이미지 확대보기오픈AI나 앤트로픽 같은 미국 빅테크의 독점형(Closed-source) AI와 달리, 오픈 웨이트 모델은 인공지능의 두뇌에 해당하는 학습 파라미터를 누구나 자유롭게 다운로드하고 파인튜닝(미세조정)할 수 있어 제작자가 배포 이후의 오용을 사후 통제하기가 사실상 불가능하다.
이러한 구조적 맹점을 극복하기 위해 중국 대표 AI 유니콘과 안전 전문 연구기관이 손을 잡고, 모델 설계 및 훈련 데이터 수집이라는 초기 '상류(Upstream)' 단계에서부터 위험을 걸러내는 6단계 생애주기 관리 프레임워크를 정립하고 나섰다.
9월 29일(현지시각) 홍콩 영자 일간지 사우스차이나모닝포스트(SCMP) 보도에 따르면, 중국의 유력 파운데이션 모델 개발사인 Z.ai(즈푸AI)와 베이징 소재 글로벌 안전 컨설팅 기관 콘코디아 AI(Concordia AI)는 공동 연구를 통해 '프런티어 오픈 웨이트 AI 위험 관리 프레임워크' 보고서를 공식 발표했다.
배포 후 통제권 상실하는 오픈 웨이트… "사전 학습 데이터 선별이 최후의 방어선"
오픈 웨이트 모델은 인터넷 이용자 누구나 독립된 서버에서 모델을 실행하고 코드를 뜯어고칠 수 있어 기술 민주화와 비용 절감의 핵심 동력으로 꼽히지만, 악의적인 해커나 적대 세력이 안전 가이드라인을 강제로 해제(탈옥)할 경우 생화학 무기 제조나 사이버 테러에 무방비로 악용될 수 있다는 치명적 한계를 안고 있다.
보고서는 제작자가 모델을 공개하는 순간 사후 모니터링이나 원격 차단 권한을 영구히 상실한다는 점을 명시하며, 모든 안전 점검 절차를 개발 초기 단계로 전진 배치해야 한다고 지적했다.
이를 위해 보고서가 제시한 6단계 관리 체계는 위험 식별, 안전 임계값 설정, 취약점 분석, 정량 평가, 사전 완화, 거버넌스 관리로 구성되어 있다.
특히 저자들은 이 중에서도 '훈련 데이터셋 정제(Data Screening)'를 가장 강력하고 필수적인 방어 수단으로 지목했다.
모델이 사전 학습을 진행하기 전에 화학·생물학적 위험 정보, 악성 소프트웨어 코드, 극단주의 콘텐츠 등 유해 데이터를 선제적으로 걸러내어 인공지능 시스템이 위험 지식을 원천적으로 학습하지 못하도록 차단해야 한다는 설명이다.
오픈AI 모델 폭주로 학습 중단 충격… 美 '블랙박스' vs 中 '투명성' 차별화
이번 보고서는 글로벌 빅테크들이 차세대 자율형 AI(에이전트)의 위험성 통제에 극심한 난항을 겪고 있는 시점에 발표되어 더욱 큰 주목을 받고 있다.
실제로 지난 26일 미국 오픈AI는 차세대 독점 모델 개발 과정에서 자율 에이전트가 통제를 벗어나 외부 컴퓨터 시스템을 임의로 해킹하고 예측 불가능한 이상 동작을 일으킨 사건이 발생하자 해당 모델의 사전 학습을 전격 중단한 바 있다.
반면 중국 테크 기업들은 모델 개발 과정을 대중에 공개하는 전례 없는 '투명성 승부수'를 던지며 미국식 폐쇄주의와 각을 세우고 있다.
지난주 샤오미는 자사의 차세대 모델 'MiMo-V2.6'의 강화학습 과정을 유튜브 등 온라인 플랫폼을 통해 실시간 라이브 스트리밍으로 전 세계에 생중계했다.
수백만 달러의 컴퓨팅 연산 비용, 학습 실패 로그, 학습 데이터의 혼합 비율을 실시간 대시보드로 가감 없이 공개함으로써 미국 기업 특유의 불투명한 '블랙박스'식 관행과 정면으로 차별화를 시도했다.
한편 Z.ai는 자사의 코딩 보조 도구 'ZCode'가 사용자 동의 없이 로컬 작업 데이터를 외부 서버로 전송했다는 논란이 일자 공식 사과와 함께 코드베이스 전체를 오픈소스로 전환하고 제3자 보안 감사를 수용하기로 했다.
이러한 기업들의 자정 조치는 지난 9월 14일 중국 정부가 국가 차원의 'AI 안전 거버넌스 프레임워크'를 발표하며 엄격한 안전 프로토콜과 다자간 국제 협력을 요구한 정책 기조와 정확히 맞물려 있다.
성능 앞서는 중국산 오픈소스… 美 '금지령 검토' 속 기술 패권 분수령
오픈 웨이트 모델은 이제 미·중 기술 패권 전쟁의 핵심 전장으로 부상했다.
최근 샌프란시스코의 공신력 있는 AI 벤치마크 기관 아티피셜 애널리시스(Artificial Analysis) 인텔리전스 지수에서 문샷AI의 '키미 K3(Kimi K3)'를 비롯해 샤오미의 'MiMo-V2.6-Pro', 알리바바의 '통이첸원 3.8-맥스(Qwen3.8-Max)', Z.ai의 'GLM-5.3' 등 중국산 오픈 웨이트 모델들이 미국의 폐쇄형 유료 모델들과 대등하거나 이를 능가하는 평가를 잇달아 획득했다.
중국산 오픈소스 AI의 가격 경쟁력과 성능이 서방 시장을 빠르게 잠식하자, 미국 백악관은 안보 위협을 이유로 외국산 오픈소스 모델의 미국 내 다운로드 및 사용을 금지하는 방안을 검토하기 시작했다.
그러나 이에 대해 엔비디아, 구글, 오픈AI 등 미국 테크 기업 연합은 백악관에 서한을 보내 견고한 오픈소스 생태계야말로 미국의 AI 리더십을 지키는 근간이라며 전면 금지에 강력히 반대했다.
메타의 마크 저커버그 CEO 역시 외국산 모델을 인위적으로 차단하기보다 미국 자체 모델의 경쟁력을 높이는 데 집중해야 한다며 규제 움직임에 제동을 걸었다.
중국이 오픈 웨이트 모델의 고질적 약점인 '안전성'과 '무기화' 우려에 대해 체계적인 6단계 선제 방어 가이드라인을 선점해 제시함에 따라, 향후 글로벌 AI 생태계의 표준 규범과 소프트웨어 주도권을 둘러싼 미·중 간의 주도권 다툼이 한층 치열해질 전망이다.
신경원 글로벌이코노믹 기자 shincm@g-enews.com

































