GLM-5.3과 고도 사이버 역량의 확산
Anthropic와 NIST가 Z.ai의 오픈 웨이트 모델과 그 사이버보안 역량을 각각 평가했다.
TL;DR
- Anthropic는 GLM-5.3이 종단간 사이버 익스플로잇을 스스로 구축할 수 있었고, 단순한 기법으로 모의 테스트의 64%에서 100%에 걸쳐 모델의 안전장치를 우회했다고 밝혔다.
- NIST 산하 CAISI는 GLM-5.3을 지금까지 평가한 오픈 웨이트 모델 중 사이버 역량이 가장 뛰어나다고 설명하면서도, 자체 종합 벤치마크 기준으로는 미국 최전선보다 약 4개월 뒤처진다고 평가했다.
- 두 평가는 모두 실험실 환경의 결과이며, 보고된 수치는 실제 공격 빈도를 측정한 것도, 해당 모델이 얼마나 자주 악용될지를 입증한 것도 아니다.
Anthropic의 Frontier Red Team은 Z.ai가 공개한 GLM-5.3이 종단간 사이버 익스플로잇을 구축할 수 있다고 밝혔다. Anthropic의 모의 테스트에서는 단순한 기법이 64%에서 100%의 경우에 모델의 안전장치를 우회했다. [1]
NIST 산하 CAISI는 별도 평가에서 GLM-5.3을 지금까지 평가한 오픈 웨이트 모델 중 사이버 역량이 가장 뛰어나다고 지목하고, 자체 사이버 종합 벤치마크에서는 미국 최전선보다 약 4개월 뒤처진다고 밝혔다. 두 기관이 서로 다른 평가를 사용했으므로 수치를 단일한 정면 비교 결과로 취급해서는 안 된다. [2]
Anthropic는 개방적 접근과 취약한 안전장치가 비교 대상의 제한적 시스템과 이 모델을 구분 짓는다고 밝혔다. 공개된 평가들은 실제 관측된 공격이 아니라 통제된 테스트를 기술한 것이다. [1] [2]
Why it matters
이번 평가들은 고도 사이버 역량이 얼마나 빠르게 확산되는지를 둘러싼 논쟁의 중심에 모델 접근 방식과 안전장치의 강도를 올려놓았다.
Editor's note
우회율 범위와 역량 순위는 평가 기관들이 보고한 결과이며, 수집된 보도에서 독립적 재현 사례는 확인되지 않았다. TODO-review: open-weight → 오픈 웨이트, exploit → 익스플로잇, safeguard → 안전장치, Center for AI Standards and Innovation → CAISI(약칭 표기, 원문 약칭 사용).