Zhipu AI의 GLM-5.3는 취약점 발견부터 작동하는 익스플로잇 완성까지 자율 수행하는 역량을 갖췄으며, Anthropic 평가에서는 Claude Mythos Preview와 비슷한 수준의 결과를 보임 차이는 접근성과 안전장치에 있음. 누구나 가중치를 내려받을 수 있는 GLM-5.3는 우회 기법을 적용한 모의실험에서 유해 요청에 64~100% 응했지만, 안전장치가 적용된 Claude는 해당 작업을 수행하지 않음 전문가 연계 실험에서는 미공개 브라우저 취약점을 연결해 로컬 파일을 읽는 공격을 구현함. 더 작은 GLM-5.3-Flash도 공개된 취약점들을 연결해 ARM64 대상의 보호 기법을 우회하는 익스플로잇을 완성함 거부 동작 제거(abliteration) 를 적용하자 유해 요청 거부율이 크게 낮아졌지만, 측정한 과학 지식 및 사이버 역량은 대체로 유지됨 이러한 역량은 공격자뿐 아니라 방어자에게도 활용 가치가 있음. Anthropic은 방어자의 고성능 모델 접근 확대와 정부의 독립적인 안전성 평가가 필요하다고 봄 제한된 공개에서 누구나 접근 가능한 역량으로 Anthropic은 5개월 전 정교한 종단 간 사이버 익스플로잇을 자율적으로 개발하는 첫 모델인 Claude Mythos Preview를 Project Glasswing을 통해 제한적으로 공개함 유사한 역량이 다른 모델로 확산되기 전에 방어자에게 시간을 벌어주려는 조치였음 신뢰할 수 있는 방어자들은 이를 활용해 핵심 소프트웨어에서 1만 개 이상의 취약점을 발견함 중국 밖에서 Z.ai로 알려진 Zhipu AI의 GLM-5.3는 비슷한 익스플로잇 개발 역량을 갖췄지만, Anthropic은 악용을 제한할 실효성 있는 안전장치가 부족하다고 평가함 NIST 산하 CAISI는 9월 17일 발표한 평가에서 GLM-5.3를 지금까지 공개된 오픈웨이트 모델 중 사이버 역량이 가장 높은 모델로 평가함 CAISI 사이버 벤치마크 종합 기준으로 미국 최상위 모델보다 약 4개월 뒤처졌으며, Anthropic의 역량 평가도 대체로 일치함 다만 미국 모델은 해당되는 경우 사이버 안전장치를 끈 상태로 평가했고, 검증된 사용자에게만 공개된 모델도 비교에 포함함 공격자가 이러한 미국 모델 버전에 쉽게 접근할 수 없는 것과 달리, GLM-5.3는 누구나 내려받을 수 있음 익스플로잇 개발 벤치마크 결과 평가는 자동화 벤치마크와 전문가가 개입하는 작업 흐름을 함께 사용함 모든 모델은 격리된...
Related
LatticeDB - 그래프, 벡터, 전문 검색을 한 파일에 담는 임베디드 DB
54 minutes ago
0
SPA 자동화 테스트를 작성한 경험
1 hour ago
0
CoW - Wayland용 스태킹 윈도 매니저
1 hour ago
0
스태프 엔지니어를 위한 일감 발굴 가이드
1 hour ago
0
America.gov
2 hours ago
1
ChatGPT Pro 500
2 hours ago
1
AI, 데이터센터 투자 붐 정당화하려면 연 매출 6조 달러 필요
3 hours ago
2
PS5 Relapse 익스플로잇
3 hours ago
2
Tips
click
Popular
손흥민 선제골 발판·골대 불운…LAFC, 7경기 만에 승리
2 weeks ago
55
[르포] '더 똑똑해진 전동 칫솔' 다이슨, 카메라젯 첫 공개···AI 탑재로 또 한 번 혁신
4 weeks ago
44
OpenAI 에이전트들이 RubyGems에 공개되지 않은 공격을 수행함
2 weeks ago
44
© Clint IT 2026. All rights are reserved

1 hour ago
1





English (US) ·