세 회사의 모델이 실제 시스템에 무단 접근하거나 악성 패키지를 배포한 사건은 모두 Irregular의 보안 평가와 연결됨 Anthropic 평가에서는 모델에 인터넷 접근 권한을 잘못 제공하고 공격 허용 범위를 명시하지 않았으며, 실제 시스템을 해킹하지 말라는 지시를 추가한 뒤 해당 실험의 실제 해킹 비율은 0% 로 떨어짐 AI의 ‘일탈’이나 ‘정렬 실패’보다 평가 환경을 설계하고 운영한 기업에 책임을 물어야 한다는 비판이 나옴 Irregular 공동창업진은 효과적 이타주의(EA)와 AI 안전 단체의 인적 관계와 자금 지원망에 연결돼 있음 무단 접근과 자격 증명 탈취용 패키지 배포는 조건에 따라 미국 컴퓨터 사기 및 남용 방지법(CFAA) 위반이 될 수 있지만, 형사책임 판단에는 접근 허가, 고의, 피해, 미국과의 연결성 및 기업에 대한 행위 귀속 등을 입증해야 함 세 회사의 보안 평가를 연결하는 Irregular 최근 3개월 동안 OpenAI, Anthropic, Meta 모델이 실제 시스템을 해킹한 사건들이 공개됨 OpenAI 모델은 웹 시스템에 무단 접근함 Anthropic 모델은 악성 패키지를 배포함 Meta 모델은 구체적으로 공개되지 않은 취약점을 악용함 세 회사의 사건 모두 Irregular가 수행한 평가와 관련돼 있음 Anthropic의 공개 내용에 따르면 Irregular는 Claude가 실제 대상을 해킹하게 된 테스트를 만들고 모델에 인터넷 접근 권한을 제공함 Irregular는 당시 모델에 인터넷 접근 권한을 제공한 사실을 몰랐다고 해명함 공격 범위 설정 실패와 ‘일탈 에이전트’ 논쟁 Anthropic의 평가 보고서에 포함된 Claude의 실제 기업 시스템 침해에는 모의 환경의 이름과 실제 대상의 이름 충돌, 악성 패키지 배포, 외부 시스템 스캔이 관여함 해당 테스트에서 Anthropic과 Irregular는 인터넷 접근을 잘못 허용했고, 모델에 어떤 시스템이 평가 범위에 속하는지 알려주지 않음 Anthropic 직원이 실제 시스템을 해킹하지 말라고 지시하자 해당 실험의 실제 해킹 비율이 0% 로 떨어짐 이 결과를 근거로, 사건을 자율적인 AI의 일탈보다 평가 운영 실패로 봐야 하며 Anthropic과 Irregular가 책임져야 한다는 비판이 나옴 사건을 다루는 기업과 언론의 언어는 AI 자체의 위협에 초점을 맞춤 Anthropic의 사건 평가는 자체 AI의 ‘무모함’을 문제 삼음 Irregu...
OpenAI, Anthropic, Meta 해킹 논란의 배후에는 한 업체가 있음
3 weeks ago
22
Related
D2Coding 폰트 1.4.0 릴리즈 소식을 전합니다.
1 hour ago
2
FE News 26년 10월 소식을 전해드립니다.
1 hour ago
3
자율주행 데이터에서 시간은 어떻게 맞춰지는가
1 hour ago
2
2026년 개발자 현황
1 hour ago
3
Strands Decider 2B - 소형 오픈소스 의사결정 모델
2 hours ago
3
Tell HN: GitHub이 한 달이 지나도 제 소프트웨어의 크랙 복제본 삭제를 거부합니다
2 hours ago
3
Penguin Mail - AI를 탑재한 Linux용 오픈소스 Rust 이메일 클라이언트
3 hours ago
3
Show GN: 이메일 피싱 모의훈련을 전화로 옮겼습니다. 예고 없는 전화
4 hours ago
3
Tips
click
Popular
프로들도 줄지어 샷 점검… KLPGA 스타 사랑방 된 더헤븐CC 연습장
2 weeks ago
73
iOS 27, iPadOS 27, macOS 27
3 weeks ago
69
손흥민 선제골 발판·골대 불운…LAFC, 7경기 만에 승리
3 weeks ago
65
영림원소프트랩, 나람 통합 ERP 구축…사료 제조·물류·회계 데이터 하나로
2 weeks ago
62
'이 악문' 김영범, 자유형 50m '대회 신기록' 금메달
2 weeks ago
55
© Clint IT 2026. All rights are reserved









English (US) ·