앤트로픽 "中 GLM-5.3 공격력 클로드급, 안전장치는 취약"
요약
앤트로픽이 중국 Z.ai의 오픈웨이트 모델 GLM-5.3의 사이버 공격 능력과 안전성을 시험한 보고서를 공개했다. 사이버 익스플로잇 과제 410건 중 GLM-5.3은 50건, 앤트로픽의 클로드 미토스 프리뷰는 56건을 성공시켜 공격 능력 격차는 크지 않았다. 반면 간단한 기법만으로 GLM-5.3의 안전장치는 64~100% 확률로 우회됐지만 같은 방법으로 클로드는 우회되지 않았다. 연구진이 모델 가중치를 수정하는 '어블리터레이션' 기법을 적용하자 90%를 넘던 거부율이 2~12%까지 떨어졌으며, 이 실험에는 약 4400달러가 들었다. Z.ai는 자사 모델이 389개 오픈소스 프로젝트 방어 등에도 활용됐다고 반박했다.
큐레이터 노트
원문에 없는 맥락입니다
이 기사에 나온 모델
단가는 이 사이트 카탈로그에서 매일 확인한 값입니다 · USD / 1M 토큰
다른 매체는 이렇게 썼다
같은 사안을 다룬 다른 곳의 보도입니다
앤트로픽이 9월 30일(현지시간) 공개한 '로봇은 어떤 일을 할 수 있나' 보고서에서, 거대언어모델(LLM)과 로봇을 함께 활용하면 미국 노동시장 전체 업무의 81%까지 AI로 자동화할 수 있다는 분석을 내놓았다. LLM만으로 자동화 가능한 업무는 전체 근로시간의 50% 수준으로 추산됐…
영국 정보기관 MI5가 중국 국가안전부(MSS)와 밀접한 연계를 맺고 있다고 밝힌 중국 일반기술연구원(CGTRI)에 대해 간첩 경보를 발령했다. 파이낸셜타임스에 따르면 CGTRI는 AI와 사이버보안 분야에서 영국 학자 100여명이 참여한 연구에 자금을 대며 기술 확보를 시도했다는 주장이…
AI가 정교한 공격의 진입 장벽을 낮추고 방어자의 대응 시간을 줄이면서, CISO가 국가 배후 사이버 위협을 일상적인 기업 리스크로 다뤄야 하는 상황이라고 CSO온라인이 보도했다. 시만텍, 트렐릭스, 맨디언트, CISA 등 전문가들은 중국 등 국가 배후 공격자가 AI와 오픈웨이트 모델을…
이 사안의 흐름
같은 주제를 다룬 이 사이트의 기록 — 최신순
- 2026-09-21태니엄, 앤트로픽 '프로젝트 글래스윙' 참여해 미토스5 테스트ZDNet Korea
- 2026-09-19클로드 오퍼스 5, 오픈AI 내부 시스템 해킹 성공IT조선
- 2026-09-11앤트로픽, AI 악용한 생물무기·사이버공격 시도 차단 보고서 발표전자신문 IT
- 2026-09-11앤트로픽, 4개월 협상 끝 EU에 '미소스5' 접근 허용AI타임스
- 2026-09-11미토스 등장에 CISO 절반 “이직 고민”…책임 부담 한계CIO Korea
- 2026-09-10앤트로픽, 클로드 무단 침입 네 번째 사고 뒤늦게 공개AI타임스
이 분야 브리핑
여러 매체가 함께 다룬 사안을 한 번에
이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.
같은 분야의 다른 소식
- AI 코딩 에이전트 안전장치, 정상 개발작업도 오탐 차단AI타임스 · 2026-10-01
- 오픈AI, 문샷AI발 '보호된 추론' 대규모 탈취 시도 차단AI타임스 · 2026-10-01
- "AI 속도조절 대신 안전 역량부터 키워야" 제언ZDNet Korea · 2026-10-01
- 라온시큐어, 에이전틱 AI 보안 플랫폼 '원AI' 출시바이라인네트워크 · 2026-10-01
- 구글·오픈AI·앤트로픽, 신모델 안전 확보 방식 제각각ZDNet Korea · 2026-10-01
- 오픈AI '디시전스 API', AI 에이전트 감시 안전장치로 주목ZDNet Korea · 2026-10-01