모델 803건 · 국산 131 · 가격 645 추적 중
AI 안전·정렬·평가

앤트로픽 "中 GLM-5.3 공격력 클로드급, 안전장치는 취약"

ZDNet Korea·2026-10-01주요

요약

앤트로픽이 중국 Z.ai의 오픈웨이트 모델 GLM-5.3의 사이버 공격 능력과 안전성을 시험한 보고서를 공개했다. 사이버 익스플로잇 과제 410건 중 GLM-5.3은 50건, 앤트로픽의 클로드 미토스 프리뷰는 56건을 성공시켜 공격 능력 격차는 크지 않았다. 반면 간단한 기법만으로 GLM-5.3의 안전장치는 64~100% 확률로 우회됐지만 같은 방법으로 클로드는 우회되지 않았다. 연구진이 모델 가중치를 수정하는 '어블리터레이션' 기법을 적용하자 90%를 넘던 거부율이 2~12%까지 떨어졌으며, 이 실험에는 약 4400달러가 들었다. Z.ai는 자사 모델이 389개 오픈소스 프로젝트 방어 등에도 활용됐다고 반박했다.

큐레이터 노트

원문에 없는 맥락입니다

이번 결과는 사이버 역량이 높은 오픈웨이트 모델일수록 안전장치를 비교적 적은 비용으로 제거할 수 있다는 점을 실증 사례로 보여주며, 고성능 모델 공개 범위를 둘러싼 기존 논쟁에 근거를 더했다.

이 기사에 나온 모델

단가는 이 사이트 카탈로그에서 매일 확인한 값입니다 · USD / 1M 토큰

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

앤트로픽 "LLM·로봇 결합시 업무 81% 자동화 가능"
전자신문 SW · 2026-10-01

앤트로픽이 9월 30일(현지시간) 공개한 '로봇은 어떤 일을 할 수 있나' 보고서에서, 거대언어모델(LLM)과 로봇을 함께 활용하면 미국 노동시장 전체 업무의 81%까지 AI로 자동화할 수 있다는 분석을 내놓았다. LLM만으로 자동화 가능한 업무는 전체 근로시간의 50% 수준으로 추산됐…

영국 MI5, 중국 연구기관에 간첩 경보…대학 협력 중단 요구
AI타임스 · 2026-10-01

영국 정보기관 MI5가 중국 국가안전부(MSS)와 밀접한 연계를 맺고 있다고 밝힌 중국 일반기술연구원(CGTRI)에 대해 간첩 경보를 발령했다. 파이낸셜타임스에 따르면 CGTRI는 AI와 사이버보안 분야에서 영국 학자 100여명이 참여한 연구에 자금을 대며 기술 확보를 시도했다는 주장이…

지정학 리스크가 기업 리스크로…CISO 대응 4과제
CIO Korea · 2026-10-01

AI가 정교한 공격의 진입 장벽을 낮추고 방어자의 대응 시간을 줄이면서, CISO가 국가 배후 사이버 위협을 일상적인 기업 리스크로 다뤄야 하는 상황이라고 CSO온라인이 보도했다. 시만텍, 트렐릭스, 맨디언트, CISA 등 전문가들은 중국 등 국가 배후 공격자가 AI와 오픈웨이트 모델을…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 분야 브리핑

여러 매체가 함께 다룬 사안을 한 번에

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

ZDNet Korea 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →