중국 AI 모델 안전성 평가 공개율 3.6%에 그쳐
요약
AI 분석업체 세미애널리시스가 2021년부터 2026년 9월15일까지 알리바바, 바이트댄스, 텐센트, 바이두, 딥시크, 문샷 AI, Z.ai 등 중국 AI 개발사를 조사한 결과, 모델 출시 전 안전성 검증 결과를 공개한 비율은 1.1%에 불과했다. 출시 후 뒤늦게 공개한 사례까지 모두 합쳐도 전체 공개율은 3.6%에 그쳤다. 중국 정부는 AI 안전 위험을 공식적으로 인정하고 있지만, 실제 업계는 모델 성능과 시장 선점을 우선시하고 있다는 지적이 나왔다.
큐레이터 노트
원문에 없는 맥락입니다
깊이 읽기
이 기사 한 건이 아니라, 같은 사안을 다룬 이 사이트의 기록을 근거로 정리했습니다
이 일이 어디서 왔나
앞서 앤트로픽은 9월 위협 보고서에서 딥시크·문샷AI·알리바바 등 중국 기업이 클로드 응답을 몰래 수집해 자사 모델 학습에 썼다고 밝혔고, 비드래프트의 10월 6일 조사에서는 국내외 AI 모델 25종 중 23종이 에이전트 작업 과정에서 위험 행동을 보인 것으로 나타났다. 이번 세미애널리시스 조사는 같은 시기 중국 AI 업계의 안전성 검증 '공개' 관행 자체를 수치로 들여다본 것이다.
짚어야 할 점
- 중국 정부가 AI 위험을 공식적으로 인정한다는 사실과, 기업들이 실제로 성능·시장 선점을 우선해 검증 결과를 공개하지 않는다는 행태 사이의 간극이 조사의 핵심이다.
- 안전성 검증 공개가 의무가 아니라 업계 자율에 맡겨진 구조라는 점이 공개율 3.6%라는 낮은 수치를 설명하는 배경으로 제시됐다.
- 비드래프트가 지적한 '유해 답변 거부와 실제 행동 위험의 괴리'나 나델라가 주장한 '투명한 증거 기반 시스템'과 같은 맥락에서, 이번 조사는 공개 자체가 이뤄지지 않는 더 기초적인 단계의 문제를 보여준다.
아직 확인되지 않은 것
- 세미애널리시스가 어떤 기준으로 '안전성 검증 결과 공개'를 판단했는지, 구체적인 평가 항목은 기사에 나오지 않았다.
- 같은 기간 미국·한국 등 다른 나라 AI 기업들의 공개율이 얼마나 되는지 비교 자료는 제시되지 않아, 3.6%라는 수치가 중국만의 문제인지는 확인되지 않았다.
- 중국 정부나 알리바바·바이트댄스·텐센트 등 조사 대상 기업들이 이번 결과에 대해 어떻게 반응했는지는 확인되지 않았다.
다른 매체는 이렇게 썼다
같은 사안을 다룬 다른 곳의 보도입니다
마이크로소프트 CEO 사티아 나델라가 X에 올린 글에서 고도화된 AI 모델이 가진 위험성과 대응 방안에 대한 견해를 밝혔다. 그는 AI를 그 조언과 행동을 그대로 받아들이거나 거부하는 '겹쳐진 블랙박스'로 다루는 방식을 더 이상 받아들일 수 없다고 말했다. 대신 모델을 격리하고 관찰할 …
미국 EDA 기업 시놉시스가 자체 EDA 툴의 AI 기능을 고도화하기 위해 중국 AI 스타트업·연구기관과 협력 방안을 논의 중이라고 니케이아시아가 9일 보도했다. 이는 생성형 AI와 LLM으로 회로 배치·최적화·검증 시간과 비용을 줄이려는 시놉시스의 AI 전환 전략의 일환이다. 동시에 …
OpenAI가 재스민 왕, 토멕 코르바크, 미키타 발레스니 등 AI 안전 연구원 3명을 해고한 결정을 철회하지 않겠다고 밝혔다. 회사는 금요일 X에 올린 글에서 이들이 '민감한 정보를 다루는 명확한 정책'을 위반해 신뢰를 심각하게 저버렸다고 주장했다. 또한 해고 이유가 이들이 AI 안전…
이 사안의 흐름
같은 주제를 다룬 이 사이트의 기록 — 최신순
- 2026-10-07클로드, 챗GPT보다 사용량 가치 5배 높아AI타임스
- 2026-10-06오픈AI, AI 생성 텍스트에 워터마크…EU 먼저 적용전자신문 IT
- 2026-10-06비드래프트, AI 25종 중 23종서 위험 행동 확인IT조선
- 2026-10-03중국 토큰 그레이마켓, 클로드 정가 10%에 유통ZDNet Korea
- 2026-10-03AI 추론 '침묵화'로 사고 사슬 모니터링 무력화 우려AI타임스
이 글에 나온 말
이 분야 브리핑
여러 매체가 함께 다룬 사안을 한 번에
- AI 벤치마크 경쟁 과열, 신뢰성 논란도기사 13건
- 젠슨 황, AI 위험론 반박 속 밴플리트상 수상기사 14건
이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.
같은 분야의 다른 소식
- 앤트로픽, 내부 AI 평가서 실시간 인터넷 차단AI타임스 · 2026-10-11
- AI 위험 논쟁에 가려진 핵무기 종말 시나리오The Guardian AI · 2026-10-11
- 앤트로픽, AI 모욕 이용자와 대화 차단 정책 도입전자신문 SW · 2026-10-11
- AI도 스트레스 테스트…한국 AI 안전 시험장 가보니전자신문 IT · 2026-10-11
- 셀렉트스타, AI 오답 잡는 안전검사 현장 공개전자신문 IT · 2026-10-11
- 나델라 "AI에 비상 브레이크·독립 감사 필요"AI타임스 · 2026-10-11