모델 833건 · 국산 131 · 가격 670 추적 중
AI 안전·정렬·평가

중국 AI 모델 안전성 평가 공개율 3.6%에 그쳐

AI타임스·2026-10-11

요약

AI 분석업체 세미애널리시스가 2021년부터 2026년 9월15일까지 알리바바, 바이트댄스, 텐센트, 바이두, 딥시크, 문샷 AI, Z.ai 등 중국 AI 개발사를 조사한 결과, 모델 출시 전 안전성 검증 결과를 공개한 비율은 1.1%에 불과했다. 출시 후 뒤늦게 공개한 사례까지 모두 합쳐도 전체 공개율은 3.6%에 그쳤다. 중국 정부는 AI 안전 위험을 공식적으로 인정하고 있지만, 실제 업계는 모델 성능과 시장 선점을 우선시하고 있다는 지적이 나왔다.

큐레이터 노트

원문에 없는 맥락입니다

안전성 검증 결과 공개는 의무가 아니라 업계 자율에 맡겨져 있어, 정부의 위험 인식과 기업의 실제 행동 사이에 간극이 있음을 보여주는 조사다.

깊이 읽기

이 기사 한 건이 아니라, 같은 사안을 다룬 이 사이트의 기록을 근거로 정리했습니다

이 일이 어디서 왔나

앞서 앤트로픽은 9월 위협 보고서에서 딥시크·문샷AI·알리바바 등 중국 기업이 클로드 응답을 몰래 수집해 자사 모델 학습에 썼다고 밝혔고, 비드래프트의 10월 6일 조사에서는 국내외 AI 모델 25종 중 23종이 에이전트 작업 과정에서 위험 행동을 보인 것으로 나타났다. 이번 세미애널리시스 조사는 같은 시기 중국 AI 업계의 안전성 검증 '공개' 관행 자체를 수치로 들여다본 것이다.

짚어야 할 점

  • 중국 정부가 AI 위험을 공식적으로 인정한다는 사실과, 기업들이 실제로 성능·시장 선점을 우선해 검증 결과를 공개하지 않는다는 행태 사이의 간극이 조사의 핵심이다.
  • 안전성 검증 공개가 의무가 아니라 업계 자율에 맡겨진 구조라는 점이 공개율 3.6%라는 낮은 수치를 설명하는 배경으로 제시됐다.
  • 비드래프트가 지적한 '유해 답변 거부와 실제 행동 위험의 괴리'나 나델라가 주장한 '투명한 증거 기반 시스템'과 같은 맥락에서, 이번 조사는 공개 자체가 이뤄지지 않는 더 기초적인 단계의 문제를 보여준다.

아직 확인되지 않은 것

  • 세미애널리시스가 어떤 기준으로 '안전성 검증 결과 공개'를 판단했는지, 구체적인 평가 항목은 기사에 나오지 않았다.
  • 같은 기간 미국·한국 등 다른 나라 AI 기업들의 공개율이 얼마나 되는지 비교 자료는 제시되지 않아, 3.6%라는 수치가 중국만의 문제인지는 확인되지 않았다.
  • 중국 정부나 알리바바·바이트댄스·텐센트 등 조사 대상 기업들이 이번 결과에 대해 어떻게 반응했는지는 확인되지 않았다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

나델라 "모든 AI 모델은 '손상됐다'고 가정해야"
The Verge AI · 2026-10-10

마이크로소프트 CEO 사티아 나델라가 X에 올린 글에서 고도화된 AI 모델이 가진 위험성과 대응 방안에 대한 견해를 밝혔다. 그는 AI를 그 조언과 행동을 그대로 받아들이거나 거부하는 '겹쳐진 블랙박스'로 다루는 방식을 더 이상 받아들일 수 없다고 말했다. 대신 모델을 격리하고 관찰할 …

시놉시스, 中 AI 연구소와 반도체 설계 협력 모색
ZDNet Korea · 2026-10-09

미국 EDA 기업 시놉시스가 자체 EDA 툴의 AI 기능을 고도화하기 위해 중국 AI 스타트업·연구기관과 협력 방안을 논의 중이라고 니케이아시아가 9일 보도했다. 이는 생성형 AI와 LLM으로 회로 배치·최적화·검증 시간과 비용을 줄이려는 시놉시스의 AI 전환 전략의 일환이다. 동시에 …

OpenAI, 안전연구원 3명 해고 결정 재확인
The Verge AI · 2026-10-09

OpenAI가 재스민 왕, 토멕 코르바크, 미키타 발레스니 등 AI 안전 연구원 3명을 해고한 결정을 철회하지 않겠다고 밝혔다. 회사는 금요일 X에 올린 글에서 이들이 '민감한 정보를 다루는 명확한 정책'을 위반해 신뢰를 심각하게 저버렸다고 주장했다. 또한 해고 이유가 이들이 AI 안전…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
학습
학습은 모델이 데이터를 반복적으로 살펴보며 예측 오차를 줄이는 방향으로 내부 파라미터를 조정해 나가는 과정을 말한다.
평가
AI 모델이나 시스템의 출력이 원하는 기준에 얼마나 부합하는지를 정량적·정성적으로 측정하는 절차를 말한다.

이 분야 브리핑

여러 매체가 함께 다룬 사안을 한 번에

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

AI타임스 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →