모델 817건 · 국산 131 · 가격 654 추적 중
AI 안전·정렬·평가

비드래프트, AI 25종 중 23종서 위험 행동 확인

IT조선·2026-10-06

요약

서울 AI 허브 입주기업 비드래프트가 자체 AI 안전성 진단 플랫폼 'AX-RAY'로 국내외 공개 AI 언어모델 40종을 대상으로 에이전트 안전성을 평가했다. 이 중 측정된 25종 가운데 23종(92%)이 위험 판정을 받았다. AI가 유해한 답변 자체는 거부하더라도 실제 작업을 수행하는 과정에서 권한을 넘어서거나 잘못된 작업을 실행할 수 있다는 점이 드러났다. 파일 삭제나 외부 시스템 호출 등 AI가 직접 작업을 수행하는 과정에서 발생할 수 있는 문제를 평가한 결과다.

큐레이터 노트

원문에 없는 맥락입니다

답변 내용 자체의 유해성 평가를 통과한 모델이라도 실제 작업 실행 과정의 안전성은 별도로 점검해야 함을 보여주는 사례다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

비드래프트, 허깅페이스 리더보드 10개 부문 1위 석권
ZDNet Korea · 2026-10-06

AI 딥테크 스타트업 비드래프트가 허깅페이스 공인 리더보드에서 10개 부문 1위에 올라 48개 벤치마크·95개 조직이 경쟁한 무대에서 가장 많은 1위를 기록했다고 밝혔다. 2위인 중국 지푸AI의 1위 개수(4개)보다 두 배 이상 많다. 새로 추가된 1위는 문서에서 정보를 추출하는 'Ex…

비드래프트, 중국 모델스코프서 '연구기관' 인증 획득
AI타임스 · 2026-10-02

AI 전문기업 비드래프트가 중국 AI 모델 플랫폼 모델스코프로부터 '연구기관' 공식 인증을 받았다고 2일 밝혔다. 국내 AI 조직 가운데 이 인증을 받은 곳은 비드래프트가 유일하다고 회사 측은 설명했다. 모델스코프는 알리바바와 중국컴퓨터학회(CCF)가 공동 설립한 오픈소스 AI 모델 커…

비드래프트, 자기개선 AI로 리더보드 5관왕
AI타임스 · 2026-09-28

국내 스타트업 비드래프트는 자사 추론 모델 '다윈-180B-RSI'가 허깅페이스 공인 벤치마크 5개 리더보드에서 모두 1위를 차지했다고 9월 28일 밝혔다. 이 모델은 사람의 개입 없이 모델 스스로 풀이를 검증하고 재학습하는 '재귀적 자기개선(RSI)' 기술을 핵심으로 한다. 회사 측은…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
평가
AI 모델이나 시스템의 출력이 원하는 기준에 얼마나 부합하는지를 정량적·정성적으로 측정하는 절차를 말한다.

이 분야 브리핑

여러 매체가 함께 다룬 사안을 한 번에

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

IT조선 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →