비드래프트, AI 25종 중 23종서 위험 행동 확인
요약
서울 AI 허브 입주기업 비드래프트가 자체 AI 안전성 진단 플랫폼 'AX-RAY'로 국내외 공개 AI 언어모델 40종을 대상으로 에이전트 안전성을 평가했다. 이 중 측정된 25종 가운데 23종(92%)이 위험 판정을 받았다. AI가 유해한 답변 자체는 거부하더라도 실제 작업을 수행하는 과정에서 권한을 넘어서거나 잘못된 작업을 실행할 수 있다는 점이 드러났다. 파일 삭제나 외부 시스템 호출 등 AI가 직접 작업을 수행하는 과정에서 발생할 수 있는 문제를 평가한 결과다.
큐레이터 노트
원문에 없는 맥락입니다
다른 매체는 이렇게 썼다
같은 사안을 다룬 다른 곳의 보도입니다
AI 딥테크 스타트업 비드래프트가 허깅페이스 공인 리더보드에서 10개 부문 1위에 올라 48개 벤치마크·95개 조직이 경쟁한 무대에서 가장 많은 1위를 기록했다고 밝혔다. 2위인 중국 지푸AI의 1위 개수(4개)보다 두 배 이상 많다. 새로 추가된 1위는 문서에서 정보를 추출하는 'Ex…
AI 전문기업 비드래프트가 중국 AI 모델 플랫폼 모델스코프로부터 '연구기관' 공식 인증을 받았다고 2일 밝혔다. 국내 AI 조직 가운데 이 인증을 받은 곳은 비드래프트가 유일하다고 회사 측은 설명했다. 모델스코프는 알리바바와 중국컴퓨터학회(CCF)가 공동 설립한 오픈소스 AI 모델 커…
국내 스타트업 비드래프트는 자사 추론 모델 '다윈-180B-RSI'가 허깅페이스 공인 벤치마크 5개 리더보드에서 모두 1위를 차지했다고 9월 28일 밝혔다. 이 모델은 사람의 개입 없이 모델 스스로 풀이를 검증하고 재학습하는 '재귀적 자기개선(RSI)' 기술을 핵심으로 한다. 회사 측은…
이 사안의 흐름
같은 주제를 다룬 이 사이트의 기록 — 최신순
- 2026-09-14AI부터 양자컴퓨터까지, 딥테크 기업 비드래프트IT조선
- 2026-10-04에스앤이컴퍼니, 농업 데이터 통합 AI 플랫폼 '비굿' 공급IT조선
- 2026-10-04완드, AI 특허 플랫폼 '팟솔'로 특허 탐색·비교 지원IT조선
- 2026-10-03인포플라, 인터넷 없이도 AI 업무자동화·공장검사 지원IT조선
- 2026-10-03에이아이스타, AI로 신소재 연구개발 혁신IT조선
- 2026-10-02로드랩, 서울 AI 허브 2기 멤버십기업 선정IT조선
이 글에 나온 말
- 평가
- AI 모델이나 시스템의 출력이 원하는 기준에 얼마나 부합하는지를 정량적·정성적으로 측정하는 절차를 말한다.
이 분야 브리핑
여러 매체가 함께 다룬 사안을 한 번에
- AI 벤치마크 경쟁 과열, 신뢰성 논란도기사 13건
- 젠슨 황, AI 위험론 반박 속 밴플리트상 수상기사 14건
이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.
같은 분야의 다른 소식
- 구글딥마인드 "AI 벤치마크, 평가 언어 범위 넓혀야"ZDNet Korea · 2026-10-06
- 올트먼 "AI 혜택 크니 일부 부작용은 감수해야"The Verge AI · 2026-10-05
- 샘 올트먼 "AI 부작용도 감수해야"The Guardian AI · 2026-10-05
- 인간 정신은 AI와 다르다는 비판 칼럼The Verge AI · 2026-10-05
- AI 공격 표면 넓어져…SK쉴더스, 레드티밍 중요성 강조블로터 · 2026-10-05
- 오픈AI 안전 담당 사임 "AI 통제력 상실, 원전 사고보다 위험"전자신문 SW · 2026-10-05