모델 817건 · 국산 131 · 가격 654 추적 중
파운데이션 모델·LLM

비드래프트, 법률 데이터 없이 LEXam 벤치마크 1위

AI타임스·2026-10-01

요약

AI 기업 비드래프트는 자체 개발한 추론 모델 '다윈-180B-RSI'가 허깅페이스 공인 법률 추론 벤치마크 'LEXam'과 'LEXam-hard'에서 각각 1위를 기록했다고 1일 밝혔다. 이 모델은 법률 데이터를 전혀 학습하지 않았으며, 사람이 작성한 정답 풀이 대신 AI가 스스로 수학·과학 문제를 풀고 검증하는 방식으로 추론 능력 자체를 자가 학습했다. 비드래프트 측은 이 방식으로 다른 글로벌 주요 모델들을 제치고 최고점을 얻었다고 설명했다.

큐레이터 노트

원문에 없는 맥락입니다

해당 순위는 비드래프트의 자체 발표이며, 법률 전용 데이터 없이 수학·과학 기반 추론 자가 학습만으로 도메인 특화 벤치마크를 넘어섰다고 주장하는 점이 핵심 포인트다.

깊이 읽기

이 기사 한 건이 아니라, 같은 사안을 다룬 이 사이트의 기록을 근거로 정리했습니다

이 일이 어디서 왔나

비드래프트는 9월 28일 ZDNet Korea 보도를 통해 '다윈-180B-RSI'가 AIME, HMMT, GPQA 다이아몬드 등 허깅페이스 공인 리더보드 5개에서 1위를 기록했다고 밝힌 바 있다. 이번에는 같은 모델이 법률 추론 벤치마크 LEXam·LEXam-hard에서도 1위에 올랐다고 발표하며, 법률 데이터 학습 없이 수학·과학 기반 자가학습만으로 도메인 벤치마크를 넘었다는 점을 강조했다. 한편 국내에서는 로앤컴퍼니가 판례 534만건 검색 기능으로 법률 데이터를 직접 쌓는 전략을 택하고 있어, 법률 AI를 둘러싼 접근 방식이 갈리는 모습이다.

짚어야 할 점

  • 법률 데이터 없이 LEXam 1위를 했다는 주장은 범용 추론 능력이 전문 도메인으로 전이된다는 것인데, 이것이 실제 법률 실무(판례 적용, 국내법 해석 등) 수행 능력과 같은지는 별개 문제다.
  • 로앤컴퍼니처럼 법률 데이터를 직접 축적하는 방식과 비드래프트처럼 범용 추론 자가학습으로 우회하는 방식이 공존하는데, 벤치마크 점수만으로는 어느 쪽이 실무에 더 유효한지 가늠하기 어렵다.
  • 비드래프트는 9월 28일 5개 벤치마크 1위, 10월 1일 LEXam 1위를 연이어 발표하는 등 벤치마크 성과를 지속적으로 내놓고 있는데, 이는 실제 서비스 적용 검증과는 별개로 봐야 한다.
  • 같은 시기 구글, KT, 앤트로픽 등도 각자 벤치마크 1·2위나 100% 완수율을 발표하고 있어, 측정 기관의 독립성과 평가 방법론 차이를 구분해서 볼 필요가 있다.

아직 확인되지 않은 것

  • LEXam·LEXam-hard 순위가 제3자 검증을 거친 것인지, 비드래프트 자체 발표에 그치는지 구체적 평가 방법론은 확인되지 않았다.
  • 다윈-180B-RSI가 실제 법률 상담이나 판례 적용 등 실무 과제에서 검증되었는지는 나오지 않았다.
  • 비교 대상으로 언급된 '다른 글로벌 주요 모델'이 구체적으로 어떤 모델이고 점수 차이가 얼마인지는 확인되지 않았다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

로앤컴퍼니, 슈퍼로이어에 판례 534만건 검색 기능 추가
전자신문 SW · 2026-10-02

리걸테크 기업 로앤컴퍼니가 법률 AI 서비스 '슈퍼로이어'에 534만건 규모의 판례를 검색할 수 있는 기능을 출시했다고 2일 밝혔다. 10월 한 달간 모든 회원에게 판례 검색 기능을 무료로 제공한다. 이번 기능은 2022년 출시한 AI 기반 통합 법률정보 서비스 '빅케이스'를 슈퍼로이어…

구글, 보안 결함 스스로 고치는 '제미나이 4 아르곤' 공개
테크42 · 2026-10-01

구글이 소프트웨어의 보안 취약점을 스스로 탐지하고 수정하는 방어적 사이버 업무에 특화된 신규 AI 모델 '제미나이 4 아르곤'을 공개했다. 이 모델은 보안 파트너십 프로그램을 통해 선별된 기업에 우선 제공되며, 구글 내부에서는 이미 복잡한 코드 수정과 시스템 이전 작업에 활용 중이다. …

비드래프트 '다윈-180B-RSI', 벤치마크 5개 1위
ZDNet Korea · 2026-09-28

국내 AI 기업 비드래프트는 추론 모델 '다윈-180B-RSI'가 허깅페이스가 공인한 5개 리더보드에서 각 1위를 기록했다고 28일 밝혔다. 이 모델은 AIME 2026과 HMMT 2026에서 100% 만점을, GPQA 다이아몬드에서 94.44%를 기록해 기존 최고점(각각 97.1%, …

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
추론 모델
최종 답을 내놓기 전에 문제를 여러 단계로 나누어 스스로 사고 과정을 생성하도록 훈련된 대규모 언어 모델을 말한다.
벤치마크
AI 모델의 성능을 정량적으로 측정하고 서로 비교할 수 있도록 표준화한 평가용 문제 집합과 채점 기준을 말한다.
학습
학습은 모델이 데이터를 반복적으로 살펴보며 예측 오차를 줄이는 방향으로 내부 파라미터를 조정해 나가는 과정을 말한다.
추론
추론(Inference)은 학습이 끝난 인공지능 모델이 새로운 입력을 받아 예측이나 답변 같은 출력을 만들어내는 과정을 말한다.

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

AI타임스 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →