비드래프트, 법률 데이터 없이 LEXam 벤치마크 1위
요약
AI 기업 비드래프트는 자체 개발한 추론 모델 '다윈-180B-RSI'가 허깅페이스 공인 법률 추론 벤치마크 'LEXam'과 'LEXam-hard'에서 각각 1위를 기록했다고 1일 밝혔다. 이 모델은 법률 데이터를 전혀 학습하지 않았으며, 사람이 작성한 정답 풀이 대신 AI가 스스로 수학·과학 문제를 풀고 검증하는 방식으로 추론 능력 자체를 자가 학습했다. 비드래프트 측은 이 방식으로 다른 글로벌 주요 모델들을 제치고 최고점을 얻었다고 설명했다.
큐레이터 노트
원문에 없는 맥락입니다
다른 매체는 이렇게 썼다
같은 사안을 다룬 다른 곳의 보도입니다
국내 AI 기업 비드래프트는 추론 모델 '다윈-180B-RSI'가 허깅페이스가 공인한 5개 리더보드에서 각 1위를 기록했다고 28일 밝혔다. 이 모델은 AIME 2026과 HMMT 2026에서 100% 만점을, GPQA 다이아몬드에서 94.44%를 기록해 기존 최고점(각각 97.1%, …
KT가 자체 개발한 AI 모델 라우팅 기술 '오토모델라우터'가 LLM 라우터 전문 공개 벤치마크 '라우터 아레나'에서 종합 2위를 기록했다. 이 기술은 공개 리더보드에 'KT-ModelRouter'라는 이름으로 등재됐으며, 정확도와 비용을 함께 평가하는 'Acc-Cost Arena' 기…
KT가 개발한 AI 모델 라우팅 기술 '오토모델라우터'가 미국 라이스대학교 연구진이 만든 공개 평가 플랫폼 '라우터 아레나'에서 종합 2위에 올랐다. 이 플랫폼은 약 8400개 질의로 AI 라우터의 응답 정확도, 비용 효율성, 견고성 등을 종합 평가한다. KT의 오토모델라우터는 정확도와…
이 사안의 흐름
같은 주제를 다룬 이 사이트의 기록 — 최신순
- 2026-10-01구글, 제미나이 4 아르곤 내부서 실성능 회의론AI타임스
- 2026-09-27KT 자체 AI 라우팅 기술, 라우터 아레나 2위 올라ZDNet Korea
- 2026-09-22에포크AI, 벤치마크 신뢰성 검증 착수AI타임스
- 2026-09-22뉴로퓨전, 미래예측 벤치마크 ForecastBench 1위전자신문 SW
- 2026-09-21뉴로퓨전, 글로벌 예측 벤치마크 1위 달성AI타임스
이 글에 나온 말
이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.
같은 분야의 다른 소식
- 업스테이지, 경량 LLM '솔라 미니 4' 공개전자신문 IT · 2026-10-01
- 구글, 제미나이 4 아르곤 내부서 실성능 회의론AI타임스 · 2026-10-01
- 구글, 최상위 AI '제미나이 4 아르곤' 공개…일반 출시는 보류IT조선 · 2026-09-30
- 구글, '제미나이 4 아르곤' 공개…접근은 제한적AI타임스 · 2026-09-30
- 리퀴드 AI, 확률 계산형 의사결정 모델 'd1' 출시AI타임스 · 2026-09-30
- 앤트로픽, 소넷 5.5 출시…오퍼스와 성능 근접블로터 · 2026-09-30