모델 819건 · 국산 131 · 가격 656 추적 중
AI 안전·정렬·평가

지니젠AI, 오픈라우터 모델 426종 한국어 품질 리더보드 공개

AI타임스·2026-09-17

요약

지니젠AI가 글로벌 AI 모델 중개 플랫폼 오픈라우터에 등록된 모델 426종을 분석하고, 이 중 330종을 대상으로 한국어 품질 평가 결과를 담은 리더보드를 허깅페이스에 공개했다. 평가 항목은 높임말 정확도, 한국 제도 지식, 전문 용어, 지시 준수, 요약, 번역투 배제, 문체 일관성 등 7개다. 오픈라우터는 앤트로픽, 구글, 오픈AI, xAI, 딥시크 등 다양한 AI 모델을 단일 API로 제공하는 플랫폼으로, 2026년 8월 기준 이용자 1000만명을 돌파했다.

큐레이터 노트

원문에 없는 맥락입니다

글로벌 벤치마크는 대체로 영어 중심으로 설계돼 있어, 높임말·번역투 같은 한국어 고유 항목을 별도로 평가했다는 점이 특징이다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

비드래프트, 허깅페이스 리더보드 10개 부문 1위 석권
ZDNet Korea · 2026-10-06

AI 딥테크 스타트업 비드래프트가 허깅페이스 공인 리더보드에서 10개 부문 1위에 올라 48개 벤치마크·95개 조직이 경쟁한 무대에서 가장 많은 1위를 기록했다고 밝혔다. 2위인 중국 지푸AI의 1위 개수(4개)보다 두 배 이상 많다. 새로 추가된 1위는 문서에서 정보를 추출하는 'Ex…

중국 모델스코프, 국내 AI모델 미러링으로 생태계 확장
IT조선 · 2026-10-04

중국 알리바바클라우드가 2022년 공개한 오픈소스 AI 모델 플랫폼 '모델스코프'가 허깅페이스 등에 공개된 AI 모델을 자체 플랫폼으로 미러링한 뒤, 이후 원 개발자가 권한을 넘겨받아 참여할 수 있는 통로를 열어두는 방식으로 생태계를 확장하고 있다. 네이버의 하이퍼클로바X, LG AI연…

비드래프트 '다윈-180B-RSI', 벤치마크 5개 1위
ZDNet Korea · 2026-09-28

국내 AI 기업 비드래프트는 추론 모델 '다윈-180B-RSI'가 허깅페이스가 공인한 5개 리더보드에서 각 1위를 기록했다고 28일 밝혔다. 이 모델은 AIME 2026과 HMMT 2026에서 100% 만점을, GPQA 다이아몬드에서 94.44%를 기록해 기존 최고점(각각 97.1%, …

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
API
API는 서로 다른 소프트웨어가 기능이나 데이터를 주고받을 수 있도록 정해 놓은 규칙과 창구를 말한다.
평가
AI 모델이나 시스템의 출력이 원하는 기준에 얼마나 부합하는지를 정량적·정성적으로 측정하는 절차를 말한다.

이 분야 브리핑

여러 매체가 함께 다룬 사안을 한 번에

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

AI타임스 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →