모델 803건 · 국산 131 · 가격 645 추적 중
국내 AI 생태계

뉴로퓨전, 글로벌 예측 벤치마크 1위 달성

AI타임스·2026-09-22

요약

국내 스타트업 뉴로퓨전이 금융 AI 투자 플랫폼 '밸리 AI'로 글로벌 AI 미래 예측 벤치마크 '포캐스트벤치'의 선행 리더보드에서 1위를 기록했다고 밝혔다. 포캐스트벤치는 미래 사건의 결과를 예측하는 벤치마크로, 문제를 푸는 시점에는 누구도 정답을 알 수 없다는 것이 특징이다. 이는 기존 벤치마크에서 제기돼 온 평가 데이터 과적합과 결과 공정성 논란에 대한 대안적 성격을 지닌 평가 방식으로 소개됐다. 이번 순위는 포캐스트벤치 측이 공개한 선행 리더보드를 통해 확인됐다.

큐레이터 노트

원문에 없는 맥락입니다

정답이 사전에 존재하지 않는 예측형 벤치마크는 데이터 과적합 우려에서 비교적 자유롭다는 점에서, 국내 스타트업이 이런 방식의 글로벌 평가에서 성과를 낸 사례로 볼 수 있다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

에이머슬리, 숙련 엔지니어 노하우 SW화한 '앰피비언' 개발
전자신문 SW · 2026-09-30

제조 AI 기업 에이머슬리가 숙련 엔지니어의 공정 판단과 제어 노하우를 소프트웨어로 구현한 플랫폼 '앰피비언'을 개발했다. 최승천 대표는 뛰어난 엔지니어 한 사람의 문제 해결 방법을 소프트웨어로 만들면 더 많은 사람이 쓸 수 있고 여러 장비와 공정으로 확장할 수 있다고 밝혔다. 이 플랫…

비드래프트 '다윈-180B-RSI', 벤치마크 5개 1위
ZDNet Korea · 2026-09-28

국내 AI 기업 비드래프트는 추론 모델 '다윈-180B-RSI'가 허깅페이스가 공인한 5개 리더보드에서 각 1위를 기록했다고 28일 밝혔다. 이 모델은 AIME 2026과 HMMT 2026에서 100% 만점을, GPQA 다이아몬드에서 94.44%를 기록해 기존 최고점(각각 97.1%, …

KT 오토모델라우터, 라우터 아레나 2위 기록
IT조선 · 2026-09-27

KT가 개발한 AI 모델 라우팅 기술 '오토모델라우터'가 미국 라이스대학교 연구진이 만든 공개 평가 플랫폼 '라우터 아레나'에서 종합 2위에 올랐다. 이 플랫폼은 약 8400개 질의로 AI 라우터의 응답 정확도, 비용 효율성, 견고성 등을 종합 평가한다. KT의 오토모델라우터는 정확도와…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
벤치마크
AI 모델의 성능을 정량적으로 측정하고 서로 비교할 수 있도록 표준화한 평가용 문제 집합과 채점 기준을 말한다.
평가
AI 모델이나 시스템의 출력이 원하는 기준에 얼마나 부합하는지를 정량적·정성적으로 측정하는 절차를 말한다.

이 분야 브리핑

여러 매체가 함께 다룬 사안을 한 번에

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

AI타임스 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →