모델 822건 · 국산 131 · 가격 659 추적 중
국내 AI 생태계

뉴로퓨전, 글로벌 예측 벤치마크 1위 달성

AI타임스·2026-09-21

요약

국내 스타트업 뉴로퓨전이 금융 AI 투자 플랫폼 '밸리 AI'로 글로벌 AI 미래 예측 벤치마크 '포캐스트벤치'의 선행 리더보드에서 1위를 기록했다고 밝혔다. 포캐스트벤치는 미래 사건의 결과를 예측하는 벤치마크로, 문제를 푸는 시점에는 누구도 정답을 알 수 없다는 것이 특징이다. 이는 기존 벤치마크에서 제기돼 온 평가 데이터 과적합과 결과 공정성 논란에 대한 대안적 성격을 지닌 평가 방식으로 소개됐다. 이번 순위는 포캐스트벤치 측이 공개한 선행 리더보드를 통해 확인됐다.

큐레이터 노트

원문에 없는 맥락입니다

정답이 사전에 존재하지 않는 예측형 벤치마크는 데이터 과적합 우려에서 비교적 자유롭다는 점에서, 국내 스타트업이 이런 방식의 글로벌 평가에서 성과를 낸 사례로 볼 수 있다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

투모로로보틱스, 로봇 AI '하빌리스 브레인 0' 공개
전자신문 SW · 2026-10-07

피지컬 AI 기업 투모로로보틱스가 로봇 파운데이션 모델 '하빌리스 브레인 0'를 공개했다. 이 모델은 주변 환경과 작업 지시를 이해해 물체를 집고 옮기는 동작으로 연결하는 로봇 AI다. 손과 물체의 위치 변화를 학습하는 'GC-VLA'와 성공·실패 경험을 바탕으로 동작을 보정하는 'GC…

구글딥마인드 "AI 벤치마크, 평가 언어 범위 넓혀야"
ZDNet Korea · 2026-10-06

로라 아로요 구글딥마인드 수석 과학자는 10월 6일 서울 'AI 페스타 2026' 기조연설에서 현재 다수 AI 벤치마크가 10~20개 언어로만 모델을 평가해 범위가 제한적이라고 지적했다. AI 모델은 약 70~100개 언어를 지원하지만 평가 체계가 이를 따라가지 못하고 있으며, 영어 문…

비드래프트, 허깅페이스 리더보드 10개 부문 1위 석권
ZDNet Korea · 2026-10-06

AI 딥테크 스타트업 비드래프트가 허깅페이스 공인 리더보드에서 10개 부문 1위에 올라 48개 벤치마크·95개 조직이 경쟁한 무대에서 가장 많은 1위를 기록했다고 밝혔다. 2위인 중국 지푸AI의 1위 개수(4개)보다 두 배 이상 많다. 새로 추가된 1위는 문서에서 정보를 추출하는 'Ex…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
벤치마크
AI 모델의 성능을 정량적으로 측정하고 서로 비교할 수 있도록 표준화한 평가용 문제 집합과 채점 기준을 말한다.
평가
AI 모델이나 시스템의 출력이 원하는 기준에 얼마나 부합하는지를 정량적·정성적으로 측정하는 절차를 말한다.

이 분야 브리핑

여러 매체가 함께 다룬 사안을 한 번에

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

AI타임스 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →