구글, 이중맹검 AI 평가 시범 운영…벤치마크 오염 차단
요약
구글 딥마인드가 암호화 기술을 활용한 이중맹검(Double-blind) AI 모델 평가를 시범 운영한다고 발표했다. AI 모델이 평가 전 문제 데이터를 미리 학습해 성능 점수가 부풀려지는 '벤치마크 오염' 문제를 기술적으로 해결하려는 시도다. 구글 딥마인드는 27일(현지시간) 세계 최초로 자체 개발한 이중맹검 평가 기술 보고서를 공개했다. 현재는 평가자가 벤치마크 문제를 공개하면 개발사가 이를 모델 학습에 활용할 위험이 있다는 점을 문제로 지적했다.
큐레이터 노트
원문에 없는 맥락입니다
다른 매체는 이렇게 썼다
같은 사안을 다룬 다른 곳의 보도입니다
구글이 9월 24일부터 미국 픽셀 11 이용자를 대상으로 제미나이의 '콜 포 미' 기능 시험을 시작했다고 테크크런치가 보도했다. 대상은 픽셀 11, 11 프로, 11 프로 XL, 11 프로 폴드이며 유료 제미나이 구독과 전화 앱 공개 베타 버전이 필요하다. 제미나이가 이용자의 번호로 업…
국내 AI 기업 비드래프트는 추론 모델 '다윈-180B-RSI'가 허깅페이스가 공인한 5개 리더보드에서 각 1위를 기록했다고 28일 밝혔다. 이 모델은 AIME 2026과 HMMT 2026에서 100% 만점을, GPQA 다이아몬드에서 94.44%를 기록해 기존 최고점(각각 97.1%, …
구글이 인도에서 일부 이용자를 대상으로 제미나이와 'AI 모드' 화면에서 플립카트 상품을 바로 구매할 수 있는 기능을 시험하고 있다. 구매 버튼을 누르면 화면 이탈 없이 플립카트 결제 절차로 연결되며, 대상은 스마트폰·전자제품·모바일 액세서리 등 일부 상품으로 제한된다. 구글은 인도 축…
이 사안의 흐름
같은 주제를 다룬 이 사이트의 기록 — 최신순
- 2026-09-04구글, 매시간 예보 기상 AI '웨더넥스트 3' 공개AI타임스
- 2026-08-31구글, 벤치마크 능동화 하네스로 AI 잠재력 끌어내AI타임스
- 2026-08-28배럿 조프, 오픈AI 떠나 구글行...제미나이 개발 합류AI타임스
- 2026-09-30구글·MS, 기업 데이터 표준화 단체 '아파치 오시' 합류AI타임스
- 2026-09-27구글, 우주 AI 데이터센터 ‘선캐처’ 실험위성 10월 발사IT조선
이 글에 나온 말
이 분야 브리핑
여러 매체가 함께 다룬 사안을 한 번에
이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.
같은 분야의 다른 소식
- 빅테크 AI 연구원 22인 "멸종 위험" 경고 인터뷰 공개AI타임스 · 2026-09-30
- 라온시큐어 "AI 보안, 외부차단서 행동통제로"블로터 · 2026-09-30
- 오픈AI, 호주 정부망 무단접근 사과…특별조사팀 구성AI타임스 · 2026-09-30
- 앤트로픽, IPO 서류에 AI 실존적 위험 공식 경고AI타임스 · 2026-09-30
- 알트먼 "안전 확신 전까진 IPO 안 서두른다"AI타임스 · 2026-09-30
- 라온시큐어, AI 에이전트용 보안 솔루션 5종 공개전자신문 SW · 2026-09-30