모델 816건 · 국산 131 · 가격 654 추적 중
파운데이션 모델·LLM

구글, '제미나이 4 프로' 초기 테스트 정황 포착

AI타임스·2026-09-24

요약

구글이 내부 코드명 '아르곤'으로 불리는 '제미나이 4 프로'의 초기 체크포인트를 테스트하고 있다는 정황이 포착됐다. 유출 전문 계정 '렌틸스80'이 X를 통해 처음 이 소식을 전했으며, 구글이 벤치마크 플랫폼 등에 '제미나이 3.8 플래시' 등으로 위장한 아르곤 체크포인트를 노출시켰다는 내용이다. 유출된 테스트 결과물에서는 프런트엔드 코드와 UI·웹 디자인 생성 능력이 개선됐다는 평가가 나왔으며, 이는 정형화되고 독창성이 부족하다는 지적을 받아온 기존 제미나이의 한계를 넘어섰다는 평이다.

큐레이터 노트

원문에 없는 맥락입니다

구글의 공식 발표가 아닌 유출 계정발 정황이므로, 실제 출시 여부와 성능은 정식 공개 전까지 확인이 필요하다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

SK엠앤서비스, 복지몰에 자체 개발 AI 리뷰 요약 적용
전자신문 SW · 2026-10-02

SK엠앤서비스가 운영하는 임직원 복지몰 베네피아에 자체 개발한 'AI 요약 서비스'가 처음으로 적용됐다. 이 서비스는 대규모 언어모델(LLM)로 축적된 리뷰 데이터를 분석해 새로운 리뷰 탐색 경험을 제공한다. 핵심 기능인 'AI 자연어 문단 요약'은 단순 문장 발췌가 아니라 10건 이상…

AI 생성 3D 모델 결함을 직접 고치는 InstructMesh 개발
MIT News (AI) · 2026-10-01

MIT CSAIL, 구글, 노스이스턴대 연구진이 AI로 생성된 3D 모델의 설계 결함을 사용자가 직접 수정해 3D 프린팅할 수 있는 도구 'InstructMesh'를 개발했다. 이 도구는 텍스트·이미지로 3D 모델을 만드는 마이크로소프트의 TRELLIS와 거대언어모델 GPT-4를 결합해…

앤트로픽 "LLM·로봇 결합시 업무 81% 자동화 가능"
전자신문 SW · 2026-10-01

앤트로픽이 9월 30일(현지시간) 공개한 '로봇은 어떤 일을 할 수 있나' 보고서에서, 거대언어모델(LLM)과 로봇을 함께 활용하면 미국 노동시장 전체 업무의 81%까지 AI로 자동화할 수 있다는 분석을 내놓았다. LLM만으로 자동화 가능한 업무는 전체 근로시간의 50% 수준으로 추산됐…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
벤치마크
AI 모델의 성능을 정량적으로 측정하고 서로 비교할 수 있도록 표준화한 평가용 문제 집합과 채점 기준을 말한다.
평가
AI 모델이나 시스템의 출력이 원하는 기준에 얼마나 부합하는지를 정량적·정성적으로 측정하는 절차를 말한다.

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

AI타임스 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →