프린스턴대, '순환 루프 변환기(RLT)' 아키텍처 공개
요약
프린스턴대학 연구진이 대형언어모델의 이전 계산 결과를 다음 토큰 생성에 직접 연결하는 새로운 트랜스포머 아키텍처 '순환 루프 변환기(RLT)'를 알파카이브를 통해 공개했다. 이 아키텍처는 토큰 처리 후 생성된 디코더의 최종 은닉 상태와 어텐션 캐시를 다음 단계의 첫 입력으로 전달하도록 설계됐다. 기존 디코더 전용 LLM은 이전 토큰 정보를 KV 캐시에 저장해 어텐션으로 재참조할 뿐, 마지막 계산 결과를 다음 단계에 직결하지는 않았다.
큐레이터 노트
원문에 없는 맥락입니다
다른 매체는 이렇게 썼다
같은 사안을 다룬 다른 곳의 보도입니다
KT가 자체 개발한 AI 모델 라우팅 기술 '오토모델라우터'가 LLM 라우터 전문 공개 벤치마크 '라우터 아레나'에서 종합 2위를 기록했다. 이 기술은 공개 리더보드에 'KT-ModelRouter'라는 이름으로 등재됐으며, 정확도와 비용을 함께 평가하는 'Acc-Cost Arena' 기…
중국 AI 산업이 대규모언어모델(LLM) 성능 경쟁을 넘어 실제 업무를 수행하는 AI 에이전트 중심으로 이동하고 있다. 질문에 답하는 수준을 벗어나 사용자 목표를 이해하고 작업을 스스로 계획한 뒤 필요한 도구와 시스템을 활용해 결과를 만들어내는 '실행형 AI'로 진화하는 흐름이다. 36…
구글 딥마인드의 새 수장 코레이 카부크추올루가 The Information과의 첫 언론 인터뷰에서 제미나이 4가 현재 정제(refinement) 단계에 있으며 연말보다 훨씬 이른 시점에 출시하는 것이 목표라고 밝혔다. 그는 "결과를 보고 있고 흥분되는 상황이라 가능한 한 빨리 초기 사후…
이 사안의 흐름
같은 주제를 다룬 이 사이트의 기록 — 최신순
- 2026-09-30리퀴드 AI, 확률 계산형 의사결정 모델 'd1' 출시AI타임스
- 2026-09-28앤트로픽, 클로드 소네트 5.5 공개…속도·비용 효율 강화AI타임스
- 2026-09-24구글, '제미나이 4 프로' 초기 테스트 정황 포착AI타임스
- 2026-09-23짧은 판단에 특화된 AI 모델 '제브', 개발자 사이 빠른 확산IT조선
- 2026-09-23'LLM 마스터: 모델×시스템 엔지니어링' 도서 출간AI타임스
이 글에 나온 말
- 트랜스포머
- 트랜스포머는 입력 시퀀스의 모든 토큰 쌍 사이의 관계를 어텐션 메커니즘으로 직접 계산하여 문맥을 파악하는 신경망 아키텍처를 말한다.
- KV 캐시
- 트랜스포머 기반 언어 모델이 토큰을 하나씩 생성할 때 이미 계산한 어텐션의 키(Key)와 값(Value) 벡터를 저장해 두었다가 다음 토큰 생성 시 재사용함으로써 중복 계산을 없애는 추론 최적화 기법을 말한다.
- 어텐션
- 입력의 각 요소가 출력을 생성하는 데 얼마나 중요한지를 계산해 가중치를 부여하는 신경망 메커니즘을 말한다.
- 토큰
- 언어 모델이 텍스트를 처리할 때 사용하는 최소 단위로, 단어나 단어의 일부, 문장 부호 등을 가리키는 말이다.
이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.
같은 분야의 다른 소식
- 구글, 최상위 AI '제미나이 4 아르곤' 공개…일반 출시는 보류IT조선 · 2026-09-30
- 구글, '제미나이 4 아르곤' 공개…접근은 제한적AI타임스 · 2026-09-30
- 리퀴드 AI, 확률 계산형 의사결정 모델 'd1' 출시AI타임스 · 2026-09-30
- 앤트로픽, 소넷 5.5 출시…오퍼스와 성능 근접블로터 · 2026-09-30
- 오픈AI, 저비용 모델 'GPT-6.1 솔'·에이전트 '닷츠' 공개전자신문 SW · 2026-09-29
- 오픈AI, 저비용 고성능 'GPT-6.1 솔' 공개AI타임스 · 2026-09-29