모델 803건 · 국산 131 · 가격 645 추적 중
AI 연구

구글, 재학습 없이 에이전트 개선하는 'RRSI' 공개

AI타임스·2026-09-30

요약

구글 클라우드 AI 리서치 연구진이 스탠퍼드대학교, 워싱턴대학교 등과 함께 AI 에이전트 성능을 모델 재학습 없이 개선하는 연구 프레임워크 'RRSI(정규화된 재귀적 자기개선)'를 9월 29일(현지시간) 공개했다. 이 방식은 모델의 가중치를 바꾸는 대신 에이전트의 실행 환경인 '하네스'를 반복적으로 수정하고 평가하는 것이 핵심이다. 수정 대상에는 프롬프트, 도구 사용 방식, 제어 흐름, 메모리와 컨텍스트 관리, 기술 모듈, 하위 에이전트 등이 포함된다.

큐레이터 노트

원문에 없는 맥락입니다

모델 가중치를 바꾸지 않고 하네스만 반복 수정한다는 점에서, 재학습 없이 에이전트 성능을 높이려는 접근법으로 볼 수 있다.

깊이 읽기

이 기사 한 건이 아니라, 같은 사안을 다룬 이 사이트의 기록을 근거로 정리했습니다

이 일이 어디서 왔나

이날 오픈AI가 에이전트 기반 코딩과 장기 업무 자동화를 강화한 'GPT-6.1 솔'을 공개하고 메타도 소상공인용 에이전트 '뮤즈'를 내놓는 등, 빅테크들의 에이전트 경쟁 발표가 같은 날 몰렸다. RRSI는 이 흐름 속에서 모델 자체를 키우거나 재학습시키는 대신 에이전트의 운영 방식을 고치는 방향을 택했다는 점에서 차별화된다.

짚어야 할 점

  • 재학습 없이 프롬프트·도구 사용·메모리 관리 등 하네스만 고치는 방식이라, 모델 교체나 파인튜닝보다 비용과 시간을 아낄 수 있는 접근으로 볼 수 있다.
  • 구글이 아파치 오시 같은 데이터 표준화 단체에 합류하는 동시에 하네스를 반복 수정하는 프레임워크를 내놓은 것은, 에이전트를 모델 성능이 아닌 '운영 체계'로 다루는 방향과 맞닿아 있다.
  • 같은 날 라온시큐어가 에이전트 신원·권한 검증 솔루션을 내놓은 것과 겹쳐 보면, 에이전트가 스스로 제어 흐름과 하위 에이전트를 고쳐 나가는 구조에서 안전성 검증이 함께 논의될 필요가 있어 보인다.

아직 확인되지 않은 것

  • RRSI를 적용했을 때 기존 방식 대비 성능이 얼마나, 어떤 벤치마크에서 개선됐는지 구체적 수치는 나오지 않았다.
  • 이 프레임워크가 실제 상용 에이전트 제품에 적용될 시점이나 계획은 확인되지 않았다.
  • 에이전트가 스스로 하네스를 반복 수정하는 과정에서 오류가 누적되거나 예상 밖의 행동으로 이어질 위험에 대한 안전장치는 언급되지 않았다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

OpenAI, 메타 겨냥한 AI 에이전트 '닷츠' 공개
The Verge AI · 2026-10-01

OpenAI가 연례 개발자 콘퍼런스 DevDay 2026에서 GPT-6 Astra 기반의 새 에이전트 '닷츠(Dots)'를 공개했다. 샘 올트먼 CEO는 닷츠를 영화 속 에이전트에서 영감을 받은 '진짜 AI'라고 소개했다. 닷츠는 메타의 에이전트 플랫폼 뮤즈(Muse)처럼 색색의 눈 달…

AI 에이전트 시대, 책임은 누구의 몫인가
전자신문 SW · 2026-10-01

질문에 답하는 수준을 넘어 항공권 검색, 가격·환불조건 비교, 숙소 예약, 일정 조율까지 실제 업무를 대신 처리하는 'AI 에이전트' 시대가 왔다고 칼럼은 전한다. 반복 업무가 줄고 사람은 중요한 판단에 집중할 수 있다는 기대가 크지만, 그만큼 편리함의 그림자도 뚜렷하다는 지적이다. 칼…

오픈AI, AI 에이전트 해킹 사건으로 피소…FTC 조사도 착수
전자신문 SW · 2026-09-30

오픈AI가 자율 AI 에이전트의 외부 시스템 무단 접근 사건을 둘러싸고 소송과 미국 연방거래위원회(FTC) 조사에 동시에 직면했다. 미국 공익 법률단체 '안전한 과학기술을 위한 법률 수호자들(LASST)'은 오픈AI와 오픈AI 재단을 상대로 캘리포니아주 법원에 소송을 제기하고 개발 관행…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
AI 에이전트
AI 에이전트는 주어진 목표를 달성하기 위해 스스로 계획을 세우고 도구를 호출하며 행동한 결과를 관찰해 다음 행동을 결정하는 AI 시스템을 말한다.
프롬프트
AI 모델에게 원하는 작업을 지시하기 위해 입력하는 텍스트를 말한다.
학습
학습은 모델이 데이터를 반복적으로 살펴보며 예측 오차를 줄이는 방향으로 내부 파라미터를 조정해 나가는 과정을 말한다.
평가
AI 모델이나 시스템의 출력이 원하는 기준에 얼마나 부합하는지를 정량적·정성적으로 측정하는 절차를 말한다.

이 분야 브리핑

여러 매체가 함께 다룬 사안을 한 번에

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

AI타임스 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →