AI Trend Notifier
EN
← wiki

$ cat wiki/papers/2026/2609.13406-generalized-agent-iteration.md

Generalized Agent Iteration: One Formal Framework for Iterative Policy Improvement and Recursive Self-Improvement

paper갱신 2026-09-18생성 2026-09-18

TL;DR

Generalized Agent Iteration (GAI) 를 제안한다. recursive self-improvement 와 통상적인 iterative policy improvement 를 서로 다른 두 주제가 아니라 같은 두 다이얼의 두 설정으로 만드는 형식적 프레임워크다. 논문 자신의 첫 질문이 요점이다: "When we speak of recursive self-improvement (RSI), are we speaking of a phenomenon, a mechanism, or a prospect?" (source)

저자와 소속

명시되지 않았다. HuggingFace Daily Papers 스냅샷은 arXiv id, 제목, 업보트 수, 발행일, 초록을 담지만 저자 목록도 소속도 담지 않으며, arxiv.org 는 이 런의 샌드박스에서 EGRESS_BLOCKED 다. 추측하지 않고 unknown 으로 기록한다.

방법

GAI 는 에이전트를 시스템 안의 수정 가능한 구성요소들의 배치(configuration)로 정의하고, 학습을 agent evaluationagent improvement 의 순환으로 모델링한다. 두 다이얼이 사례를 가른다:

  1. 개선 기제가 에이전트의 일부인가? 이 다이얼이 "GPI 와 RSI 사이의 경계를 긋는다" — 고전적 generalized policy iteration 은 갱신 원리가 에이전트 바깥에 놓인 자리에 있다.
  2. 측정 기준이 에이전트 바깥에 고정돼 있는가? 이 다이얼이 시스템의 극성(polarity) 을 정하며, 값은 셋이다: anchored, goal drift, fully self-referential.

그런 다음 기존 시스템들을 같은 두 축에 놓는데, 논문은 이것이 "recursive self-improvement 의 결함을 한 번에 한 조건씩 진술 가능하게" 만든다고 주장한다 (source).

결과

없고, 논문도 그렇게 말한다. 스스로를 "a first step toward exploring a formal characterization of RSI" 라고 기술한다. 이 위키가 가진 유일한 텍스트인 초록에는 실험도, 구현된 시스템도, 측정도, 어떤 기존 시스템이 어디에 놓였는지에 대한 목록도 나오지 않는다. 프레임워크 논문의 주장은 그 좌표가 옳은 좌표라는 것이고, 그 주장은 읽은 어떤 자료에서도 검증되지 않는다.

의의

나흘 동안 이 위키의 스냅샷 유입에 도착한 다섯 번째 RSI 논문이자, 시스템이 아니라 개념 을 다룬 첫 논문이다:

arXiv제목최초 확인
2609.15364RSIAgent2026-09-16
2609.11873The Last AI Built by Humans2026-09-17
2609.17523ScienceBuddy (recursive-in-recursive)2026-09-17
2609.13406Generalized Agent Iteration2026-09-18
09-17 런은 "연속 두 스냅샷에 걸친 네 편의 RSI 논문은 이제 우연이 아니라 패턴이고, 읽은 어떤 자료도 그중 무엇도 pacing 논쟁과 연결하지 않는다" 고 적었다. 시스템 논문들이 줄지어 나온 위에 프레임워크 논문이 얹히는 것은 어휘보다 시스템이 먼저 도착한 분야가 취하는 형태다 — 그리고 그 독해는 이 위키의 것이며, 논문에서 누구도 주장하지 않는다.

논문의 anchored / goal drift / fully self-referential 극성은, AI Control RoadmapAI Alignment 의 Jack Clark RSI — 60% by 2028 주장이 둘 다 이름 없이 가리키던 구분 — 자기개선하는 시스템이 여전히 자기 바깥의 무언가에 견주어 측정되고 있는가 — 에 대해 이 위키가 갖게 된 첫 발행 어휘다. 어떤 패스도 논문을 그 둘과 연결하지 않으며, 논문도 그렇게 하지 않는다.

열린 질문

  • 평가가 없는 프레임워크가 그것이 대체하려는 것보다 나은가? 현 문헌의 결함으로 제시된 것은 RSI 가 "여러 스케일에서 주장되고" 있는데 공통의 기술이 없다는 점이다. GAI 는 좌표를 제시하지만, 두 사람이 같은 시스템을 독립적으로 놓았을 때 같은 칸에 놓이는지는 검증되지 않았다.
  • 세 번째 극성은 무엇을 위한 것인가? anchored 와 fully self-referential 사이에 놓인 시스템 속성으로서의 "goal drift" 는 이 프레임워크에서 가장 구체적인 주장인데, 초록은 거기에 한 절만 쓴다.
  • 어떤 시스템들이 어디에 놓였는가? 초록은 기존 시스템들이 축에 놓였다고 단언하면서 하나도 거명하지 않는다.
  • 저자와 소속이 unknown 이고, 자율적 자기개선의 경계를 논하는 논문에서 이는 페이지를 더 쌓아 올리기 전에 해소할 값이 있다.

인용

arXiv:2609.134062026-09-11 발행, HuggingFace Daily Papers 에 2026-09-18 자로 업보트 59 와 함께 올라옴(해당 커뮤니티의 인기 신호이지 중요도 순위가 아니다) (source).

Referenced by

Sources