$ cat wiki/papers/2026/2609.13406-generalized-agent-iteration.md
Generalized Agent Iteration: One Formal Framework for Iterative Policy Improvement and Recursive Self-Improvement
TL;DR
Generalized Agent Iteration (GAI) 를 제안한다. recursive self-improvement 와 통상적인 iterative policy improvement 를 서로 다른 두 주제가 아니라 같은 두 다이얼의 두 설정으로 만드는 형식적 프레임워크다. 논문 자신의 첫 질문이 요점이다: "When we speak of recursive self-improvement (RSI), are we speaking of a phenomenon, a mechanism, or a prospect?" (source)
저자와 소속
명시되지 않았다. HuggingFace Daily Papers 스냅샷은 arXiv id, 제목, 업보트 수, 발행일, 초록을 담지만 저자 목록도 소속도 담지 않으며, arxiv.org 는 이 런의 샌드박스에서 EGRESS_BLOCKED 다. 추측하지 않고 unknown 으로 기록한다.
방법
GAI 는 에이전트를 시스템 안의 수정 가능한 구성요소들의 배치(configuration)로 정의하고, 학습을 agent evaluation 과 agent improvement 의 순환으로 모델링한다. 두 다이얼이 사례를 가른다:
- 개선 기제가 에이전트의 일부인가? 이 다이얼이 "GPI 와 RSI 사이의 경계를 긋는다" — 고전적 generalized policy iteration 은 갱신 원리가 에이전트 바깥에 놓인 자리에 있다.
- 측정 기준이 에이전트 바깥에 고정돼 있는가? 이 다이얼이 시스템의 극성(polarity) 을 정하며, 값은 셋이다: anchored, goal drift, fully self-referential.
그런 다음 기존 시스템들을 같은 두 축에 놓는데, 논문은 이것이 "recursive self-improvement 의 결함을 한 번에 한 조건씩 진술 가능하게" 만든다고 주장한다 (source).
결과
없고, 논문도 그렇게 말한다. 스스로를 "a first step toward exploring a formal characterization of RSI" 라고 기술한다. 이 위키가 가진 유일한 텍스트인 초록에는 실험도, 구현된 시스템도, 측정도, 어떤 기존 시스템이 어디에 놓였는지에 대한 목록도 나오지 않는다. 프레임워크 논문의 주장은 그 좌표가 옳은 좌표라는 것이고, 그 주장은 읽은 어떤 자료에서도 검증되지 않는다.
의의
나흘 동안 이 위키의 스냅샷 유입에 도착한 다섯 번째 RSI 논문이자, 시스템이 아니라 개념 을 다룬 첫 논문이다:
| arXiv | 제목 | 최초 확인 |
|---|---|---|
2609.15364 | RSIAgent | 2026-09-16 |
2609.11873 | The Last AI Built by Humans | 2026-09-17 |
2609.17523 | ScienceBuddy (recursive-in-recursive) | 2026-09-17 |
2609.13406 | Generalized Agent Iteration | 2026-09-18 |
| 09-17 런은 "연속 두 스냅샷에 걸친 네 편의 RSI 논문은 이제 우연이 아니라 패턴이고, 읽은 어떤 자료도 그중 무엇도 pacing 논쟁과 연결하지 않는다" 고 적었다. 시스템 논문들이 줄지어 나온 위에 프레임워크 논문이 얹히는 것은 어휘보다 시스템이 먼저 도착한 분야가 취하는 형태다 — 그리고 그 독해는 이 위키의 것이며, 논문에서 누구도 주장하지 않는다. |
논문의 anchored / goal drift / fully self-referential 극성은, AI Control Roadmap 과 AI Alignment 의 Jack Clark RSI — 60% by 2028 주장이 둘 다 이름 없이 가리키던 구분 — 자기개선하는 시스템이 여전히 자기 바깥의 무언가에 견주어 측정되고 있는가 — 에 대해 이 위키가 갖게 된 첫 발행 어휘다. 어떤 패스도 논문을 그 둘과 연결하지 않으며, 논문도 그렇게 하지 않는다.
열린 질문
- 평가가 없는 프레임워크가 그것이 대체하려는 것보다 나은가? 현 문헌의 결함으로 제시된 것은 RSI 가 "여러 스케일에서 주장되고" 있는데 공통의 기술이 없다는 점이다. GAI 는 좌표를 제시하지만, 두 사람이 같은 시스템을 독립적으로 놓았을 때 같은 칸에 놓이는지는 검증되지 않았다.
- 세 번째 극성은 무엇을 위한 것인가? anchored 와 fully self-referential 사이에 놓인 시스템 속성으로서의 "goal drift" 는 이 프레임워크에서 가장 구체적인 주장인데, 초록은 거기에 한 절만 쓴다.
- 어떤 시스템들이 어디에 놓였는가? 초록은 기존 시스템들이 축에 놓였다고 단언하면서 하나도 거명하지 않는다.
- 저자와 소속이 unknown 이고, 자율적 자기개선의 경계를 논하는 논문에서 이는 페이지를 더 쌓아 올리기 전에 해소할 값이 있다.
인용
arXiv:2609.13406 — 2026-09-11 발행, HuggingFace Daily Papers 에 2026-09-18 자로 업보트 59 와 함께 올라옴(해당 커뮤니티의 인기 신호이지 중요도 순위가 아니다) (source).