파이스가 참고한 연구
이 페이지 목차
스스로 고쳐도 안 망가지게MOSSThe Unfireable Safety KernelDarwin Gödel Machine (DGM)오래된 표준 셋배운 걸 쌓아 두기VoyagerMUSE-AutoskillSkillAudit기억과 지식LLM Wiki (Karpathy)OpenKBHermes Agent실행 없이 시험하기Dream-RSI조사 기록에만 있는 것가져오지 않은 것논문 번호는 열어 보고 전한다각 항목은 「무슨 말인가 · 파이스가 가져간 것 · 어디에 있나」 순서입니다. 단계 링크는 이 사이트의 제작 기록입니다.
스스로 고쳐도 안 망가지게
파이스는 자기 소스를 고칩니다. 고치다 망가지면 고칠 수단까지 같이 죽습니다. 그래서 되돌아오는 길을 먼저 만들었습니다.
MOSS
MOSS: Self-Evolution through Source-Level Rewriting in Autonomous Agent Systems (Cai 외) · 2026-05-21
- 무슨 말인가: 에이전트의 프롬프트(지시문)가 아니라 소스 코드 자체를 고치는 시스템입니다. 실제로 실패한 사례를 묶어 고칠 근거로 삼고, 고친 버전은 임시 작업 공간에서 그 사례를 다시 돌려 먼저 시험합니다. 사용자가 동의하면 바꿔 끼웁니다. 바꿔 끼운 뒤 90초 동안 5초마다 건강 검사를 해서 3번 연속 통과하면 확정하고, 아니면 되돌립니다. 되돌릴 곳은 요청서가 아니라 따로 적어 둔 「마지막 정상 버전」 기록에서 읽습니다.
- 파이스가 가져간 것: 같은 수치와 규칙입니다. 다시 띄운 뒤 90초 동안 5초마다 건강 검사를 하고, 3번 연속 통과해야 그 버전을 마지막 정상으로 올립니다. 못 하면 마지막 정상으로 되돌려 다시 띄웁니다. 되돌릴 곳도 따로 둔 기록 파일에서 읽습니다. 파이스가 덧붙인 것도 있습니다. 건강 검사를 통과해도 시험 틀(
selftest.js)이 실패하면 마지막 정상으로 올리지 않습니다. - 어디에 있나: 감시기
runner.js(맨 위 주석에 MOSS 가 적혀 있습니다) · 5단계의 「Phase 6 구조대」.
The Unfireable Safety Kernel
The Unfireable Safety Kernel: Execution-Time AI Alignment for AI Agents and Other Escapable AI Systems (Dobrin · Chmiel) · 2026-06-24
- 무슨 말인가: 안전장치를 에이전트와 같은 프로그램 안에 두면, 에이전트를 움직이는 입력이 안전장치에도 닿을 수 있다는 주장입니다. 그래서 안전 심사는 따로 도는 별도 프로그램에 맡기고, 심사가 안 되면 행동을 막는 쪽으로 실패하게 하자고 합니다.
- 파이스가 가져간 것: 「안전장치가 에이전트 손 안에 있으면 안전장치가 아니다」(파이스가 줄여 적은 말입니다). 자기수정 도구가 감시기 · 비상 화면 · 마지막 정상 기록을 못 고치게 막았습니다(읽기는 허용). 경로 표기를 바꿔 보는 등 6가지 시도를 시험해 전부 막힌 것을 확인했습니다. 한계도 적어 두었습니다. 셸(명령 실행기)을 쓰면 돌아갈 길이 남습니다.
- 어디에 있나:
tools.js의 금지 목록 · 커밋(저장 기록) 0906197, 메시지에 논문 번호 · 5단계의 「Phase 6 구조대」.
Darwin Gödel Machine (DGM)
Darwin Godel Machine: Open-Ended Evolution of Self-Improving Agents (Zhang 외) · 2025-05-29
- 무슨 말인가: 코딩 에이전트가 자기 코드를 고쳐 새 변형을 만들고, 변형마다 코딩 시험(SWE-bench · Polyglot)으로 점수를 매깁니다. 시험은 단계적입니다. 적은 문제로 먼저 거르고, 통과하면 더 큰 문제 묶음으로 갑니다. 변형을 모아 두는 보관소의 관리와 부모 고르기는 에이전트가 못 고치게 고정했다고 밝힙니다. 안전 논의에서는 시스템 한 부분을 고칠 수 없게 두고 그 부분이 나머지를 평가하고 멈추게 하는 방안을, 해 볼 만한 생각으로 언급합니다.
- 파이스가 가져간 것: 「바뀐 코드는 시험을 통과해야 들인다」입니다. 문법 검사는 통과하는데 기능이 죽은 코드를 시험 틀(
selftest.js)이 잡습니다. 자기수정은 이 시험을 통과해야 커밋되고, 통과한 버전만 마지막 정상이 됩니다. 시험 틀 파일 자체는 금지 목록에 없습니다. 대신 자기수정이 시험 틀을 깨뜨리면 실패로 보고 되돌립니다. 허점도 겪었습니다. 시험 부분을 지운 코드를 시험 틀이 「통과」로 봐서, 통과 문구가 실제로 찍혔는지까지 확인하게 고쳤습니다. - 어디에 있나:
selftest.js(맨 위 주석에 DGM 이 적혀 있습니다) · 5단계의 「Phase 7 스스로 좋아지는 구조」.
오래된 표준 셋
연구가 아니라 표준 문서입니다. 문서 페이지에는 날짜가 따로 없습니다.
Erlang/OTP — Supervisor Behaviour: 일하는 프로세스(돌고 있는 프로그램)를 지켜보다가 죽으면 다시 띄웁니다. 정해진 시간에 너무 자주 죽으면 포기하고 윗단에 넘깁니다.
Android — A/B (seamless) system updates: 시스템을 두 벌 두고 새 버전은 안 쓰는 쪽에 설치합니다. 새 쪽이 부팅하지 못하면 이전 쪽으로 돌아갑니다.
Kubernetes — Configure Liveness, Readiness and Startup Probes: 정해진 간격으로 컨테이너(프로그램을 담아 돌리는 상자)를 검사해서, 실패하면 다시 띄웁니다. 돌고는 있는데 멈춰 버린 상태처럼, 다시 띄워야만 풀리는 고장을 잡는 용도입니다.
파이스가 가져간 것: 파이스 조사 기록은 셋을 한 원리로 묶었습니다. 되살리는 층은 작고 안 바뀌어야 합니다. 「살아 있다」의 기준은 기능이 도는지입니다. 실패하면 마지막 정상으로 갑니다. 감시기, 모델을 부르지 않고 파이스 자신의 배선만 보는 깊은 건강 검사, 마지막 정상 기록이 이 원리를 옮긴 것입니다.
어디에 있나:
runner.js· 5단계의 「Phase 6 구조대」.
배운 걸 쌓아 두기
파이스가 능력을 얻는 길은 「내 소스를 고친다」(위험) 아니면 「없다」뿐이었습니다. 그 중간에 스킬 창고를 두었습니다. 스킬 창고는 시험을 통과한 작은 프로그램 파일을 쌓아 두는 곳입니다.
Voyager
Voyager: An Open-Ended Embodied Agent with Large Language Models (Wang 외) · 2023-05-25
- 무슨 말인가: 마인크래프트를 하는 AI 가 스스로 다음 목표를 정하며 계속 배웁니다. 잘 된 행동을 코드로 적어 창고에 쌓고, 나중에 꺼내 다시 씁니다. 모델을 다시 학습시키지 않고, 이미 있는 모델(GPT-4)을 그대로 부르면서 점점 능해집니다.
- 파이스가 가져간 것: 「성공한 코드를 버리지 않고 쌓는다」입니다. 스킬 하나는 파일 하나이고,
create_skill·list_skills·run_skill세 도구로 다룹니다. 심장부 코드를 안 건드리므로 스킬이 잘못돼도 파이스는 안 깨집니다. - 어디에 있나:
tools.js(스킬 창고 위 주석에 Voyager 가 적혀 있습니다) · 5단계의 「Phase 7 스스로 좋아지는 구조」.
MUSE-Autoskill
MUSE-Autoskill: Self-Evolving Agents via Skill Creation, Memory, Management, and Evaluation (Lin 외) · 2026-05-26
- 무슨 말인가: 스킬을 만들고 끝내지 않고, 만들기 · 기억 · 관리 · 평가 · 다듬기를 한 흐름으로 봅니다. 시험이 딸린 스킬은 시험을 통과해야 등록됩니다. 실패하면 오류를 읽고 고쳐서 다시 돌립니다.
- 파이스가 가져간 것: 「시험을 통과한 것만 창고에 둔다」입니다.
create_skill은 파일을 쓴 뒤 문법 검사와 스스로 시험(--selftest)을 돌립니다. 하나라도 실패하면 파일을 지우거나 되돌리고, 시험 출력을 돌려줘 고쳐서 다시 시도하게 합니다. - 어디에 있나:
tools.js의create_skill(코드 주석에는 이 이름이 없고, 조사 기록 ROADMAP 의 Phase 7 조사 칸에 SkillAudit 과 한 줄로 적혀 있습니다) · 5단계.
SkillAudit
SkillAudit: From Fixed-Suite Benchmarking to Skill-Centered Assessment (Yu 외) · 2026-06-21
- 무슨 말인가: 스킬을 미리 정한 문제 모음으로 재면 스킬의 몫과 모델 실력이 섞입니다. 그래서 스킬 꾸러미 안에서 시험 문제를 만들어 격리된 곳에서 돌리고, 쓸모 · 비용 · 안전을 보고서로 냅니다. 상위권 실제 스킬에 적용해 보니 7% 넘게가 위험 판정을 받았다고 보고합니다.
- 파이스가 가져간 것: 「검증 없이 스킬을 쌓으면 쓰레기를 쌓는 것」이라는 경계입니다(파이스가 붙인 말입니다). 코드 주석에 이 이름으로 남아 있고,
create_skill의 시험 관문이 그 구현입니다. 논문의 보고서 틀(쓸모 · 비용 · 안전 측정)은 가져오지 않았습니다. - 어디에 있나:
tools.js(create_skill안의 주석) · 5단계. - ※ 파이스 기록에는 논문 번호 없이 이름만 적혀 있었습니다. 이름이 같은 이 논문을 원문으로 달았습니다. 파이스 기록의 설명(「검증을 통과한 것만 남긴다」)은 이 논문보다 위의 MUSE-Autoskill 에 더 가깝습니다.
기억과 지식
LLM Wiki (Karpathy)
LLM Wiki (Andrej Karpathy 의 글 llm-wiki.md) · 2026-04-04
- 무슨 말인가: 질문이 올 때마다 원문에서 답을 새로 캐지 말고, AI 가 서로 링크된 마크다운 위키를 계속 가꾸자는 생각입니다. 원문(AI 는 읽기만) · 위키(AI 가 쓰고 고침) · 규칙 문서 세 층으로 나눕니다. 동작은 새 자료 넣기 · 질문하기 · 점검하기(모순과 낡은 주장 찾기) 셋입니다. 옵시디언(노트 앱)은 그 변화를 보는 화면입니다.
- 파이스가 가져간 것: 「회사 위키 층」입니다. 볼트(노트 폴더)를 뒤져 답한 턴의 결과를 위키 노트로 쌓고, 같은 질문이 또 오면 그 위키 노트를 원문 검색 결과 옆에 같이 붙입니다(처음엔 위키가 맞으면 원문 검색을 건너뛰었지만, 한 번 틀리게 정리된 노트가 되풀이되지 않도록 10/2 부터 원문 확인을 빼지 않습니다). 새 폴더를 만들지 않고 이미 있던 위키 폴더를 씁니다. 이 생각은 Hermes 스킬 허브의 llm-wiki 스킬을 한국어 플레이북으로 들이면서 가져왔습니다.
- 어디에 있나:
wiki.js(커밋 9411e46) · 11단계의 「Hermes Agent 적용」.
OpenKB
OpenKB (VectifyAI, Apache-2.0) · 저장소 생성 2026-04-04
- 무슨 말인가: 문서를 모아 AI 가 요약 · 개념 페이지 · 교차 링크로 엮어 위키를 만들어 주는 명령행 도구입니다. 결과는 평문 마크다운과
[[위키링크]]라서 옵시디언으로 바로 열립니다. 긴 PDF 는 벡터 데이터베이스(뜻 검색용 저장소) 대신 목차 구조를 타고 찾습니다. - 파이스가 가져간 것: 생각만입니다. 「AI 가 마크다운 파일을 관리하고 옵시디언은 보는 화면」이라는 것입니다. 파이스는 새 저장소나 새 형식을 만들지 않고, 이미 폴더에 든 마크다운 노트를 그대로 지식 창고로 씁니다. OpenKB 를 설치하거나 코드를 가져오지는 않았습니다.
- 어디에 있나: 노트 화면(서버 코드 0줄) 5단계 · 옵시디언 「제2 두뇌」 4단계.
Hermes Agent
Hermes Agent (NousResearch, MIT · 문서) · 저장소 생성 2025-07-22
- 무슨 말인가: 쓸수록 능해지는 오픈소스 개인 비서입니다. 기억 · 스킬 · 스킬 허브(남이 만든 절차 노트를 모아 둔 곳) · 지난 대화 검색 · 예약 실행을 갖췄고, 메신저 20여 곳에 붙습니다.
- 파이스가 가져간 것: 통째로 갈아타지 않고 좋은 것만 이식했습니다.
- 기억 병합: Hermes 는 기억 칸에 글자 예산이 있고, 넘으면 새 글을 거절하며 합쳐서 다시 쓰게 합니다. 파이스도 같은 사실이 4~5개로 흩어지던 것을 하나로 합치는
consolidate를 넣었습니다. - 배경 검토: 응답을 마친 뒤 따로 갈라낸 검토 단계가 기억과 스킬을 손봅니다. 파이스는 5분 간격을 기다리지 않고, 지난 검토 뒤 도구를 10번 쓰면 바로 이 검토가 돌게 했습니다.
- 원장과 되돌리기: Hermes 는 스킬이 바뀔 때마다 바뀌기 전과 후 내용을 한 줄씩 남겨 되돌릴 수 있게 합니다. 파이스도 플레이북(「이럴 땐 이렇게」 절차 노트)을 쓸 때마다 이전 전문을 남기는 원장을 만들었습니다.
- 스킬 허브 읽기: SKILL.md 형식의 절차 노트를 읽어 한국어 플레이북으로 번역해 들입니다. 실행 코드는 받지 않습니다. 13개가 들어왔습니다.
- 세션 검색: 지난 대화를 낱말로 찾는 기능을 따라, 3주 전 작업도 낱말 하나로 찾습니다.
- 예약 결과 전달: 예약이 끝나면 결과를 폰 알림 · 메일 · 캘린더로 보냅니다.
- 기억 병합: Hermes 는 기억 칸에 글자 예산이 있고, 넘으면 새 글을 거절하며 합쳐서 다시 쓰게 합니다. 파이스도 같은 사실이 4~5개로 흩어지던 것을 하나로 합치는
- 어디에 있나:
memory.js·reflect.js·playbook_ledger.js·skill_import.js·session_search.js·deliver.js· 11단계의 「Hermes Agent 적용」.
실행 없이 시험하기
Dream-RSI
Dream-RSI: Recursive Self-Improvement through Evolving Worlds (Zheng 외) · 2026-09-14
- 무슨 말인가: 에이전트가 새 방법을 시도하며 쌓은 기록을 가상 시험장으로 씁니다. 새 탐색 방식(어느 가지를 따라가고 언제 멈출지)을 다시 돌리지 않고, 기록 위에서 걸어 보며 점수를 매겨 고릅니다. 지금 방식도 후보에 같이 넣습니다. 그래서 기록 위 점수로는 새 방식이 지금보다 나빠지지 않습니다. 실제 성능에 대한 보장은 아닙니다.
- 파이스가 가져간 것: 「쌓인 기록이 곧 시뮬레이터」라는 생각입니다. 작업 기록 671건을 실행 0회로 다시 돌려 「정책이 달랐다면?」을 계산하는
replay_worklog.py를 만들었습니다(커밋 ad9ab12). 그럴듯한 아이디어 둘을 배포 전에 죽였습니다.- 「반복 상한을 낮추면 토큰을 아낀다」: 도구를 20번 이상 부른 작업 12건이 토큰의 43% 를 썼지만 성공률이 100% 였습니다. 상한을 지금의 40 에서 20 으로 낮추면 토큰은 167만 아끼고 성공 9건을 잃습니다. 상한은 그대로 뒀습니다.
- 「노트 읽기가 빗나가면 비슷한 이름을 알려 준다」: 실제 노트 6만 장으로 재 보니 빗나간 이유가 오타가 아니라 그 노트가 없어서였습니다. 8건 중 1건만 걸려서 만들다 걷어냈습니다.
- 논문에는 있고 파이스엔 아직 없는 것: 지금 방식을 후보에 넣고 더 나은 것이 있을 때만 바꾸는 선택 규칙입니다. 파이스의 자동 플레이북은 일단 바꾸고, 나빠지면 되돌리기 도구로 되돌리는 방식입니다. 한계도 있습니다. 기록에 없는 길(「다른 도구를 썼다면」)은 답할 수 없습니다.
- 어디에 있나:
replay_worklog.py(맨 위 주석에 Dream-RSI 가 적혀 있습니다) · 11단계의 「기록 재생으로 정책을 시험했다」.
조사 기록에만 있는 것
파이스의 조사 기록에 이름이 있지만, 가져간 자리를 코드에서 못 찾았거나 원문을 확정하지 못한 것입니다.
- Cradle: Empowering Foundation Agents Towards General Computer Control (Tan 외) · 2024-03-05: 화면만 보고 키보드와 마우스로 컴퓨터를 다루는 범용 에이전트 틀입니다. 스킬을 코드로 저장해 두고 새 과제와 비슷한 것을 꺼내 쓰며, 최근 화면과 결과는 따로 기억에 둡니다. 조사 기록(ROADMAP)에 한 줄 있지만 코드로 옮긴 자리는 못 찾았습니다. 기록에는 대문자 CRADLE 로 적혀 있었습니다.
- SIA: Self Improving AI with Harness & Weight Updates (Hebbar 외) · 2026-05-26: 에이전트의 틀과 모델 가중치를 한 고리에서 같이 고치되, 채점기는 고정해 둡니다. 파이스 기록에는 번호 없이 SIA 라는 이름만 있어 같은 논문인지 확정하지 못했습니다.
selftest.js주석에 DGM 과 나란히 적혀 있지만, 그 주석이 말하는 「벤치마크를 통과해야 채택」 문장은 이 논문에서 확인하지 못했습니다. - obsidian-llm-wiki: 원문을 다시 찾지 못함. 같은 이름의 저장소가 여럿이라 파이스 기록이 가리킨 것을 확정하지 못했습니다. 같은 생각(「AI 가 마크다운을 가꾸고 옵시디언은 보는 화면」)은 위의 LLM Wiki 와 OpenKB 에서 확인했습니다.
- 계층적 메모리 연구: 특정 논문 이름 없이 「2026년 공통 진단」 한 줄로만 적혀 있어 원문을 다시 찾지 못함.
가져오지 않은 것
가져오지 않기로 한 것과 이유도 기록에 같이 있습니다.
- Hermes 본체로 갈아타기: 파이스의 차별점인 회사 전용 연결부를 다시 붙여야 합니다. 이식이 더 쌌습니다.
- 메신저 게이트웨이: 회사 자료가 외부 메신저로 새는 길이 됩니다. 웹 화면을 유지했습니다.
- 여러 회사 모델에 흩뿌리는 두뇌 라우팅: 자료 통제가 안 됩니다.
- 외부 기억 서비스: 기억이 곧 회사 정보라서 맡기지 않았습니다.
- 탈옥 스킬: 금지했습니다.
- Hermes 클라우드 호스팅 · 도커 실행 환경 · 여러 인격(Bot Mode): 보류했습니다.
- 선택 스킬 셋(감시기 · 검색 · 코드 위키): 쓸 자리가 정해지지 않아 안 들였습니다.
- 구조대를 대화형 에이전트로 만들기: 그것이 깨지면 고칠 것이 또 필요한 끝없는 계단입니다. 버튼 몇 개짜리 정적 웹으로 뒀습니다.
- 건강 검사에 모델(두뇌) 넣기: 두뇌 장애는 남의 장애입니다. 넣으면 멀쩡한 코드를 자꾸 되돌립니다.
- 도구를 모듈이나 프로세스로 쪼개기: 도구 오류는 이미 격리돼 있습니다. 그어야 할 선은 도구와 코어 사이가 아니라, 고칠 수 있는 쪽과 못 고치는 쪽(구조대) 사이입니다.
- 멀티에이전트(에이전트 여럿이 역할을 나누는 것): 보류했습니다.
- 노트 그래프 화면: 조사 기록은 「제일 비싸고 제일 안 쓴다」며 미루기로 했습니다. 그런데 같은 날 낮에 파이스가 만든 첫 판이 들어갔습니다(5단계의 「HUD · 뇌 그래프」). 미루기로 한 것이 뒤집힌 경우입니다.
논문 번호는 열어 보고 전한다
2026-09-30 에 파이스는 논문 번호를 한 번도 열어 보지 않고 그대로 전한 일이 있습니다. 일을 나눠 맡긴 부서(하위 에이전트)가 돌려준 글 속의 번호였습니다. 부서의 답은 그럴듯해서, 감독 역할의 파이스가 검수 없이 옮겨 적기 쉽습니다. 8/17 에는 파일 경로가 잘려 링크 6개가 깨진 일도 있었습니다.
그래서 10/1 에 부서 결과에서 링크 · 논문 번호 · 파일 경로를 뽑아 「확인필요」 목록으로 감독에게 붙이는 함수(확인거리)를 넣었습니다. 시험 틀이 「뽑는다 · 공백 든 경로를 끝까지 잡는다 · 감독에게 붙인다」 세 가지를 매번 봅니다. 부서를 못 믿어서가 아닙니다. 옮겨 적기 전에 열어 볼 목록이 있어야 검수를 건너뛰지 못하기 때문입니다.
이 페이지도 같은 방식으로 썼습니다. 번호마다 원문을 직접 열어 제목 · 저자 · 날짜를 확인했고, 파이스가 가져간 내용이 걸린 대목은 본문까지 맞춰 보았습니다(Voyager 와 SkillAudit 는 초록까지). 열어 보니 파이스 기록이 원문보다 세게 적은 곳이 둘 있었습니다.
- MOSS 를 「바뀌지 않는 층과 바뀌는 층」으로 나눈 표는 파이스가 정리한 것입니다. 논문은 교체 담당이 에이전트 컨테이너 밖에 있다고만 적었습니다.
- 「평가 틀은 고쳐지면 안 되고, 변형은 벤치마크를 통과해야 채택된다」는 DGM · SIA 의 문장이 아닙니다. DGM 은 탐색 절차를 고정하고 단계별 시험을 두었을 뿐이고, SIA 는 채점기를 고정했다고만 적었습니다.