Prime Agent

코딩 워크플로를 스스로 개선하는 RLM 기반 자율 에이전트

curl -fsSL https://app.primeintellect.ai/prime-agent/install.sh | sh

Prime Intellect 가 공개한 자기개선형 코딩 에이전트입니다. 강화학습 기반 언어 모델(RLM)로 장시간 실행되는 작업을 스스로 계획하고 수정하며, 실행 결과를 다음 시도에 반영합니다. 설치 스크립트 한 줄로 로컬에 올려 쓰고 코드는 MIT 라이선스로 공개돼 있습니다.

판단

이럴 때 씁니다

  • 터미널을 닫아도 계속 돌아야 하는 장시간 작업을 맡길 때
  • 서브에이전트를 별도 오케스트레이션 계층 없이 코드 안에서 함수처럼 호출하고 싶을 때
  • 반복되는 작업 패턴을 세션이 끝나도 남는 스킬로 굳혀 두고 싶을 때
  • 컨텍스트를 통째로 넘기지 않고 파이썬 변수로 잘라 다루고 싶을 때

이럴 땐 쓰지 마세요

  • 한두 파일만 고치는 단발성 작업이라 지속 상태가 필요 없을 때
  • 파이썬 REPL 을 상시 띄우는 실행 모델이 보안 정책상 부담일 때
  • 에이전트가 자기 하네스 상태를 갱신하는 동작 자체를 허용할 수 없을 때

차별점

  • 컨텍스트를 파이썬 변수로 다루는 RLM 구조라 프롬프트를 통째로 넘기지 않고 잘라서 전달합니다.
  • 서브에이전트가 별도 계층이 아니라 rlm(...) 함수 호출이라 코드 흐름 안에서 병렬 작업을 조립합니다.
  • Continual Harness 가 프롬프트·메모리·스킬·서브에이전트 명세를 지속 상태로 저장하고 /refine 으로 점진 갱신합니다.
  • 데몬이 세션을 유지해 터미널 연결이 끊겨도 작업이 이어지고 나중에 다시 붙을 수 있습니다.

워크플로

  1. 01설치 스크립트를 실행하고 프로바이더 로그인을 마칩니다.
  2. 02작업 디렉터리에서 세션을 시작하면 파이썬 IPython 환경이 함께 뜹니다. 파일 조작과 셸 실행이 전부 이 환경의 코드로 처리됩니다.
  3. 03병렬 작업이 필요하면 rlm(...) 으로 자식 에이전트를 띄우고 결과를 값으로 돌려받습니다.
  4. 04작업이 끝나면 /refine 으로 이번 궤적을 검토해 보조 하네스 상태에 근거 기반 갱신을 반영합니다. 기본 시스템 프롬프트는 바뀌지 않고 스냅샷으로 되돌릴 수 있습니다.

주요 명령

명령설명
curl -fsSL https://app.primeintellect.ai/prime-agent/install.sh | sh설치 스크립트로 prime-agent 를 올립니다.
rlm(...)세션 안에서 자식 에이전트를 띄우고 결과를 프로그램적으로 돌려받습니다.
/refine현재 궤적을 검토해 보조 하네스 상태를 근거 기반으로 소폭 갱신합니다.
brew upgrade prime-agentHomebrew 로 설치한 경우의 갱신 경로입니다. 자체 업데이트가 아니라 이 명령을 써야 합니다.

함정

설치 전에 확인하세요

  • 지속 IPython 이 핵심 실행 도구라 파일 조작과 셸 명령이 모두 코드로 나갑니다. 실행 환경을 격리하지 않으면 영향 범위가 넓습니다.
  • Homebrew 설치본은 자체 업데이트를 시도하면 안 되고 brew upgrade prime-agent 를 써야 합니다. v0.7.2 에서 이 안내가 수정됐습니다.
  • v0.7.2 부터 온보딩·명령 사용·실행 모드 등에 대한 가명 처리 제품 분석이 추가됐습니다. 수집을 원하지 않으면 옵트아웃 설정을 확인해야 합니다.
  • 데몬 기반이라 터미널을 닫아도 세션이 살아 있습니다. 의도치 않게 남은 세션이 자원을 계속 쓰지 않는지 주기적으로 확인해야 합니다.

검토 메모

공식 문서·릴리스·공개 자료를 바탕으로 정리한 편집 메모입니다.

저는 이 도구의 성격을 코딩 에이전트보다 자율 작업 런타임에 가깝게 봅니다. 다른 터미널 에이전트가 한 세션의 대화를 잘 굴리는 데 집중한다면, 이쪽은 세션이 끝난 뒤에도 남는 것을 설계의 중심에 놓았습니다. 서브에이전트가 별도 오케스트레이션 계층이 아니라 rlm(...) 함수 호출이라는 점이 그 성격을 가장 잘 보여 줍니다. 병렬 작업을 설정으로 선언하는 대신 코드 흐름 안에서 조립하게 됩니다.

도입을 검토하신다면 /refine 을 어떻게 다룰지부터 정하시길 권합니다. 에이전트가 자기 하네스 상태를 스스로 갱신한다는 것은 편리한 만큼 감사 대상이 늘어난다는 뜻이기도 합니다. 기본 시스템 프롬프트는 건드리지 않고 스냅샷으로 되돌릴 수 있게 해 둔 설계는 합리적이라고 보지만, 팀에서 쓴다면 어떤 갱신이 언제 들어갔는지 남기는 절차는 별도로 필요합니다.

실행 모델도 미리 계산에 넣으셔야 합니다. 지속 IPython 이 기본 도구라 파일 조작과 셸 명령이 전부 코드로 나가고, 데몬이 세션을 유지하므로 터미널을 닫아도 살아 있습니다. 장시간 작업에는 강점이지만 격리 없이 돌리면 영향 범위가 넓어집니다. 저라면 컨테이너나 전용 작업 디렉터리 안에서만 띄우고, 쓰지 않는 세션이 남아 있지 않은지 주기적으로 보겠습니다. v0.7.2 에서 가명 처리 제품 분석이 추가된 점도 조직에 따라 옵트아웃 확인이 필요한 항목입니다.

비교

Claude Code 나 Codex CLI 가 한 세션 안의 대화를 중심에 둔다면, Prime Agent 는 세션 밖으로 살아남는 상태를 중심에 둡니다. 지속 IPython 이 실행 도구이고 하네스 자체가 갱신 대상이라 장시간 자율 작업 쪽으로 무게가 실립니다. 반대로 한두 파일 고치는 작업에는 이 구조가 과합니다.

최근 변경

v0.8.1에서는 새 세션의 기본 RLM 최대 재귀 깊이를 1에서 2로 늘리고, ACP 프롬프트 요청이 인과적으로 연결된 서브에이전트·부모 작업이 모두 끝난 뒤에만 완료되도록 바꿨습니다. Cloudflare AI Gateway의 workers-ai 미러 ID가 카탈로그에서 빠지면서 기본 모델을 claude-sonnet-4.5로 교체하고, 여러 줄 triple-quoted 문자열의 구문 강조가 깨지던 문제도 고쳤습니다.