AX Code 받기 · 무료문서

이 페이지는 영어 문서의 번역입니다. 명령, 식별자, 예제는 그대로입니다. 런타임 7.24.4 · SDK 2.6.7. 영어 원문

검증된 다중 모델 변경

상태: 활성 범위: 현재 상태 최종 검토: 2026-08-21 담당: AX Code 런타임

중요한 변경이 있고, 한 번 이상 시도하고 싶으며, 저장소 자체의 검사가 어느 시도를 남길지 결정하게 하고 싶을 때의 작업 페이지입니다.

모드 참조, 즉 플래그, 구성 키, 순위 입력은 실행 모드를 보십시오. 이 페이지는 처음부터 끝까지의 작업입니다.

언제 가치가 있는가

여러 모델을 실행하면 하나보다 몇 배 더 듭니다. 변경이 중요하고 실패를 나중에 발견하는 비용이 클 때 효과가 있습니다. 모듈 경계를 넘는 리팩터, 마이그레이션, 보안에 민감한 코드의 수정, 어느 접근이 맞는지 정말로 모르는 변경입니다.

한 줄 편집, 이름 바꾸기, 읽어서 확인할 수 있는 일에는 가치가 없습니다.

서로 다른 두 도구

도구 만들어 내는 것 파일을 쓰는가
council 독립적인 검토 의견을 모음 아니요
arena 후보 구현을 순위로 매김 격리된 작업 트리에서만

무엇을 할지 정하려면 council를 사용합니다. 설계나 검토 질문을 연결된 여러 공급자에 퍼뜨리고, 답을 합의, 엄격한 과반, 소수, 단독 발견으로 모읍니다. 익명 토론 라운드를 선택할 수도 있습니다. 조언일 뿐입니다. 모델끼리 동의한다고 올바름의 증명은 아닙니다. 그 질문이 얼마나 다투어지는지에 대한 신호입니다.

어느 구현을 남길지 정하려면 arena을 사용합니다.

아레나 구현 작업 흐름

1. 준비

구현 모드에는 커밋이 하나 이상 있는 Git 프로젝트와 깨끗한 주 작업 트리가 필요합니다. 참가자 작업 트리는 정확한 기준 커밋에서 만들어지며 커밋되지 않은 변경을 물려받지 않으므로, 먼저 커밋하거나 stash합니다.

연결된 공급자에 서로 다른 선택 가능한 모델이 둘 이상 있어야 합니다. 공유 게이트웨이도 지원됩니다. 그리고 modes.arena.enabled: true가 필요합니다.

2. 실행

/arena <task description>

각 참가자는 기록된 기준 커밋에서 만든 자기 Git 작업 트리를 받고, 그 안에서 구현 에이전트가 실행됩니다. 참가자는 주 작업 트리를 수정하지 않습니다.

3. AX Code가 각 후보에 하는 일

  • 참가자의 추적된 변경과 추적되지 않은 변경을, 에이전트가 직접 만든 커밋을 포함해, 지속되는 브랜치 커밋으로 스냅샷합니다.
  • 감지된 프로젝트 검증 명령, 즉 타입 검사, 테스트, 린트를 실행합니다. 비어 있지 않은 패치가 잡힌 뒤에만 실행합니다. 빈 패치는 이길 수 없습니다.
  • 기본으로 검증 우선 순위를 매깁니다. 완료되고 비어 있지 않으며 검증을 통과한 패치만 이길 수 있습니다. 통과한 후보 중에서는 위험이 낮고 더 다양한 패치를 선호합니다.

4. 결정

보고서는 작업 트리 경로, 브랜치 이름, 커밋 범위를 줍니다.

AX Code는 승자를 병합하지 않습니다. 직접 살펴보고, 병합하거나, cherry-pick합니다. 의도된 동작입니다. 검증은 “이 패치에서 구성한 검사가 통과했다”는 뜻이며, 실제 신호이지만 검토를 대신하지는 않습니다.

5. 검토하고, 필요하면 되돌립니다

후보가 트리에 들어오면 증거 명령이 평소처럼 적용됩니다.

ax-code graph <sessionID>       # what the winning run actually did
ax-code risk <sessionID>        # heuristic risk signals for the change
ax-code session rollback <sessionID> --dry-run

실행 증거를 보십시오.

여기서 “검증됨”이 정확히 뜻하는 것

그 후보의 패치에 대해 프로젝트가 감지한 타입 검사, 린트, 테스트 명령이 실행되어 통과했다는 뜻입니다.

변경이 올바르거나, 완전하거나, 안전하거나, 잘 설계되었다는 뜻은 아닙니다. 테스트 스위트가 바뀐 동작을 다루지 않으면, 통과한 후보는 이미 다루던 것이 깨지지 않았다는 것만 보여 줍니다. 검증은 바닥을 높입니다. 천장을 인증하지는 않습니다.

일반 대화형 편집까지 확장되지도 않습니다. 아레나 후보와 게이트된 리팩터 적용은 검사를 실행합니다. 일반 세션의 평범한 edit나 write은 자동으로 그렇게 하지 않습니다. 일반 실행에 그 증거를 남기고 싶으면 verify_project을 실행합니다.

비용과 실패 방식

  • 비용은 참가자 수에 따라 늘어납니다. 각 참가자가 완전한 구현 에이전트를 실행합니다.
  • 더러운 작업 트리는 실행을 멈춥니다. 다른 일이 일어나기 전이며, 설계된 동작입니다.
  • 서로 다른 모델이 둘보다 적으면 비교가 무의미해지고, 도구는 순위를 지어내지 않고 그 사실을 보고합니다.
  • 모든 후보가 검증에 실패할 수 있습니다. 유용한 결과입니다. 보통 작업이 덜 지정되었거나, 저장소 검사가 에이전트의 가정보다 엄격하다는 뜻입니다.