AX Code 받기 · 무료문서

이 페이지는 영어 문서의 번역입니다. 명령, 식별자, 예제는 그대로입니다. 런타임 7.24.4 · SDK 2.6.7. 영어 원문

지원 공급자와 모델

상태: 활성

범위: 현재 상태

최종 검토: 2026-09-19

담당: ax-code 런타임

이 페이지는 기본 설정 흐름에서 AX Code가 노출하는 공급자 프리셋을 나열합니다. 진실의 원천은 packages/ax-code/src/provider/default-setup-providers.ts의 런타임 공급자 허용 목록, packages/ax-code/src/provider/models-snapshot.json의 번들 모델 스냅샷, packages/ax-code/src/provider/local-runtime.ts의 로컬 런타임 프리셋, 그리고 packages/ax-code/src/provider/ax-engine/constants.ts의 AX Engine 정의입니다.

터미널 UI에서는 /connect를, 대화형 설정에는 ax-code providers login <provider-id>를 사용합니다. 헤드리스와 CI 환경은 나열된 환경 변수를 제공할 수도 있습니다.

연결된 공급자 관리

세션 보기는 세션 ID(클릭하면 복사), 제목, 실시간 상태가 있는 상단 막대를 유지하고, 그 뒤에 연결된 수를 보여주는 Providers 항목이 있습니다. 그 항목이나 manage를 누르면 공급자 관리자가 열리며, /providers 명령으로도 열 수 있습니다. 거기서 모델을 선택하거나 각 공급자를 끄거나 연결을 끊거나, 전체 /connect 흐름으로 이동할 수 있습니다.

  • 키 교체: /connect에서 공급자를 선택하고 Replace key를 고르거나, ax-code providers login <provider-id>를 다시 실행합니다.
  • 일시적으로 끄기: /providers 또는 /connect에서 Disable을 고르거나 ax-code providers disable <provider-id>를 실행합니다. 그러면 전역 구성의 disabled_providers에 공급자가 추가되고 저장된 자격 증명은 유지됩니다. 꺼진 공급자는 /providers와 /connect의 Disabled 아래에 계속 보이며, Enable 또는 ax-code providers enable <provider-id>로 다시 켤 수 있습니다.
  • 영구 연결 해제: /providers 또는 /connect에서 Disconnect를 고르거나 ax-code providers logout <provider-id>를 실행합니다. 그러면 auth.json에서 저장된 자격 증명이 삭제됩니다.

호스트된 모델 카탈로그는 각 AX Code 릴리스와 함께 제공되며, 사용할 수 있는 코딩 에이전트 능력으로 걸러집니다. ax-code models <provider-id>를 실행하면 설치한 릴리스의 권위 있는 모델 ID를 볼 수 있습니다. 원시 레지스트리와 복사한 웹 목록에는 텍스트 출력이나 도구 호출이 없어 AX Code가 숨기는 모델이 들어 있을 수 있습니다. 공급자 프리셋이 모든 모델이 무료이거나 모든 계정에서 쓸 수 있다는 뜻은 아닙니다.

런타임 선택

버전 없이 모델 선택

TUI와 ax-code run 모두 대소문자를 구분하지 않는 다음 --model 계열 이름을 받습니다.

계열 모델
deepseek deepseek-flash
glm glm-5.3-flash
qwen qwen3.8-flash

예를 들어 ax-code --model glm는 GLM Flash로 TUI를 열고, ax-code run --model qwen -- "Review this change"는 Qwen Flash를 요청합니다. 프롬프트는 -- 뒤에 두거나(또는 --prompt / --prompt-file를 전달합니다). --file는 파일을 첨부하며 프롬프트 파일이 아닙니다. ax-code models는 사용할 수 있는 provider/model ID를 나열합니다. 계열 이름은 네이티브 공급자 또는 같은 모델을 제공하는 연결된 게이트웨이를 통해 해석됩니다. 공급자를 이름 지을 수도 있습니다. --model my-gateway/glm입니다. 특정 버전이나 티어를 요청하려면 my-gateway/glm-5.3 같은 전체 ID를 사용합니다.

--model를 생략하면 구성, 에이전트, 세션, 최근 모델 선택이 유지됩니다. 쓸 수 있는 선택이 없으면 공유 폴백 순서는 연결된 공급자에 걸쳐 DeepSeek Flash, GLM Flash, 그다음 Qwen Flash로 시작합니다. 공급자 설정에는 자체 기본값이 있습니다. Alibaba Coding Plan은 qwen3-coder-plus를 쓰고, Alibaba Token Plan은 qwen3.8-flash를 씁니다.

런타임 연결

/connect의 선택은 API Cloud Provider, CLI Provider, AX-Engine runtime, Local LLM runtime, Private GPU cloud, AX Trust 순서입니다. AX-Engine runtime은 로컬 모델 선택과 런타임 관리를 바로 엽니다. Local LLM runtime은 다음 선택을 이 순서로 나열합니다.

메뉴 항목 공급자 id 기본 엔드포인트 호스트 환경 변수
Ollama ollama http://localhost:11434/v1 OLLAMA_HOST
LMStudio lmstudio http://localhost:1234/v1 LMSTUDIO_HOST
MTPLX mtplx http://localhost:8000/v1 MTPLX_HOST
oMLX omlx http://localhost:8000/v1 OMLX_HOST
AX-Studio ax-studio http://localhost:18080/v1 AX_STUDIO_HOST
Others local-llm OpenAI 호환 엔드포인트를 입력합니다 LOCAL_LLM_HOST

MTPLX와 oMLX 프리셋은 소스 체크아웃에서 사용할 수 있습니다. v7.19.3 패키지 바이너리에는 포함되지 않습니다. 도구 능력 구성, 선택적 인증, 공유 기본 포트 주의는 MTPLX와 oMLX 설정을 보십시오.

로컬 서버를 시작한 뒤 해당 메뉴 항목을 고르고 엔드포인트를 확인하거나 고칩니다. 생략되면 AX Code가 /v1를 추가합니다. Others는 구성 가능한 엔드포인트 하나를 local-llm 아래에 저장합니다. 다시 선택하면 엔드포인트를 바꿀 수 있습니다. LMStudio와 Others는 API 토큰 프롬프트 없이 기존 로컬 설정 흐름을 사용합니다. LM Studio는 모델 목록 엔드포인트를 문서화합니다.

설정 선택은 enabled_providers와 disabled_providers를 존중합니다. 선택기를 열기만 해서는 이 로컬 서버가 활성화되거나 조사되지 않습니다. 발견된 외부 로컬 모델은 보수적인 능력 기본값을 유지합니다. 코딩 에이전트 작업 흐름에서 선택하려면 모델이 도구 호출을 지원해야 합니다.

클라우드 API 공급자

이 공급자들은 호스트된 API 또는 호스트된 계정 플랜 엔드포인트를 호출합니다.

공급자 id 표시 이름 자격 증명 환경 변수
google 이름 Google GOOGLE_API_KEY, GOOGLE_GENERATIVE_AI_API_KEY, GEMINI_API_KEY
deepseek 이름 DeepSeek DEEPSEEK_API_KEY
meta 이름 Meta (Muse Spark) MODEL_API_KEY, META_MODEL_API_KEY
groq 이름 GroqCloud GROQ_API_KEY
openrouter 이름 OpenRouter OPENROUTER_API_KEY
huggingface 이름 Hugging Face HF_TOKEN
unorouter 이름 UnoRouter UNOROUTER_API_KEY
alibaba-coding-plan 이름 Alibaba Coding Plan ALIBABA_CODING_PLAN_INTL_API_KEY, ALIBABA_CODING_PLAN_API_KEY
alibaba-coding-plan-cn 이름 Alibaba Coding Plan (China) ALIBABA_CODING_PLAN_CN_API_KEY, ALIBABA_CODING_PLAN_API_KEY
alibaba-token-plan 이름 Alibaba Token Plan ALIBABA_TOKEN_PLAN_INTL_API_KEY, ALIBABA_TOKEN_PLAN_API_KEY
alibaba-token-plan-cn 이름 Alibaba Token Plan (China) ALIBABA_TOKEN_PLAN_CN_API_KEY, ALIBABA_TOKEN_PLAN_API_KEY
github-copilot 이름 GitHub Copilot GITHUB_TOKEN
zai 이름 Z.AI ZHIPU_API_KEY
zai-coding-plan 이름 Z.AI Coding Plan ZHIPU_API_KEY
minimax-coding-plan 이름 MiniMax Token Plan MINIMAX_TOKEN_PLAN_API_KEY, MINIMAX_API_KEY
minimax-cn-coding-plan 이름 MiniMax Token Plan (China) MINIMAX_TOKEN_PLAN_CN_API_KEY, MINIMAX_API_KEY

MiniMax는 Coding Plan의 이름을 Token Plan으로 바꿨습니다. 공급자 ID는 models.dev와 OpenCode에 맞추기 위해 minimax-coding-plan / minimax-cn-coding-plan로 남습니다. Token Plan 키 (sk-cp-…)는 platform.minimax.io (국제) 또는 platform.minimaxi.com(중국)에서 받습니다.

huggingface는 호스트된 Serverless Inference Providers 라우터(https://router.huggingface.co/v1)입니다. AX Engine이 내려받은 로컬 모델을 저장하는 로컬 Hugging Face 스냅샷 캐시와는 관계가 없습니다. huggingface를 연결해도 로컬 엔진이 시작되거나 필요하지 않습니다.

비용 없는 첫 실행은 무료 티어 API 빠른 시작을 보십시오. 그 문서는 공급자의 무료 제공과 AX Code의 호환성을 구분하고, 외부 무료 API 카탈로그 자체가 지원 행렬이 아닌 이유를 설명합니다.

Grok은 아래에 나열된 grok-build-cli 공급자를 통해서만 지원됩니다. AX Code는 더 이상 직접적인 xai 클라우드 API 공급자를 포함하지 않습니다. 기존의 Grok API 자격 증명은 연결을 만들지 않습니다.

github-copilot는 GitHub Copilot 계정 다리입니다. 일부 무료 API 디렉터리가 나열하는 별도의 github-models API가 아닙니다.

OpenAI 호환과 Anthropic 호환 게이트웨이도 사용자 지정 공급자 구성으로 지원됩니다. 사용자 지정 및 게이트웨이 공급자를 보십시오.

사설 GPU 클라우드

이 공급자들은 Local LLM runtime 다음, Private GPU cloud 아래의 /connect에 나타납니다.

자신의 OpenAI 호환 GPU 엔드포인트를 연결하려면 Custom provider를 고릅니다. URL과 API 키를 입력합니다. AX Code는 /v1/models에서 모델을 발견하고 키를 암호화된 인증 저장소에 저장합니다. 저장된 연결은 Private GPU cloud에 남습니다. 다시 선택하면 모델을 고르거나, 엔드포인트를 바꾸거나, 연결을 끊습니다. 이 항목은 custom-private-gpu 아래에 구성 가능한 엔드포인트 하나를 저장합니다.

카탈로그(API 키)

OpenCode 방식의 호스트된 GPU 카탈로그입니다. 모델은 번들 models.dev 스냅샷에서 옵니다. API 키로 연결합니다.

공급자 id 표시 이름 자격 증명 환경 변수
nebius 이름 Nebius Token Factory NEBIUS_API_KEY
fireworks-ai 이름 Fireworks AI FIREWORKS_API_KEY
togetherai 이름 Together AI TOGETHER_API_KEY
baseten 이름 Baseten BASETEN_API_KEY
nvidia 이름 NVIDIA NIM NVIDIA_API_KEY
deepinfra 이름 Deep Infra DEEPINFRA_API_KEY

호스트된 Hugging Face 라우터(huggingface / HF_TOKEN)는 클라우드 API 공급자에 남습니다. 전용 Hugging Face Inference Endpoints는 아래에 나열됩니다.

전용(URL과 토큰)

PAI 방식의 전용 GPU 엔드포인트입니다. OpenAI 호환 URL과 토큰을 붙여 넣습니다. AX Code는 GET …/models를 호출하고 배포된 모델 ID를 사용합니다. 이들은 Alibaba Coding Plan / Token Plan(DashScope) 공급자가 아닙니다.

공급자 id 표시 이름 자격 증명 환경 변수
alibaba-pai 이름 Alibaba PAI-EAS ALIBABA_PAI_API_KEY, ALIBABA_PAI_BASE_URL
runpod 이름 RunPod RUNPOD_API_KEY, RUNPOD_BASE_URL
huggingface-endpoints 이름 Hugging Face Endpoints HF_ENDPOINTS_TOKEN, HF_ENDPOINTS_BASE_URL
sagemaker 이름 Amazon SageMaker SAGEMAKER_API_KEY, SAGEMAKER_BASE_URL
volcengine-ark 이름 Volcengine Ark ARK_API_KEY, ARK_BASE_URL
modelarts 이름 Huawei ModelArts MODELARTS_API_KEY, MODELARTS_BASE_URL
tencent-ti 이름 Tencent TI TENCENT_TI_API_KEY, TENCENT_TI_BASE_URL
custom-private-gpu 이름 Custom provider CUSTOM_PRIVATE_GPU_API_KEY, CUSTOM_PRIVATE_GPU_BASE_URL

sagemaker는 SageMaker 앞의 OpenAI 호환 URL(vLLM / TGI / API Gateway)용입니다. AWS SigV4에 서명하지 않습니다.

AX Trust

AX Trust는 Private GPU cloud 다음, /connect의 마지막 범주입니다. Connect AX Trust를 고르고, /v1를 포함한 게이트웨이 기본 URL을 입력한 뒤 클라이언트 API 키를 제공합니다. AX Code는 게이트웨이의 모델을 발견하고 키를 암호화된 인증 저장소에 저장합니다. 저장된 연결은 모델 선택, 엔드포인트 갱신, 모델 새로고침, 삭제를 제공합니다.

기존 URL에 다시 연결할 때 토큰을 비워 두면 그 공급자 ID, 모델, 저장된 키가 유지됩니다. 사용자 지정 이름이 있어도 공급자는 AX Trust에 남습니다. 레거시 ax-trust와 ax-trust-* ID도 이 범주에 나타납니다. AX Trust는 계속 게이트웨이 정책, 승인, 감사를 소유합니다. AX Code는 이 연결에 기본적으로 세션 친화 헤더를 보냅니다.

CLI 공급자

CLI 공급자는 AX Code에 호스트된 API 키를 저장하는 대신 로컬 벤더 CLI와 그 로그인과 세션을 재사용합니다.

공급자 id 표시 이름 필요한 로컬 명령 지원 모델 id
claude-code 이름 Anthropic (Claude Code) claude claude-code
codex-cli 이름 OpenAI (Codex CLI) codex codex-cli
grok-build-cli 이름 Grok Build CLI grok grok-build-cli
muse-cli 이름 Muse Code CLI muse muse-cli

필요하면 먼저 벤더 CLI 로그인을 실행한 뒤 ax-code providers login <provider-id>를 실행합니다. AX Code는 CLI 명령을 조사하고, 조사가 성공하면 로컬 표지 자격 증명을 저장합니다.

Muse Code의 경우 로컬 muse 바이너리를 설치하고, muse login를 실행하거나(또는 META_API_KEY를 설정한 뒤) ax-code providers login muse-cli를 실행합니다. AX Code는 호스트된 Meta API 키를 저장하지 않고 Muse CLI 세션(~/.config/muse)을 재사용합니다. 호스트된 meta API 공급자는 별도의 연결로 남습니다.

호스트된 MiniMax Token Plan은 minimax-coding-plan / minimax-cn-coding-plan로 계속 사용할 수 있습니다. 번들된 MiniMax Code CLI나 Kimi Code CLI 공급자는 없습니다.

AX Engine 로컬 공급자

ax-engine는 내장 로컬 추론 공급자입니다. 자격이 있는 Apple Silicon Mac에서만 사용할 수 있으며, AutomatosX Tiel Coder와 Cyber-Tiel Coder 35B A3B MXFP4 MTP 개발 팩만 제공합니다. 네이티브 능력은 모델이 시작될 때 검사됩니다.

공급자 id 모델 id 선택 컨텍스트 출력
ax-engine tiel-coder-35b-axq-mxfp4 Tiel Coder 35B A3B MXFP4 MTP (기본) 65,536 8,192
ax-engine cyber-tiel-coder-35b-axq-mxfp4 Cyber-Tiel Coder 35B A3B MXFP4 MTP 65,536 8,192

Qwen3.8 27B, Ornith, Qwen3-Coder-Next와 그 밖의 모든 저장소는 관리형 선택에서 제외됩니다. 역사적 기록은 상태와 정리를 위해 읽을 수 있습니다.

기본 로컬 모델은 tiel-coder-35b-axq-mxfp4입니다. 정확히 선택된 저장소, 메모리, 디스크 안내는 AX Engine 모델 선택을 보십시오.

따로 구성된 기존의 루프백 연결 인터페이스에서는 /v1/models가 권위입니다. AX Code는 실시간 모델 ID, 컨텍스트와 출력 한도, 모달리티, 구조화된 도구 호출 지원을 발견합니다. 구조화된 도구 호출을 알리지 않는 모델은 코딩 에이전트 요청에 쓰이지 않습니다.

AX Engine은 기본적으로 간결한 core 도구 프로필을 사용합니다(bash, 파일 발견과 읽기, 편집, 쓰기, 그리고 스킬). 완전한 도구 레지스트리에 충분한 컨텍스트가 있는 사용자 지정 배포에서만 provider.ax-engine.options.toolProfile를 full로 설정합니다.

엔진 설치

로컬 추론에는 AX Engine 7.5.7 이상이 필요합니다. Apple Silicon Mac 설치 프로그램에는 이미 자체 포함 AX Engine 사이드카(CLI 런타임 옆의 engine/<version>/)가 들어 있으므로, 깨끗한 Mac에는 Homebrew가 필요하지 않습니다.

그다음 AX Code는 이 순서로 바이너리를 해석합니다.

  1. provider.ax-engine.options.binaryPath, 위치는 ax-code.json입니다(검증된 버전이 최소 7.5.7이어야 합니다).
  2. AX_ENGINE_BIN 환경 변수입니다(검증된 버전이 최소 7.5.7이어야 합니다).
  3. ax-engine, 대상은 PATH입니다(검증된 버전이 최소 7.5.7이어야 합니다).
  4. AX Code가 관리하는 오버레이 설치입니다(ax-code providers ax-engine install, 역시 최소 7.5.7이 필요합니다).
  5. 현재 Mac 런타임에 번들된 사이드카입니다.

먼저 --version를 확인하고, install.version로 폴백하며 그 출처는 ax-engine doctor --json입니다. Doctor의 종료 코드는 호스트 준비 상태(Metal 도구 모음, MLX 파일)를 보고하므로, 그 JSON에 버전이 있으면 0이 아닌 종료도 인정됩니다. AX Code가 서버 시작을 소유하고, 보통 ax-engine serve를 127.0.0.1:31418에서 실행합니다. 선택적 Homebrew 포뮬러는 brew가 소유하는 엔진을 원하는 사용자를 위한 대안으로 남으며, 필수는 아닙니다.

관리형 Tiel 실행은 카탈로그 창(컨텍스트 토큰 65,536, 출력 토큰 8,192)을 사용하며, 이는 에이전트 프롬프트가 들어가도록 ax-engine serve의 내장 16,384토큰 기본값보다 큽니다. provider.ax-engine.options.contextTokens와 provider.ax-engine.options.maxOutputTokens로 어느 예산이든 줄입니다(outputTokens는 같은 출력 조절입니다). 환경 이름은 AX_ENGINE_CONTEXT_TOKENS와 AX_ENGINE_MAX_OUTPUT_TOKENS입니다(AX_ENGINE_OUTPUT_TOKENS는 별칭입니다). 덮어쓰기는 카탈로그 상한을 좁힐 수만 있습니다. 더 크거나 잘못된 값은 보고되고 무시되며, 1,024의 배수가 아닌 Tiel 또는 Qwen3.8 창은 접두사 캐시 블록이 1,024토큰을 유지하도록 아래로 맞춥니다. 같은 숫자가 실행 중인 서버와 모델 한도가 사용하는 값입니다. 실시간 /v1/models 카드는 그 창을 더 줄일 수 있고, 올릴 수는 없습니다. 구성된 옵션이 우선하며, 환경 값이 무시되면 AX Code가 경고합니다. binaryPath가 AX_ENGINE_BIN를 무시할 때, 또는 connectionMode / baseURL가 AX_ENGINE_HOST를 무시할 때도 같은 경고가 나갑니다. 더 작은 창은 전체 에이전트 프롬프트에 너무 작을 수 있습니다. 그때 AX Code는 서버가 담을 수 없는 프롬프트를 보내는 대신 모델을 거부합니다.

Tiel과 Cyber-Tiel은 구조화된 도구 호출을 알립니다. 서버가 실행되면 실시간 /v1/models 카드가 그 알림을 덮어씁니다. mtpPolicy: disabled는 바이너리 버전을 읽을 수 없어도 MTP를 끕니다. auto와 required는 여전히 AX Engine 7.4.0 이상이 필요합니다.

libmlx.dylib / mlx.metallib가 없는 PATH 또는 오버레이 설치는 거부됩니다. 번들과 오버레이 아카이브는 자체 포함 7.5.7 macOS 페이로드입니다.

엔진을 설치해도 모델은 내려받지 않습니다. 그 뒤에 Desktop Models 페이지에서, 또는 ax-code providers ax-engine prepare로 모델을 고르고 내려받습니다. Hugging Face 캐시에 이미 있는 완전하고 호환되는 기본 스냅샷은 직접 디코드에 받아들여집니다. prepare --download는 사용할 수 있을 때 카탈로그가 선호하는 MTP 패키지를 사용합니다.

/connect를 연 뒤 AX-Engine runtime, 그다음 Select a model을 고릅니다. 선택한 모델이 필요할 때 AX Code가 로컬 런타임을 구성하고 자동으로 시작합니다. URL이나 API 키는 필요하지 않습니다. View status, Stop local runtime, Disable이 로컬 런타임을 관리합니다. 모델을 선택하면 레거시 수동 연결 설정도 관리형 로컬 설정으로 바뀝니다.

엔진은 Apple Silicon macOS용으로만 제공됩니다. 다른 호스트에서는 호스트된 공급자 또는 OpenAI 호환 공급자 게이트웨이를 사용합니다. AX Code 서버는 로컬 전용입니다.