본문으로 건너뛰기

배포 모드

운영 환경에 맞는 배포 형태를 선택하세요.

  • All-in-One — 마스터와 에이전트를 같은 서버에서 실행합니다. 평가용이나 랩 환경, 단일 서버 설치에 적합합니다.
  • Multi-Node — 마스터 서버 1대와 GPU 서버마다 에이전트 1대씩. 운영 플릿에 권장합니다.
  • Hybrid — 한 서버에서 마스터와 에이전트를 함께 띄우고, 원격 GPU 서버의 에이전트도 이 마스터로 보고하게 합니다. 관리 호스트 자체에 GPU가 달려 있을 때 유용합니다.

All-in-One 배포

가장 단순한 구성 — 같은 호스트에서 마스터와 에이전트 서비스를 모두 실행합니다.

~$ mac pull all
~$ mac start all

컨테이너가 모두 올라오면 http://<this-host-ip>:23000에서 웹 대시보드를 엽니다.

Multi-Node 배포

1단계 — 마스터 기동

관리용 서버 (GPU 필요 없음)에서 다음을 실행합니다.

~$ mac pull master
~$ mac start master

CLI는 접속 정보를 다음과 같이 출력합니다.

Services started successfully

Access Information:
==================
Web Dashboard: http://10.1.5.7:23000
API Server: http://10.1.5.7:28080
Prometheus: http://10.1.5.7:29090

2단계 — 에이전트 등록

각 GPU 서버에서 마스터 주소를 지정하고 에이전트를 기동합니다.

~$ mac env set MASTER_IP=10.1.5.7
~$ mac pull agent
~$ mac start agent

에이전트는 자동으로 다음을 수행합니다.

  • MASTER_IP와 같은 /24 서브넷에 속한 호스트 IP를 탐지 (멀티 홈 서버에서 유용)
  • 별도 지정이 없으면 시스템 호스트네임을 NODE_NAME으로 사용
  • 마스터에 등록 — 마스터는 NODE_ID를 발급하고 Prometheus 스크랩 설정을 갱신

에이전트 해제

서버를 폐기하는 등 에이전트를 영구 해제하려면 다음을 실행합니다.

~$ mac stop agent

mac stop agent는 마스터에 통보해 인벤토리에서 해당 노드를 제거합니다. 단순히 잠시 오프라인이 되는 경우 (예: 유지보수 재부팅)는 등록 상태가 유지되므로, 장시간의 유지보수 기간에도 인벤토리가 그대로 보존됩니다.

Hybrid 배포

관리 호스트에도 GPU가 있다면, 해당 호스트에서 mac start all을 실행하고, 원격 GPU 서버는 MASTER_IP를 이 호스트로 맞춘 뒤 mac start agent로 띄우세요.

설치 확인

~$ mac status
NAME STATUS PORTS
mac-api-server running 0.0.0.0:28080->28080/tcp
mac-web-ui running 0.0.0.0:23000->80/tcp
mac-prometheus running 0.0.0.0:29090->9090/tcp
mac-metrics-bridge running 0.0.0.0:29199->29199/tcp
...

~$ curl -s http://localhost:28080/health
{"status":"healthy"}

~$ curl -s http://localhost:29090/api/v1/targets | jq '.data.activeTargets[] | {job, health}'
{ "job": "exporters", "health": "up" }
{ "job": "exporters", "health": "up" }

mac test를 실행하면 노드의 모든 MAC 서비스와 핵심 클러스터 API를 한 번에 점검할 수 있습니다 — [PASS]/[FAIL]/[SKIP] 표를 출력하고 모두 정상이면 0으로 종료합니다 (mac test 참고). 그런 다음 웹 대시보드를 열어 Cluster Overview 페이지를 확인합니다. 에이전트마다 타일이 하나씩 보이고, 메트릭이 정상적으로 들어오면 초록색으로 표시됩니다.

설치 완료 후 Cluster Overview설치 완료 후 Cluster Overview

업그레이드

새 릴리스로 업그레이드하려면 다음과 같이 합니다.

~$ sudo apt update
~$ sudo apt install --only-upgrade mango-ai-center
~$ mac pull all # 또는 호스트별로 master / agent
~$ mac restart all

APT 저장소 대신 단독 .deb로 설치했다면, 위의 두 apt 명령 대신 sudo dpkg -i mango-ai-center_<new-version>_amd64.deb를 실행하세요.

Prometheus 데이터, 등록된 에이전트, 사용자 계정은 업그레이드 후에도 그대로 유지됩니다.

제거

~$ mac stop all
~$ mac clean # 컨테이너·볼륨·네트워크·로컬 빌드 이미지 제거
~$ sudo apt remove mango-ai-center # 또는 sudo dpkg -r mango-ai-center

mac clean은 파괴적인 명령입니다. Prometheus 시계열 DB와 로그 기록이 모두 삭제됩니다. 지난 메트릭이 필요하다면 미리 Prometheus 볼륨을 백업해 두세요.