배포 모드
운영 환경에 맞는 배포 형태를 선택하세요.
- All-in-One — 마스터와 에이전트를 같은 서버에서 실행합니다. 평가용이나 랩 환경, 단일 서버 설치에 적합합니다.
- Multi-Node — 마스터 서버 1대와 GPU 서버마다 에이전트 1대씩. 운영 플릿에 권장합니다.
- Hybrid — 한 서버에서 마스터와 에이전트를 함께 띄우고, 원격 GPU 서버의 에이전트도 이 마스터로 보고하게 합니다. 관리 호스트 자체에 GPU가 달려 있을 때 유용합니다.
All-in-One 배포
가장 단순한 구성 — 같은 호스트에서 마스터와 에이전트 서비스를 모두 실행합니다.
~$ mac pull all
~$ mac start all
컨테이너가 모두 올라오면 http://<this-host-ip>:23000에서 웹 대시보드를 엽니다.
Multi-Node 배포
1단계 — 마스터 기동
관리용 서버 (GPU 필요 없음)에서 다음을 실행합니다.
~$ mac pull master
~$ mac start master
CLI는 접속 정보를 다음과 같이 출력합니다.
Services started successfully
Access Information:
==================
Web Dashboard: http://10.1.5.7:23000
API Server: http://10.1.5.7:28080
Prometheus: http://10.1.5.7:29090
2단계 — 에이전트 등록
각 GPU 서버에서 마스터 주소를 지정하고 에이전트를 기동합니다.
~$ mac env set MASTER_IP=10.1.5.7
~$ mac pull agent
~$ mac start agent
에이전트는 자동으로 다음을 수행합니다.
MASTER_IP와 같은/24서브넷에 속한 호스트 IP를 탐지 (멀티 홈 서버에서 유용)- 별도 지정이 없으면 시스템 호스트네임을
NODE_NAME으로 사용 - 마스터에 등록 — 마스터는
NODE_ID를 발급하고 Prometheus 스크랩 설정을 갱신
에이전트 해제
서버를 폐기하는 등 에이전트를 영구 해제하려면 다음을 실행합니다.
~$ mac stop agent
mac stop agent는 마스터에 통보해 인벤토리에서 해당 노드를 제거합니다. 단순히 잠시
오프라인이 되는 경우 (예: 유지보수 재부팅)는 등록 상태가 유지되므로, 장시간의 유지보수
기간에도 인벤토리가 그대로 보존됩니다.
Hybrid 배포
관리 호스트에도 GPU가 있다면, 해당 호스트에서 mac start all을 실행하고, 원격 GPU
서버는 MASTER_IP를 이 호스트로 맞춘 뒤 mac start agent로 띄우세요.
설치 확인
~$ mac status
NAME STATUS PORTS
mac-api-server running 0.0.0.0:28080->28080/tcp
mac-web-ui running 0.0.0.0:23000->80/tcp
mac-prometheus running 0.0.0.0:29090->9090/tcp
mac-metrics-bridge running 0.0.0.0:29199->29199/tcp
...
~$ curl -s http://localhost:28080/health
{"status":"healthy"}
~$ curl -s http://localhost:29090/api/v1/targets | jq '.data.activeTargets[] | {job, health}'
{ "job": "exporters", "health": "up" }
{ "job": "exporters", "health": "up" }
mac test를 실행하면 노드의 모든 MAC 서비스와 핵심 클러스터 API를 한 번에 점검할 수
있습니다 — [PASS]/[FAIL]/[SKIP] 표를 출력하고 모두 정상이면 0으로 종료합니다
(mac test 참고). 그런 다음 웹 대시보드를
열어 Cluster Overview 페이지를 확인합니다. 에이전트마다 타일이 하나씩 보이고,
메트릭이 정상적으로 들어오면 초록색으로 표시됩니다.


업그레이드
새 릴리스로 업그레이드하려면 다음과 같이 합니다.
~$ sudo apt update
~$ sudo apt install --only-upgrade mango-ai-center
~$ mac pull all # 또는 호스트별로 master / agent
~$ mac restart all
APT 저장소 대신 단독 .deb로 설치했다면, 위의 두 apt 명령 대신
sudo dpkg -i mango-ai-center_<new-version>_amd64.deb를 실행하세요.
Prometheus 데이터, 등록된 에이전트, 사용자 계정은 업그레이드 후에도 그대로 유지됩니다.
제거
~$ mac stop all
~$ mac clean # 컨테이너·볼륨·네트워크·로컬 빌드 이미지 제거
~$ sudo apt remove mango-ai-center # 또는 sudo dpkg -r mango-ai-center
mac clean은 파괴적인 명령입니다. Prometheus 시계열 DB와 로그 기록이 모두 삭제됩니다.
지난 메트릭이 필요하다면 미리 Prometheus 볼륨을 백업해 두세요.