DGX Spark Cluster Monitor

spark-01.local
All Systems Nominal
--:--:-- ----

Resources

GPU Util B200
0% OK
GB200 · 1.9 GHz · 48°C
Unified Memory LPDDR5X
0% OK
0.0 / 128 GB used
CPU Load 20C
0.00 OK
1-min load avg · 20 cores
Disk /local NVMe
0% OK
0 / 3.8 TB used
Network 10GbE
0 MB/s OK
↑ 0.0 MB/s · link up
Temp / Power SoC
48°C OK
165 W · fan 18%

Trends · last 5 min

GPU Utilization % / 2s 0%
-5m-2.5mnow
Unified Memory GB / 128 0.0 GB
-5m-2.5mnow

Services

Service Port Status Latency Uptime
sglang Quasar
Llama-3.1-8B-Instruct
:8003 Running 12 ms 6d 4h
LiteLLM
proxy · OpenAI-compatible
:8081 Running 3 ms 6d 4h
Jupyter Lab
notebook + kernels
:8888 Running 9 ms 2d 11h
Prometheus
metrics scrape
:9090 Degraded 340 ms 1d 0h
ModelScope Cache
hf.co mirror
:9123 Idle

Model Serving

Active inference
llama-3.1-8b-instruct · quantized fp8 · kv-cache 62%
Throughput184 tok/s
TTFT38 ms
Active seqs3
Queue1 req