← All demos Simulated demo
ModelLlama-3-70B
Throughput0 tok/s
Active requests0
Queue depth0

GPU utilization (4x A100)

KV cache usage

block pool
0%

Recent completions

Request IDPrompt tokensOutput tokensLatencyStatus