TRAIL Compute Status Dashboard

Auto-refresh every 2h - Last update just now

⚠ Outage detected — some cluster data is stale. Showing the last successful query for each affected cluster.
Member Usage

Member Usage Allocated Cluster - Narval, Trillium - GPU util only on Trillium - Inactive = cpus/gpu<1 & mem<10GB

Member14D GPU HRS14D GPU Util14D Inactive GPU Hrs14D CLUSTERS
carril3438075% (277 GPU hrs)21Narval, Trillium
nisarbar30994% (35 GPU hrs)0Narval, Trillium
cwlee25695% (256 GPU hrs)0Trillium
chaddy21985% (219 GPU hrs)9Trillium
lla66-0Narval
aliza7417-0Narval
lavoiem910% (1 GPU hrs)0Trillium

Member Usage Other Cluster - Killarney, TamIA, Fir, Rorqual - GPU util only on Fir - Inactive = cpus/gpu<1 & mem<10GB

Member14D GPU HRS14D GPU Util14D Inactive GPU Hrs14D CLUSTERS
kuaitian292097% (2920 GPU hrs)0Fir
nisarbar127-0Killarney-L40S
adityahb49-0Killarney-L40S
aliza7410-0Killarney-L40S

Member Usage UTIAS Server - DGX, Apollo, Turing, Lovelace, UMS, UM1, UM2, UM3

Member14D GPU HRS14D Servers14D DAYS USED
nisarbar1173DGX, Lovelace, Turing11
trossen496DGX12
galcohen375Lovelace15
lock_gpu334DGX15
dawnd290UM313
mlavoie138Lovelace, Turing12
adityab111Lovelace, Turing12
johnl4Turing1
Cluster Usage

Allocated Cluster Usage

ClusterNode TypeGPU NODESLEVELFS14D GPU HRS USED14D GPU HRS TARGET14D QUEUE TIME14D USERS
Narval (stale · 6d 5h ago)4xA100-80GB1740.778481133126.5h4 (aliza741, carril34, lla, nisarbar)
Trillium4xH100-80GB610.6677576651.3h5 (carril34, chaddy, cwlee, lavoiem9, nisarbar)

UTIAS Server Usage

ClusterNode TypeGPU UTILUsers14D GPU UTIL14D USERS
DGX4xA100-SXM4-40GB4/4—65%3 (lock_gpu, nisarbar, trossen)
Apollo8xV100-32GB0/800%0
Turing4xRTX6000-Ada-48GB4/41 (nisarbar)99%4 (adityab, johnl, mlavoie, nisarbar)
Lovelace4xRTX6000-Ada-48GB4/41 (galcohen)69%4 (adityab, galcohen, mlavoie, nisarbar)
UMS1xRTX4090-24GB0/100%0
UM1 (stale · 114d 6h ago)1xRTX4090-24GB0/11 (trail)——
UM2 (stale · 114d 6h ago)1xRTX4090-24GB0/10——
UM31xRTX4090-24GB1/11 (dawnd)87%1 (dawnd)

Other Cluster Usage

ClusterNode TypeGPU NODESLEVELFS14D GPU HRS USED14D GPU HRS TARGET14D QUEUE TIMELocation
Killarney-L40S4xL40S-48GB1681.259176—0.1hVector, Toronto
Killarney-H1008xH100-48GB101.2590——Vector, Toronto
TamIA4xH100-HGX-80GB534202.9710——Mila, Montreal
Fir (stale · 2d 19h ago)4xH100-SXM5-80GB160 (60 MIG)0.0132920—0.6hSFU, Vancouver
Rorqual (stale · 7d 5h ago)4xH100-SXM5-80GB93 (27 MIG)0.0000——ETS, Montreal
UTIAS SERVERS historical data

GPU utilisation over time · last 14 days, % of GPUs in use, sampled each refresh

TRAIL GPU utilisation over time
External clusters historical data

Queue time, last observed vs 14d median · external clusters · ↖ most recent job (or longest current pending) · ↘ median over last 14 days

Combined queue time heatmap for external clusters

Historical Trends - 14d, queue times only shown for top 5 ...

Historical trends and daily GPU hours
External clusters live data
Pending jobs heatmap, all cluster users

Last updated 2026-08-23 14:00:11