Cloud

Cloud/Clusters

GPU Clusters

Manage your dedicated AI compute infrastructure.

prod-inference-us

running
us-east-1
NVIDIA H100 SXM

GPUs

8

Nodes

2

Queue

12

GPU Utilization73.0%
VRAM Usage468 / 640 GB
System Memory61.0%
10.0.0.0/16
10.0.1.0/24

Est. Monthly

$28,400.00

View Details

prod-inference-eu

running
eu-west-1
NVIDIA H200 SXM

GPUs

4

Nodes

1

Queue

3

GPU Utilization45.0%
VRAM Usage215 / 564 GB
System Memory38.0%
10.1.0.0/16
10.1.1.0/24

Est. Monthly

$19,200.00

View Details

staging-dev

running
us-west-2
NVIDIA A100 80GB

GPUs

4

Nodes

1

Queue

0

GPU Utilization22.0%
VRAM Usage58 / 320 GB
System Memory18.0%
10.2.0.0/16
10.2.1.0/24

Est. Monthly

$8,600.00

View Details

asia-inference

scaling
ap-southeast-1
NVIDIA L40S

GPUs

8

Nodes

2

Queue

47

GPU Utilization89.0%
VRAM Usage292 / 384 GB
System Memory76.0%
10.3.0.0/16
10.3.1.0/24

Est. Monthly

$12,800.00

View Details

fine-tuning-cluster

running
us-east-1
NVIDIA H100 SXM

GPUs

16

Nodes

4

Queue

2

GPU Utilization94.0%
VRAM Usage1.1K / 1.3K GB
System Memory88.0%
10.4.0.0/16
10.4.1.0/24

Est. Monthly

$56,800.00

View Details

eu-compliance

degraded
eu-central-1
AMD MI300X

GPUs

4

Nodes

1

Queue

0

GPU Utilization31.0%
VRAM Usage173 / 768 GB
System Memory27.0%
10.5.0.0/16
10.5.1.0/24

Est. Monthly

$14,200.00

View Details