Distributed GPU Cluster Infrastructure
EverestQ Cloud & Cluster
Scale inference across hundreds of GPU compute nodes with automated heartbeats, circuit breaker edge gateways (:9000), and Kubernetes HPA auto-scaling.
k8s/everestq-cluster.yamlyaml
apiVersion: apps/v1
kind: Deployment
metadata:
name: everestq-worker-pool
spec:
replicas: 4
selector:
matchLabels:
app: everestq-worker
template:
metadata:
labels:
app: everestq-worker
spec:
containers:
- name: worker
image: everestq/engine:v0.1.0
args: ["eq-worker", "--cloud-api", "http://eq-cloud:8080"]
resources:
limits:
nvidia.com/gpu: 1