EX5.ai
GPU-MARKTPLATZ + MODELL-API

GPUs mieten.
Jedes Modell nutzen.
KI live bringen.

ex5.ai ist ein GPU-Marktplatz, eine einheitliche Modell-API, eine Fine-Tuning-Pipeline, ein Chat-Workspace und eine Coding-CLI — ein Guthaben für alles. Aufladen per Karte.

Konsole öffnen →
$npm i -g @ex5/codeBALD
48
ausgewählte GPUs online
$0.34/hr
Einstiegspreis
1
Modelle in der API
99.99%
API-Uptime, 51 Tage
01 / COMPUTE
GPU Cloud

Bare-Metal-GPUs von verifizierten Hosts, sekundengenau abgerechnet — von H200 bis RTX 4090.

02 / INFERENCE
Model API

Ein OpenAI-kompatibler Endpoint für EX-1 und 50+ offene Modelle. Bezahlt wird pro Token.

03 / TRAINING
Fine-tune & Deploy

Datensatz hochladen, EX-1 oder ein beliebiges offenes Modell tunen, privaten Endpoint bekommen — ein Befehl.

04 / WORKSPACE
chat.ex5.ai + CLI

Ein schneller Web-Workspace für jedes Modell und eine agentische CLI für dein Terminal.

// GPU-MARKT

Live-GPU-Markt

Echtzeitpreise für On-Demand- und unterbrechbare Instanzen in allen Regionen. In Sekunden mieten, sekundengenau zahlen, jederzeit beenden.

Alle Angebote →
GPU
VRAM
TFLOPS FP16
REGION
VERFÜGBAR
UNTERBRECHBAR
ON-DEMAND
H200
141 GB
1979
us-ashburn-1
8×
$1.43/hr
$2.32/hr
Mieten
H100 SXM
80 GB
989
eu-frankfurt-2
10×
$1.13/hr
$1.89/hr
Mieten
A100 SXM4
80 GB
312
tr-istanbul-1
2×
$0.62/hr
$0.99/hr
Mieten
L40S
48 GB
362
nl-amsterdam-1
1×
$0.52/hr
$0.79/hr
Mieten
RTX 5090
32 GB
419
cz-prague-1
10×
$0.37/hr
$0.68/hr
Mieten
RTX 4090
24 GB
330
pl-warsaw-1
17×
$0.19/hr
$0.34/hr
Mieten

Preise aktualisieren sich alle 60 s · alle Hosts verifiziert & gebenchmarkt

// MODEL API

Jedes Modell, eine API

Base-URL tauschen, Code behalten. Unser Flaggschiff EX-1 plus die besten offenen Modelle — Preise pro Million Tokens, abgerechnet vom selben Guthaben wie deine GPUs.

curl
curl https://ex5.ai/v1/chat/completions \
  -H "Authorization: Bearer $EX5_KEY" \
  -d '{ "model": "ex5-security-27b", "messages": [...] }'
✓ OpenAI-kompatibel✓ streaming✓ tool use
// SPEZIALMODELLE

Spezialisiert statt Allzweck

Aufgabenspezifische Modelle, die wir selbst trainieren — in ihrer Disziplin kleiner, schneller und günstiger als ein Frontier-Modell. Jedes hat einen Playground in chat.ex5.ai und eine stabile API-ID.

SECURITY$0.15/1M
EX5-Security 27B

Security-focused fine-tune on a Qwen3.5-27B hybrid — Active Directory, pentest and blue-team reasoning. Runs on our own GPUs.

"model": "ex5-security-27b"
// FINE-TUNE & DEPLOY

Deine Daten rein.
Dein Endpoint raus.

Kein Cluster-Setup, keine Trainingsskripte. Fine-Tuning für EX-1 oder jedes offene Modell auf Marktplatz-GPUs zu Spot-Preisen — sobald das Training endet, stellen wir das Ergebnis als privaten, OpenAI-kompatiblen Endpoint bereit.

  1. 01
    JSONL hochladen
    Zieh einen Datensatz in die Konsole oder push ihn per CLI — wir validieren, splitten und tokenisieren ihn.
  2. 02
    Ein Befehl zum Trainieren
    LoRA oder volles Fine-Tuning mit Live-Loss-Kurven. Die Kosten werden vorab geschätzt und sekundengenau abgerechnet.
  3. 03
    Auto-Deploy nach Abschluss
    Ein privater, automatisch skalierender Endpoint auf ex5.ai — oder lade die Gewichte herunter und nimm sie überallhin mit.
Fine-Tuning starten →$ ex5-gpu tune start --base ex5-security-27b --data ./support.jsonl
ft-2841RUNNINGBeispiel2× H100 SXM · spot
BASIS
ex5-security-27b
DATENSATZ
support.jsonl
METHODE
LoRA r=32
epoch 2/3 · step 1,840/2,88064%
TRAIN LOSS
loss 0.412 ↓Gesamt ca. $21.40 · Laufzeit 1h 12m
✓ bereitgestellt → https://ex5.ai/v1
"model": "acme-support-ex1" · Autoscaling 0→8 · Gewichte herunterladbar
// CHAT.EX5.AI

Ein Workspace für jedes Modell

Chatte mit EX-1, deinen Fine-Tunes oder jedem Katalogmodell — Dateien, Code und Websuche inklusive. Abrechnung pro Token, vom selben Guthaben.

Live-Demo öffnen →
chat.ex5.aiBeispiel
ex5-security-27b ▾128K ctx · $0.55/1M in · $1.65/1M out
Write a CUDA kernel for fused top-k sampling.
X5
Here's a fused kernel that keeps the logits in shared memory and reduces in a single pass:
__global__ void fused_topk(float* logits, int k) {
  __shared__ float buf[1024];
  // warp-level bitonic sort, no global sync
  ...
1,204 tokens · $0.0021 · 96 tok/s
+Nachricht an ex5-security-27b…↑
// EX5 CLI

Dein Terminal ist die Konsole

Alles auf ex5.ai ist skriptbar: GPUs mieten, Logs streamen, Fine-Tunings starten, Endpoints deployen. Und ex5 ist eine agentische Coding-Session in deinem Repo, angetrieben von EX-Code 32B.

  • ✓ ex5-gpu — mieten & per SSH rein, in Sekunden
  • ✓ ex5-gpu tune — verwaltetes Fine-Tuning
  • ✓ ex5-gpu deploy — Modelle, Container, Endpoints
  • ✓ ex5 — agentisches Coding in deinem Repo
ex5 — zsh
$ ex5-gpu login
✔ authenticated as [email protected] · balance $48.20

$ ex5-gpu gpu rent --type rtx4090 --count 2 --max-price 0.40
✔ 2× RTX 4090 @ $0.34/hr · tr-izmir-2 · ssh ready in 41s

$ ex5-gpu tune start --base ex5-security-27b --data ./support.jsonl
⠸ ft-2841 running · epoch 2/3 · loss 0.412

$ ex5-gpu deploy ft-2841 --name acme-support
✔ live → ex5.ai/v1 · "model": "acme-support"

$ ex5 "fix the race condition in worker.rs"
agent reading worker.rs · 3 files changed · tests passing ✔
▊
// SO FUNKTIONIERT'S

Ein Guthaben, drei Schritte

01
Guthaben laden

Karte oder Überweisung — Prepaid-Guthaben in Sekunden, mindestens $5.

02
Wähl deine Ebene

Rohe GPUs, die Modell-API, ein Fine-Tuning-Job oder der Chat-Workspace — frei kombinierbar, ein Guthaben.

03
Live gehen & skalieren

Sekundengenaue GPU-Abrechnung, Inferenz pro Token, eine Rechnung. Skalier auf null, wenn du fertig bist.

EX5.ai

Jetzt auf ex5.ai loslegen