GPUs mieten.
Jedes Modell nutzen.
KI live bringen.
ex5.ai ist ein GPU-Marktplatz, eine einheitliche Modell-API, eine Fine-Tuning-Pipeline, ein Chat-Workspace und eine Coding-CLI — ein Guthaben für alles. Aufladen per Karte.
npm i -g @ex5/codeBALDcurl https://ex5.ai/v1/chat/completions -d '{"model": "ex5-security-27b", ...}'Bare-Metal-GPUs von verifizierten Hosts, sekundengenau abgerechnet — von H200 bis RTX 4090.
Ein OpenAI-kompatibler Endpoint für EX-1 und 50+ offene Modelle. Bezahlt wird pro Token.
Datensatz hochladen, EX-1 oder ein beliebiges offenes Modell tunen, privaten Endpoint bekommen — ein Befehl.
Ein schneller Web-Workspace für jedes Modell und eine agentische CLI für dein Terminal.
Live-GPU-Markt
Echtzeitpreise für On-Demand- und unterbrechbare Instanzen in allen Regionen. In Sekunden mieten, sekundengenau zahlen, jederzeit beenden.
Preise aktualisieren sich alle 60 s · alle Hosts verifiziert & gebenchmarkt
Jedes Modell, eine API
Base-URL tauschen, Code behalten. Unser Flaggschiff EX-1 plus die besten offenen Modelle — Preise pro Million Tokens, abgerechnet vom selben Guthaben wie deine GPUs.
curl https://ex5.ai/v1/chat/completions \
-H "Authorization: Bearer $EX5_KEY" \
-d '{ "model": "ex5-security-27b", "messages": [...] }'Spezialisiert statt Allzweck
Aufgabenspezifische Modelle, die wir selbst trainieren — in ihrer Disziplin kleiner, schneller und günstiger als ein Frontier-Modell. Jedes hat einen Playground in chat.ex5.ai und eine stabile API-ID.
Security-focused fine-tune on a Qwen3.5-27B hybrid — Active Directory, pentest and blue-team reasoning. Runs on our own GPUs.
"model": "ex5-security-27b"Deine Daten rein.
Dein Endpoint raus.
Kein Cluster-Setup, keine Trainingsskripte. Fine-Tuning für EX-1 oder jedes offene Modell auf Marktplatz-GPUs zu Spot-Preisen — sobald das Training endet, stellen wir das Ergebnis als privaten, OpenAI-kompatiblen Endpoint bereit.
- 01JSONL hochladenZieh einen Datensatz in die Konsole oder push ihn per CLI — wir validieren, splitten und tokenisieren ihn.
- 02Ein Befehl zum TrainierenLoRA oder volles Fine-Tuning mit Live-Loss-Kurven. Die Kosten werden vorab geschätzt und sekundengenau abgerechnet.
- 03Auto-Deploy nach AbschlussEin privater, automatisch skalierender Endpoint auf ex5.ai — oder lade die Gewichte herunter und nimm sie überallhin mit.
$ ex5-gpu tune start --base ex5-security-27b --data ./support.jsonlEin Workspace für jedes Modell
Chatte mit EX-1, deinen Fine-Tunes oder jedem Katalogmodell — Dateien, Code und Websuche inklusive. Abrechnung pro Token, vom selben Guthaben.
__global__ void fused_topk(float* logits, int k) {
__shared__ float buf[1024];
// warp-level bitonic sort, no global sync
...Dein Terminal ist die Konsole
Alles auf ex5.ai ist skriptbar: GPUs mieten, Logs streamen, Fine-Tunings starten, Endpoints deployen. Und ex5 ist eine agentische Coding-Session in deinem Repo, angetrieben von EX-Code 32B.
- ✓ ex5-gpu — mieten & per SSH rein, in Sekunden
- ✓ ex5-gpu tune — verwaltetes Fine-Tuning
- ✓ ex5-gpu deploy — Modelle, Container, Endpoints
- ✓ ex5 — agentisches Coding in deinem Repo
$ ex5-gpu login ✔ authenticated as [email protected] · balance $48.20 $ ex5-gpu gpu rent --type rtx4090 --count 2 --max-price 0.40 ✔ 2× RTX 4090 @ $0.34/hr · tr-izmir-2 · ssh ready in 41s $ ex5-gpu tune start --base ex5-security-27b --data ./support.jsonl ⠸ ft-2841 running · epoch 2/3 · loss 0.412 $ ex5-gpu deploy ft-2841 --name acme-support ✔ live → ex5.ai/v1 · "model": "acme-support" $ ex5 "fix the race condition in worker.rs" agent reading worker.rs · 3 files changed · tests passing ✔ ▊
Ein Guthaben, drei Schritte
Karte oder Überweisung — Prepaid-Guthaben in Sekunden, mindestens $5.
Rohe GPUs, die Modell-API, ein Fine-Tuning-Job oder der Chat-Workspace — frei kombinierbar, ein Guthaben.
Sekundengenaue GPU-Abrechnung, Inferenz pro Token, eine Rechnung. Skalier auf null, wenn du fertig bist.
