EX5.ai
MERCADO DE GPU + API DE MODELOS

Alquila GPU.
Ejecuta cualquier modelo.
Lanza tu IA.

ex5.ai es un mercado de GPU, una API de modelos unificada, un pipeline de fine-tuning, un espacio de chat y una CLI de programación — un solo saldo de créditos lo mueve todo. Recarga con tarjeta.

Abrir consola →
$npm i -g @ex5/codePRONTO
48
GPU destacadas en línea
$0.34/hr
precio desde
1
modelos en la API
99.99%
Disponibilidad de la API, últimos 51 días
01 / COMPUTE
GPU Cloud

GPU bare-metal de hosts verificados, facturadas por segundo — desde H200 hasta RTX 4090.

02 / INFERENCE
Model API

Un único endpoint compatible con OpenAI para EX-1 y más de 50 modelos abiertos. Paga por token.

03 / TRAINING
Fine-tune & Deploy

Sube un dataset, ajusta EX-1 o cualquier modelo abierto y obtén un endpoint privado — con un solo comando.

04 / WORKSPACE
chat.ex5.ai + CLI

Un espacio de trabajo web rápido para todos los modelos y una CLI agéntica para tu terminal.

// MERCADO DE GPU

Mercado de GPU en vivo

Precios bajo demanda e interrumpibles en tiempo real en todas las regiones. Alquila en segundos, paga por segundo y cancela cuando quieras.

Ver todas las ofertas →
GPU
VRAM
TFLOPS FP16
REGIÓN
DISP.
INTERRUMPIBLE
ON-DEMAND
H200
141 GB
1979
us-ashburn-1
8×
$1.43/hr
$2.32/hr
Alquilar
H100 SXM
80 GB
989
eu-frankfurt-2
10×
$1.13/hr
$1.89/hr
Alquilar
A100 SXM4
80 GB
312
tr-istanbul-1
2×
$0.62/hr
$0.99/hr
Alquilar
L40S
48 GB
362
nl-amsterdam-1
1×
$0.52/hr
$0.79/hr
Alquilar
RTX 5090
32 GB
419
cz-prague-1
10×
$0.37/hr
$0.68/hr
Alquilar
RTX 4090
24 GB
330
pl-warsaw-1
17×
$0.19/hr
$0.34/hr
Alquilar

los precios se actualizan cada 60 s · todos los hosts verificados y con benchmark

// MODEL API

Todos los modelos, una sola API

Cambia la base URL y conserva tu código. Nuestro modelo insignia EX-1 y los mejores modelos abiertos, con precio por millón de tokens y cobrados del mismo saldo que tus GPU.

curl
curl https://ex5.ai/v1/chat/completions \
  -H "Authorization: Bearer $EX5_KEY" \
  -d '{ "model": "ex5-security-27b", "messages": [...] }'
✓ Compatible con OpenAI✓ streaming✓ tool use
// MODELOS ESPECIALIZADOS

Especializados, no de propósito general

Modelos ajustados a tareas concretas que entrenamos internamente — más pequeños, rápidos y baratos que un modelo frontier en su propio terreno. Cada uno tiene un playground en chat.ex5.ai y un ID de API estable.

SECURITY$0.15/1M
EX5-Security 27B

Security-focused fine-tune on a Qwen3.5-27B hybrid — Active Directory, pentest and blue-team reasoning. Runs on our own GPUs.

"model": "ex5-security-27b"
// FINE-TUNE & DEPLOY

Entran tus datos.
Sale tu endpoint.

Sin configurar clústeres ni escribir scripts de entrenamiento. Haz fine-tuning de EX-1 o de cualquier modelo abierto en GPU del mercado a precios spot, y desplegamos el resultado como un endpoint privado compatible con OpenAI en cuanto termina el entrenamiento.

  1. 01
    Sube un JSONL
    Arrastra un dataset a la consola o súbelo desde la CLI — nosotros lo validamos, dividimos y tokenizamos.
  2. 02
    Un comando para entrenar
    LoRA o fine-tuning completo con curvas de pérdida en vivo. El costo se estima por adelantado y se factura por segundo.
  3. 03
    Despliegue automático al terminar
    Un endpoint privado con autoescalado en ex5.ai — o descarga los pesos y llévalos a donde quieras.
Iniciar un fine-tuning →$ ex5-gpu tune start --base ex5-security-27b --data ./support.jsonl
ft-2841RUNNINGejemplo2× H100 SXM · spot
BASE
ex5-security-27b
DATASET
support.jsonl
MÉTODO
LoRA r=32
epoch 2/3 · step 1,840/2,88064%
TRAIN LOSS
loss 0.412 ↓total est. $21.40 · transcurrido 1h 12m
✓ desplegado → https://ex5.ai/v1
"model": "acme-support-ex1" · autoescalado 0→8 · pesos descargables
// CHAT.EX5.AI

Un espacio de trabajo para todos los modelos

Habla con EX-1, con tus modelos ajustados o con cualquier modelo del catálogo — archivos, código y búsqueda web incluidos. Medido por token y cobrado del mismo saldo.

Abrir la demo en vivo →
chat.ex5.aiejemplo
ex5-security-27b ▾128K ctx · $0.55/1M in · $1.65/1M out
Write a CUDA kernel for fused top-k sampling.
X5
Here's a fused kernel that keeps the logits in shared memory and reduces in a single pass:
__global__ void fused_topk(float* logits, int k) {
  __shared__ float buf[1024];
  // warp-level bitonic sort, no global sync
  ...
1,204 tokens · $0.0021 · 96 tok/s
+Escribe a ex5-security-27b…↑
// EX5 CLI

Tu terminal es la consola

Todo en ex5.ai se puede automatizar con scripts: alquila GPU, sigue logs en streaming, lanza fine-tunings, despliega endpoints. Y ex5 es una sesión de programación agéntica en tu repo, impulsada por EX-Code 32B.

  • ✓ ex5-gpu — alquila y entra por SSH en segundos
  • ✓ ex5-gpu tune — fine-tuning gestionado
  • ✓ ex5-gpu deploy — modelos, contenedores, endpoints
  • ✓ ex5 — programación agéntica en tu repo
ex5 — zsh
$ ex5-gpu login
✔ authenticated as [email protected] · balance $48.20

$ ex5-gpu gpu rent --type rtx4090 --count 2 --max-price 0.40
✔ 2× RTX 4090 @ $0.34/hr · tr-izmir-2 · ssh ready in 41s

$ ex5-gpu tune start --base ex5-security-27b --data ./support.jsonl
⠸ ft-2841 running · epoch 2/3 · loss 0.412

$ ex5-gpu deploy ft-2841 --name acme-support
✔ live → ex5.ai/v1 · "model": "acme-support"

$ ex5 "fix the race condition in worker.rs"
agent reading worker.rs · 3 files changed · tests passing ✔
▊
// CÓMO FUNCIONA

Un saldo, tres pasos

01
Carga créditos

Tarjeta o transferencia — créditos prepago en segundos, mínimo $5.

02
Elige tu capa

GPU en bruto, la API de modelos, un trabajo de fine-tuning o el espacio de chat — combínalos libremente, con el mismo saldo.

03
Lanza y escala

GPU facturadas por segundo, inferencia por token, una sola factura. Escala a cero cuando termines.

EX5.ai

Empieza a construir en ex5.ai