EX5.ai
GPU 市场 + 模型 API

租用 GPU。
运行任意模型。
让 AI 上线。

ex5.ai 集 GPU 市场、统一模型 API、微调流水线、聊天工作区和编程 CLI 于一体——一个额度余额全部通用。可用银行卡充值。

打开控制台 →
$npm i -g @ex5/code即将推出
56
在线精选 GPU
$0.33/hr
起价
1
API 可用模型
99.99%
API 可用率(近 51 天)
01 / COMPUTE
GPU Cloud

来自经过验证的算力提供方的裸金属 GPU,按秒计费——从 H200 到 RTX 4090。

02 / INFERENCE
Model API

一个 OpenAI 兼容端点,即可调用 EX-1 及 50+ 款开源模型。按 token 付费。

03 / TRAINING
Fine-tune & Deploy

上传数据集,微调 EX-1 或任意开源模型,获得私有端点——只需一条命令。

04 / WORKSPACE
chat.ex5.ai + CLI

为所有模型打造的快速 Web 工作区,以及运行在终端里的智能体 CLI。

// GPU 市场

实时 GPU 市场

覆盖各地区的按需与可中断实例实时价格。数秒内租用,按秒付费,随时取消。

浏览全部报价 →
GPU
VRAM
TFLOPS FP16
地区
可用
可中断
ON-DEMAND
H200
141 GB
1979
us-ashburn-1
8×
$1.39/hr
$2.26/hr
租用
H100 SXM
80 GB
989
eu-frankfurt-2
8×
$1.16/hr
$1.93/hr
租用
A100 SXM4
80 GB
312
tr-istanbul-1
2×
$0.60/hr
$0.96/hr
租用
L40S
48 GB
362
nl-amsterdam-1
5×
$0.51/hr
$0.77/hr
租用
RTX 5090
32 GB
419
pl-warsaw-1
14×
$0.39/hr
$0.70/hr
租用
RTX 4090
24 GB
330
pl-warsaw-1
19×
$0.19/hr
$0.33/hr
租用

价格每 60 秒刷新 · 所有算力提供方均已验证并完成基准测试

// MODEL API

所有模型,一个 API

只需更换 base URL,代码无需改动。旗舰模型 EX-1 加上最好的开源模型,按百万 token 计价,与 GPU 从同一余额扣费。

curl
curl https://ex5.ai/v1/chat/completions \
  -H "Authorization: Bearer $EX5_KEY" \
  -d '{ "model": "ex5-security-27b", "messages": [...] }'
✓ OpenAI 兼容✓ streaming✓ tool use
// 专用模型

专精,而非通用

我们自研训练的任务专用模型——在各自擅长的领域,比前沿大模型更小、更快、更便宜。每个模型都在 chat.ex5.ai 提供 Playground,并有固定的 API ID。

SECURITY$0.15/1M
EX5-Security 27B

Security-focused fine-tune on a Qwen3.5-27B hybrid — Active Directory, pentest and blue-team reasoning. Runs on our own GPUs.

"model": "ex5-security-27b"
// FINE-TUNE & DEPLOY

数据放进来,
端点拿出去。

无需搭建集群,无需编写训练脚本。用市场 GPU 以竞价价格微调 EX-1 或任意开源模型,训练一结束,我们就将结果部署为私有的 OpenAI 兼容端点。

  1. 01
    上传 JSONL
    将数据集拖入控制台,或通过 CLI 推送——我们负责校验、切分和分词。
  2. 02
    一条命令开始训练
    LoRA 或全量微调,实时查看损失曲线。费用预先估算,按秒计费。
  3. 03
    训练完成自动部署
    在 ex5.ai 上获得私有、自动扩缩容的端点——或下载权重,部署到任何地方。
开始微调 →$ ex5-gpu tune start --base ex5-security-27b --data ./support.jsonl
ft-2841RUNNING示例2× H100 SXM · spot
基座模型
ex5-security-27b
数据集
support.jsonl
方法
LoRA r=32
epoch 2/3 · step 1,840/2,88064%
TRAIN LOSS
loss 0.412 ↓预计总费用 $21.40 · 已用时 1 小时 12 分
✓ 已部署 → https://ex5.ai/v1
"model": "acme-support-ex1" · 自动扩缩容 0→8 · 权重可下载
// CHAT.EX5.AI

适用所有模型的工作区

与 EX-1、你的微调模型或目录中的任意模型对话——支持文件、代码和网页搜索。按 token 计量,从同一余额扣费。

打开在线演示 →
chat.ex5.ai示例
ex5-security-27b ▾128K ctx · $0.55/1M in · $1.65/1M out
Write a CUDA kernel for fused top-k sampling.
X5
Here's a fused kernel that keeps the logits in shared memory and reduces in a single pass:
__global__ void fused_topk(float* logits, int k) {
  __shared__ float buf[1024];
  // warp-level bitonic sort, no global sync
  ...
1,204 tokens · $0.0021 · 96 tok/s
+给 ex5-security-27b 发消息…↑
// EX5 CLI

终端就是你的控制台

ex5.ai 上的一切都可脚本化:租用 GPU、实时查看日志、启动微调、部署端点。ex5 则是在你仓库中运行的智能体编程会话,由 EX-Code 32B 驱动。

  • ✓ ex5-gpu — 数秒内租用并 SSH 登录
  • ✓ ex5-gpu tune — 托管式微调
  • ✓ ex5-gpu deploy — 模型、容器、端点
  • ✓ ex5 — 在你的仓库中进行智能体编程
ex5 — zsh
$ ex5-gpu login
✔ authenticated as [email protected] · balance $48.20

$ ex5-gpu gpu rent --type rtx4090 --count 2 --max-price 0.40
✔ 2× RTX 4090 @ $0.34/hr · tr-izmir-2 · ssh ready in 41s

$ ex5-gpu tune start --base ex5-security-27b --data ./support.jsonl
⠸ ft-2841 running · epoch 2/3 · loss 0.412

$ ex5-gpu deploy ft-2841 --name acme-support
✔ live → ex5.ai/v1 · "model": "acme-support"

$ ex5 "fix the race condition in worker.rs"
agent reading worker.rs · 3 files changed · tests passing ✔
▊
// 使用流程

一个余额,三个步骤

01
充值额度

银行卡或电汇——数秒到账的预付额度,最低 $5。

02
选择你的层级

裸 GPU、模型 API、微调任务或聊天工作区——自由组合,共用同一余额。

03
上线与扩展

GPU 按秒计费,推理按 token 计费,统一一张账单。用完即可缩容至零。

EX5.ai

开始在 ex5.ai 上构建