🦞 Preemptible VM 算力做市商 · 全维度深度分析

报告摘要统计 / Report Summary: 977条数据行 · 约50KB容量 · 覆盖8大核心章节 / 977 Rows · ~50KB · Covering 8

算力做市商 = 价格套利 + 中断容错 + 多云冗余 + 标准化接入

② 通过 Checkpoint/Restore + 多云自动切换 消化中断风险

③ 以 “企业级SLA” 溢价(但仍比公有云On-Demand便宜80%+)转售

④ 赚取风险溢价——本质上承销"中断风险"

层级 / Tier模式 / Model代表 / Representatives利润率 /

第一层

聚合者:P2P撮合,抽取5-15%佣金

第二层

智能经纪人:ML预测中断+自动多云切换

(管理费 / Fee)第三层

垂直整合:自建GPU数据中心,SLA保证

第四层

DePIN:链上逆拍卖+Token激励

协议费 <5% +

层级 / Tier类型与描述 / Type & Description价格 / Price (per hour)

公有云 On-Demand (锚定价格)

公有云 Spot (做市商采购源之一)

去中心化市场

消费级批处理 (极低成本批处理)

核心发现:公有云定价是独立GPU云商的 47倍 —— 做市商的定价锚应该使用CoreWeave层级,而非AWS。

H100价格趋势:2024 Q1 → 2025 Q2,Spot价格从$3-5/hr降至$1-1.50/hr(产能扩张+B200替代效应)

• 加权采购成本: $0.80 - $1.50 / hr(混合Vast.ai+RunPod+AWS兜底)

• 平台费 + 存储 + 运维: $0.15 / hr

• 企业级SLA套餐: $2.50 / hr

• 标准套餐: $1.80 / hr

• 批处理套餐: $1.20 / hr

做市商本质上是在承销中断风险——可以用 Black-Scholes 框架理解:

希腊值 / Greek含义 / Meaning做市商操作 / Market Maker Operation

价格敏感度

保持Spot/On-Demand仓位动态平衡

中断概率突变

新GPU发布/大客户入场时快速调仓

波动率敏感度

监控NVIDIA产线/出口管制/挖矿潮

时间衰减

长期预留锁定低波动,短期Spot弹需

替代成本

监控新渠道/新GPU的价格变化

组合对冲策略:Long Spot(低成本)+ Short On-Demand(转售SLA溢价)+ Checkpoint能力(保险)+ 跨云分散(降低相关性)

Karpenter: 高性能Spot节点自动扩缩 + 中断自动替换

Volcano: 华为开源,Gang Scheduling确保分布式训练一致性

Llama 70B 保存约1-3分钟(140GB参数)

Llama 405B 约5-10分钟

GPU Live/Hot Migration 工业界未完全解决 —— 主流是"优雅中断+快速恢复"

高端GPU

NVIDIA全系可获取

A100/H100/B200禁售,仅限H20等特供低配版

国产替代

几乎不存在

华为昇腾910B(≈A100 80%性能)等快速崛起

闲置来源

数据中心 + 消费级 + 矿场

ETH PoS后遗留大批矿场GPU(如大量RTX3090)

市场玩家

Vast.ai等商业模式渐趋成熟

<10家,极早期蓝海市场

合规运行

政策及监管严格受限

供给侧结构性过剩:矿场GPU残余 + AI中小企业倒闭潮释放算力 + 东数西算节点低利用率。

国产芯片生态碎片化:昇腾、寒武纪、壁仞等芯片厂商及客户迫切需要高效聚合者。

信息不对称套利:目前国产GPU公有云市场定价极其不透明,存在极大的套利空间。

→ 建立GPU供给网络(包括矿场及数据中心闲置算力) / Establish GPU supply network (mining + DC idle)→ 统一API接入层 / Unified API access layer→ 目标:100-500 GPU在线 / Target: 100-500 GPUs onlinePhase 2(12个月):容错层 / Fault Tolerance Layer→ Checkpoint/Restore自动化 + 多云智能路由 / Automated Checkpoint/Restore + multi-cloud intelligent routing→ 交付99%+可用性SLA保证 / Deliver 99%+ availability SLA guarantees→ 目标:1,000-5,000 GPU,通过企业客户验证 / Target: 1,000-5,000 GPUs, verified by enterprise clientsPhase 3(18-24个月):智能化层 / Intelligence Layer→ ML预测中断概率 + Agent-Native API / ML predicts interruption probabilities + Agent-Native API→ Token经济激励(视合规与监管情况而定) / Token incentives (subject to regulatory compliance)→ 目标:10,000+ GPU,成为区域性行业领导者 / Target: 10,000+ GPUs, regional market leader十、十大核心数据 / X. Top 10 Core Metrics#核心指标 / Key Metric数值 / Value全球Spot GPU市场规模 (2025E) / Global Spot GPU Market Size

47 倍 (47x)Salad 消费级算力最低价格 / Salad Consumer-grade Minimum Price

报告原文件:preemptible_compute_market_making_report.pdf · 双语全维度排版完成,适合直接打印阅读