🦞 Preemptible VM 算力做市商 · 全维度深度分析
报告摘要统计 / Report Summary: 977条数据行 · 约50KB容量 · 覆盖8大核心章节 / 977 Rows · ~50KB · Covering 8
算力做市商 = 价格套利 + 中断容错 + 多云冗余 + 标准化接入
② 通过 Checkpoint/Restore + 多云自动切换 消化中断风险
③ 以 “企业级SLA” 溢价(但仍比公有云On-Demand便宜80%+)转售
④ 赚取风险溢价——本质上承销"中断风险"
层级 / Tier模式 / Model代表 / Representatives利润率 /
第一层
聚合者:P2P撮合,抽取5-15%佣金
第二层
智能经纪人:ML预测中断+自动多云切换
(管理费 / Fee)第三层
垂直整合:自建GPU数据中心,SLA保证
第四层
DePIN:链上逆拍卖+Token激励
协议费 <5% +
层级 / Tier类型与描述 / Type & Description价格 / Price (per hour)
公有云 On-Demand (锚定价格)
公有云 Spot (做市商采购源之一)
去中心化市场
消费级批处理 (极低成本批处理)
核心发现:公有云定价是独立GPU云商的 47倍 —— 做市商的定价锚应该使用CoreWeave层级,而非AWS。
H100价格趋势:2024 Q1 → 2025 Q2,Spot价格从$3-5/hr降至$1-1.50/hr(产能扩张+B200替代效应)
• 加权采购成本: $0.80 - $1.50 / hr(混合Vast.ai+RunPod+AWS兜底)
• 平台费 + 存储 + 运维: $0.15 / hr
• 企业级SLA套餐: $2.50 / hr
• 标准套餐: $1.80 / hr
• 批处理套餐: $1.20 / hr
做市商本质上是在承销中断风险——可以用 Black-Scholes 框架理解:
希腊值 / Greek含义 / Meaning做市商操作 / Market Maker Operation
价格敏感度
保持Spot/On-Demand仓位动态平衡
中断概率突变
新GPU发布/大客户入场时快速调仓
波动率敏感度
监控NVIDIA产线/出口管制/挖矿潮
时间衰减
长期预留锁定低波动,短期Spot弹需
替代成本
监控新渠道/新GPU的价格变化
组合对冲策略:Long Spot(低成本)+ Short On-Demand(转售SLA溢价)+ Checkpoint能力(保险)+ 跨云分散(降低相关性)
Karpenter: 高性能Spot节点自动扩缩 + 中断自动替换
Volcano: 华为开源,Gang Scheduling确保分布式训练一致性
Llama 70B 保存约1-3分钟(140GB参数)
Llama 405B 约5-10分钟
GPU Live/Hot Migration 工业界未完全解决 —— 主流是"优雅中断+快速恢复"
高端GPU
NVIDIA全系可获取
A100/H100/B200禁售,仅限H20等特供低配版
国产替代
几乎不存在
华为昇腾910B(≈A100 80%性能)等快速崛起
闲置来源
数据中心 + 消费级 + 矿场
ETH PoS后遗留大批矿场GPU(如大量RTX3090)
市场玩家
Vast.ai等商业模式渐趋成熟
<10家,极早期蓝海市场
合规运行
政策及监管严格受限
供给侧结构性过剩:矿场GPU残余 + AI中小企业倒闭潮释放算力 + 东数西算节点低利用率。
国产芯片生态碎片化:昇腾、寒武纪、壁仞等芯片厂商及客户迫切需要高效聚合者。
信息不对称套利:目前国产GPU公有云市场定价极其不透明,存在极大的套利空间。
→ 建立GPU供给网络(包括矿场及数据中心闲置算力) / Establish GPU supply network (mining + DC idle)→ 统一API接入层 / Unified API access layer→ 目标:100-500 GPU在线 / Target: 100-500 GPUs onlinePhase 2(12个月):容错层 / Fault Tolerance Layer→ Checkpoint/Restore自动化 + 多云智能路由 / Automated Checkpoint/Restore + multi-cloud intelligent routing→ 交付99%+可用性SLA保证 / Deliver 99%+ availability SLA guarantees→ 目标:1,000-5,000 GPU,通过企业客户验证 / Target: 1,000-5,000 GPUs, verified by enterprise clientsPhase 3(18-24个月):智能化层 / Intelligence Layer→ ML预测中断概率 + Agent-Native API / ML predicts interruption probabilities + Agent-Native API→ Token经济激励(视合规与监管情况而定) / Token incentives (subject to regulatory compliance)→ 目标:10,000+ GPU,成为区域性行业领导者 / Target: 10,000+ GPUs, regional market leader十、十大核心数据 / X. Top 10 Core Metrics#核心指标 / Key Metric数值 / Value全球Spot GPU市场规模 (2025E) / Global Spot GPU Market Size
47 倍 (47x)Salad 消费级算力最低价格 / Salad Consumer-grade Minimum Price
报告原文件:preemptible_compute_market_making_report.pdf · 双语全维度排版完成,适合直接打印阅读