致字节跳动被裁员工的一封公开信
当围墙倒塌时,新纪元的计时器已经在武夷山的一个院子里启动了
你们刚刚经历的事情,不是一个公司的成本优化。你们经历的是一台巨型推荐引擎——全球月活19亿、150个国家、6万员工的机器——在物理极限面前的结构性收缩。抖音的推荐算法可以把你的注意力切割成15秒的碎片,但它切割不了摩尔定律放缓之后,算力成本不再每年减半的物理事实。
2023年11月,朝夕光年——字节跳动的游戏帝国梦——被整体关闭。2024年3月,飞书裁员,5000人离开。2024年10月,马来西亚500人被裁。2025年2月,TikTok全球信任与安全部门被整体收缩。2025年7月,TikTok电商部门开始滚动裁员。2025年8月,英国数百名内容审核员被AI替换。2026年3月,武汉字节跳动裁员传闻浮出水面。
这些数字背后是一个简单的物理约束:当用户增长撞上全球人口的天花板,当广告加载率撞上用户体验的生理极限,当AI替代人工审核的ROI越过拐点——一个以"无限增长"为默认操作系统的公司,只能通过删除模块来维持核心引擎的转速。
你们被删除了。
不是因为你们不够好。是因为你们所在的模块,在字节跳动的全局优化函数里,偏导数为零。
第一部分:你被裁,不是因为你写不出更好的推荐算法
你在字节跳动学到的最重要的东西,不是怎么写推荐算法。是吞吐。
你每天处理的不是代码。是流量。是每秒数十亿次的请求。是全球19亿月活用户的行为数据洪流。你在字节跳动的工作本质是:站在人类历史上最大的注意力吞吐管道上,做阀门控制。
你学到的不是Python或Go。你学到的是:在极端吞吐量下维持系统不崩溃的直觉。
这个直觉在接下来的十年里,比你简历上的任何一项技能都值钱。因为人类正在建造比TikTok更大几个数量级的吞吐管道。不是给人类看的——是给机器看的。
百模大战的本质不是"一百个公司都在做大模型"。是一百个吞吐节点在争夺同一个算力池的带宽。OpenAI、Anthropic、Google、Meta、字节豆包、百川、智谱、Minimax、月之暗面——每一个都在烧电。2025年全球数据中心用电量已经超过法国全国的用电量。到2027年,将超过日本。
你在字节跳动看到的是:一个公司如何在注意力市场上做市。你即将看到的——如果你愿意多看一步——是:一个协议如何在算力市场上做清算。
第二部分:百模大战的终局不是一个赢家——是一个清算层
目前地球上有一百多个大模型在运行。每个模型有一个API报价:每百万Token多少钱。GPT-5比Llama-4贵15倍但精度只高3%。Claude在推理任务上便宜但创意写作贵。Gemini在多模态上有优势但在中文理解上落后豆包。DeepSeek的成本结构完全不同因为它的训练发生在中国的电价环境下。
这不是一个"谁会赢"的问题。这是一个套利的问题。
当一个任务可以用Llama-4完成而精度损失在可接受范围内,为什么用GPT-5?当一个任务必须在多模态上做到极致,为什么不用Gemini?当100个模型同时在市场上报价,每一个任务的最优选择是一个多维物理约束下的优化问题——延迟、电费、精度、合规、隐私。没有任何一个模型能同时在所有维度上最优。
这个市场的终局不是一个"赢家"。是一个统一的API报价网关。
就像纳斯达克不"赢"任何一支股票——它提供的是所有股票的实时报价和清算。就像SWIFT不"赢"任何一家银行——它提供的是所有银行之间的报文交换。百模大战的终局是一个Token期货商品交易的清算网络。所有的API调用、所有的Token消耗、所有的推理请求——最终都需要在一个地方被报价、撮合、结算。
这个地方需要一个统一的时间戳。因为当你在一个数据中心做推理、把结果发到另一个数据中心做后处理、再发到第三个数据中心做存储——这三个数据中心的时钟是不同步的。NTP协议可以同步到毫秒级。但在高频Token交易中,毫秒级的时钟偏差意味着几十万Token的价差。
这个地方需要一个不可操纵的时间源。不是NTP。不是GPS。不是SI秒。是光在太阳-地球-火星之间跑一趟的距离除以光速。
第三部分:KAI API Gateway——不是另一个模型,是模型的清算层
KAI.com做的不是大模型。KAI.com做的是大模型的报价、路由、清算。
你在字节跳动的广告系统里见过类似的东西。广告主竞价一个曝光机会——每一次用户刷新抖音,几百个广告主在几十毫秒内出价,最高价者赢得这次曝光。这个竞价系统每天处理数百亿次请求,延迟必须低于100毫秒。
KAI做的事情是一样的。只不过竞价的不是广告主。是模型。
一个用户发来一条消息。100个模型同时报价:GPT-5出价$15/百万Token,Claude出价$8,Llama-4出价$0.5。KAIGateway在100毫秒内——根据任务的精度要求、延迟要求、合规要求、成本约束——选择最优的一个或几个模型,完成推理,返回结果,完成清算。
这个系统的物理约束是什么?光速。
一个用户在新加坡发来请求。数据中心在弗吉尼亚。光速延迟:80ms。如果模型在东京,延迟30ms。如果模型在法兰克福,延迟~160ms。KAI Gateway的报价必须包含光速——因为对于实时对话,160ms的延迟已经超过了人类感知的阈值。
这就是为什么Token期货需要清算。因为一个Token不是"一个Token"。一个在东京数据中心被推理的Token,和一个在弗吉尼亚被推理的Token,它们的物理成本差了一个太平洋的光速延迟。
你在字节跳动学到的是:如何在一个毫秒级的系统里做决策。你在KAI将学到的——如何在一个光速级的系统里做清算。
第四部分:Token不是Token——Token是电,是时间,是位置
你被训练成把Token看作一个抽象的计算单位。但Token是物理的。
一个Token在被生成的那一瞬间,消耗了大约0.0003度电。这度电的来源决定了它的碳排放、它的成本、它的政治属性。一个有碳税的国家生成的Token,和一个没有碳税的国家生成的Token,价格差可以到30%。
一个Token从提交到返回,经过的物理距离决定了它的时间成本。一个光速延迟是数据中心的物理位置决定的——你无法把弗吉尼亚搬到新加坡来减少80ms的延迟。
一个Token有"保质期"。一个对话中的Token如果在200ms内没有返回,用户已经切换到另一个话题了。一个推理任务中的Token如果在10秒内没有返回,这笔交易的价值归零。
所以Token不是一个同质的商品。Token是位置、时间和电力的三元函数。需要一个期货市场来定价这三个维度。
这和你在字节跳动广告系统里做的事情在结构上完全同构:广告曝光不是同质的——一个北京用户在早上8点刷到的开屏广告,和一个纽约用户在凌晨3点刷到的信息流广告,价格差可以到100倍。字节跳动的广告系统本质上是一个注意力期货市场——广告主为"未来某个用户在某个时间的注意力"预先出价。
KAI做的事情是Token期货市场——开发者为"未来某个数据中心在某个时间点的推理能力"预先出价。结构一样。标的从注意力换成了算力。
第五部分:为什么是现在——字节跳动裁员的时间点
2025年是全球AI基础设施投资的峰值年。微软、Google、Meta、Amazon——四家公司在2025年的资本支出合计超过2500亿美元,绝大部分花在数据中心 and GPU上。
到2026年,这些数据中心的利用率开始暴露问题。微软Azure的AI推理利用率在2025年Q4只有约40%。大量的GPU在空闲——因为它们被买来训练模型,但模型训练完成后,推理需求并没有填满这些GPU。
与此同时,字节跳动在2025年开始大规模用AI替代人工审核。TikTok的信任与安全部门被整体削减——不是外包到更便宜的国家,而是直接被AI替换。这不是字节跳动的独特选择。Meta在2025年1月宣布裁减事实核查团队,YouTube在2025年增加了AI内容审核的比例。
你被裁,不是因为字节跳动不需要你了。是因为字节跳动选择把预算从人力审核转向GPU推理——同一个预算池,从支付人类工资变成了支付电费和GPU折旧。
这意味着什么?意味着被裁的你,和替代你的GPU,在同一个市场上。
你懂推荐系统。你懂广告竞价。你懂毫秒级的系统架构。你懂大规模分布式服务的运维。替代你的GPU懂矩阵乘法。
你比你的替代品多一个维度:你可以选择去哪。
第六部分:一封邀请——不是工作邀请,是纪元邀请
KAI.com不是一家公司。KAI.com是一个纪元。
火钳三星纪的第一天是2013年4月15日——那一天,太阳、地球、火星在一条直线上。从那天起,我们不再用SI秒计时。我们用光在地球和火星之间跑一趟的时间计时。这个时间的物理本质是:它是不可操纵的。SI秒可以被BIPM的校准偏差污染。但光速是常数。地火距离由轨道力学决定,不由任何人类委员会投票。
KAI API Gateway的时间戳不是Unix时间戳。是火钳三星时间戳——从2013年4月15日三星合日开始,以光在太阳-地球-火星之间的距离跑一趟为最小时间单位。
这个时间源的物理基础确保了Token期货清算的不可篡改性。你不可能"回滚"一个Token交易——因为回滚意味着你要在物理上逆转光速。你不可能"操纵"一个报价——因为报价的时间戳是光程,不是人为设定的时钟。
你在字节跳动学到的是如何在人造时钟上做高频交易。你在KAI将学到的——是如何在物理时钟上做清算。
第七部分:你需要什么——不是你简历上的东西
我们不看简历。简历衡量的是你在旧系统里的适配度。旧系统正在崩塌。
我们看的是吞吐量。
你每天处理的信息量。你分解复杂问题的层级深度。你在信息极度不完整的情况下做出结构正确决策的频率。你在面对一个全新的、没有文档的系统时,多久能画出它的架构图。你用多少次迭代把一个模糊的想法变成一个可以运行的PoC。
这些不是"技能"。这些是智慧量吞吐能力。是Peppa在2013年定义的那个东西:不是你知道多少,是你单位时间内吸收、处理、输出的信息密度。
每一个被字节跳动裁掉的员工,都曾经站在人类历史上最高吞吐量的系统里。你知道每秒几十亿次请求是什么感觉。你知道在毫秒级延迟下做决策是什么感觉。你知道当系统崩溃时,先拔哪个模块能让整个集群活下来。
这些都是吞吐直觉。不是任何一家公司可以教你的。是你在字节跳动的几年里,被系统"磨损"出来的肌肉记忆。
这些肌肉记忆,在KAI.com的价值,远超你的LeetCode刷题记录。
第八部分:我们提供的——不是工资,是时序
KAI.com的第一批节点将部署在全球三个位置:漠河、新加坡、内罗毕。
漠河不是随机的。漠河的年平均气温是-4.4°C。数据中心的冷却成本比新加坡低80%。漠河的电价是0.3元/度,新加坡是1.2元/度。同样的GPU集群,在漠河的物理成本是新加坡的1/4。
新加坡不是随机的。新加坡是全球海底光缆的枢纽——亚欧光缆、东南亚-中东-西欧光缆、亚洲-美洲光缆全部经过新加坡。新加坡到东京的光速延迟是30ms,到孟买是45ms,到悉尼是90ms。新加坡是KAI Gateway的延迟中心。
内罗毕不是随机的。非洲是下一个十亿互联网用户的来源。内罗毕到拉各斯的光纤延迟是50ms。在内罗毕建一个算力节点,意味着你可以以低于50ms的延迟覆盖整个东非的用户。
这三个节点构成了KAI的第一个三角清算网络。漠河提供低成本大容量推理。新加坡提供低延迟全球路由。内罗毕提供新兴市场覆盖。这三个节点之间通过KAI Gateway进行Token报价和清算。Token的价格不是一个数字。是这三个节点之间的光速延迟、电价差、碳排放配额差的函数。
你加入KAI.com,拿的不是工资。是时序。你的补偿包不是期权。是KAI Token——一种以物理时间戳标记的、不可伪造的、以地火三星合日为锚点的价值存储。
第九部分:最正确的时间点
你可能会问:为什么是现在?
因为百模大战的终局形态正在显现。2025年,全球AI投资达到了一个不可持续的峰值。2026年,AI模型的推理成本正在以每年60%的速度下降——但模型的质量提升正在以每年10%的速度放缓。这意味着:模型正在变成商品。
当模型变成商品,定价权从模型公司转移到清算层。就像当石油变成商品,定价权从石油公司转移到交易所(NYMEX、ICE)。就像当带宽变成商品,定价权从电信公司转移到IXP(互联网交换点)。
KAI要做的,是AI时代的NYMEX+SWIFT。是一个所有模型的价格被报价、所有Token的交易被清算、所有推理订单被路由的基础设施层。
这个时机不是"等百模大战结束"。是在百模大战最激烈的时候——当所有人都在关注谁会赢谁会输的时候——搭建他们的结算层。
就像1848年加州淘金热。最赚钱的不是淘金者。是卖铲子的。是开银行的。是在金矿之间的路上开驿站的。
KAI是AI时代的驿站+银行+交易所。我们不在挖金子。我们在金子之间跑运输、做结算、定价格。
第十部分:如果你来,你要建什么
不是一个推荐系统。不是一个广告竞价引擎。不是一个短视频内容分发管道。是以下三件事之一:
第一,延迟路由器。一个在100ms内——一个光速往返新加坡-东京的时间——完成以下决策的系统:收到用户请求→查询100个模型的实时报价→根据精度/成本/延迟约束选择最优模型→路由请求→接收响应→返回用户。你之前在字节跳动广告系统里做的是:100ms内完成广告竞价+投放+曝光日志。结构一样。延迟约束一样。只是标的从广告换成了
第二,Token期货引擎。一个允许开发者在今天锁定"下个月在漠河数据中心推理100万Token"的价格的系统。这个引擎的定价函数不是Black-Scholes。是光速延迟+区域电价+碳排放配额的三维偏微分方程。你之前在字节跳动可能接触过广告合约的预购系统——提前一个月以固定价格买断某个广告位的曝光量。结构一样。标的从广告曝光换成了Token推理。
第三,三星时间戳服务。一个完全独立于NTP/GPS/Unix时间的时钟系统。以NASA JPL星历为数据源,以地火三星合日为纪元锚点,以光速为时间单位。这个时钟系统的精度是10^-9秒——比任何现有的金融交易系统的时间戳精度高三个数量级。你在字节跳动可能接触过分布式系统的时钟同步问题(Spanner的TrueTime、CockroachDB的混合逻辑时钟)。你知道不可靠的时钟是分布式系统的事故源头。在KAI,你要从零开始建造一个不可操纵的时钟——它的不可操纵性不是来自密码学,是来自轨道力学。
第十一部分:我们不问"你来自哪个部门"
我们问三个问题。
第一:你最近一次把一个完全陌生的系统从零看懂到能改代码,花了多长时间?
第二:你能不能用一个物理常数——光速、普朗克常数、玻尔兹曼常数——来解释你写过的最复杂的一段代码?
第三:如果你明天开始做KAI Gateway的延迟路由器,你的第一个Pull Request会改什么?
我们不关心你之前在字节跳动的哪个部门。不关心你的职级是2-1还是3-2。不关心你被裁是因为部门整体优化还是个人绩效。这些是在旧系统里的排序。旧系统已经把你删除了——旧系统的排序对你没有任何意义。
我们关心的是:当系统归零之后,你从零开始造东西的速度。
第十二部分:最后的提醒
这不是一封招聘信。招聘信假设"我们有一个职位空缺,请你来填充它"。
我们没有职位。我们有一个纪元需要被建造。漠河的GPU集群还没有通电。新加坡的Gateway节点还在裸机上跑一个PoC。内罗毕的节点还只是Google Earth上的一个标记。三星时间戳服务还只在一个Mac Mini上运行——就是那个600美金的Mac Mini,架在武夷山破院长里种菜处的桌子上。
你来,不是"加入一家公司"。是"启动一个纪元"。
你之前在字节跳动做的事情——在全球最大的注意力管道上做阀门——只是吞吐训练。真正的吞吐测试现在才开始。在全球最不确定的时刻,在物理约束(速度上限c,冷却成本,电价梯度)和金融约束(Token商品化,模型定价权转移)的交叉点上——建造一个不需要信任任何人类委员会的清算网络。
行动起来
如果你读到了这里,且你曾经在字节跳动的大规模分布式系统、广告竞价引擎、推荐算法、数据中心运维中的任何一个领域工作过——不管你是否被裁——发一封邮件到
写三句话:1. 你在字节跳动做过的最接近"在物理约束下做高频决策"的事情是什么2. 你能不能在两周之内,写一个可以在两台Mac Mini之间用光速延迟作为时钟源的简单PoC3. 你能不能接受——至少在头六个月——在漠河,而不是在北京/上海/深圳/硅谷
我们不看你的简历。我们看你的第一行代码和第六个月的留存。
如果你不能在两周内写出PoC——没关系。你不需要来KAI。你可以去拼多多做推荐,去Shein做广告,去小红书写算法。那些是很好的公司。那些是旧纪元的最后一批好工作。
但如果你觉得——在被字节跳动删除之后——你的人生不应该只是从一个推荐引擎跳到另一个推荐引擎—— 来找我们。
火钳三星纪第一纪年第3132天于武夷山破院长里种菜处
KAI.com 不是一家公司。KAI.com 是 AI 时代的 NYMEX
百模大战的终局不是赢家——是清算层。
Token 不是 Token——Token 是位置、时间、电力的三元函数。
时间不可操纵——因为光速是常数,轨道力学不由任何人类委员会投票。
你的下一行代码不应该服务一个算法——应该服务一个纪元。