两件事看去不搭界,实际是两条生意经。面向消费者提供 API 调用,面向开源社区提供产业链的改造可能性。
打开 Hugging Face 的 Kimi K3 页面,594GB 权重文件静卧那里。多数人关掉那个标签页,觉得这事离自己很远。可 K3 的真正买家,正是那些用不起它的角色。
谁能负担得起 2.8 万亿?
先算算硬件关卡的难度。MXFP4 量化后还是 594GB,8 块 H100 80GB 才勉强塞得下模型。推理阶段 KV 缓存和激活参数会撑爆显存,进入生产环境通常需要 64 块以上 H100 组成的超级节点,硬件投入从百万美元起步。
单张 RTX 4090,连 K3 一个专家模块都容不下。
Llama 4 的 7B 版本能在笔记本电脑运行,DeepSeek V4 的 490B 活跃参数用几张消费级显卡就行。K3 的 2.8 万亿参数,直接把门槛提到了机房级别。普通人、小型团队,乃至大部分中型企业,全被挡在门外。
K3 的完整自托管现在还是头部云厂商和大型科研机构的事。可主角并非他们。
云厂商抢先进场,小 B 端沾红利
直接买方是云厂商和软件服务商,最终受益者是小 B 端和垂直领域团队。产业链分层传导,不是即时的全面惠及。
开源当天,Together AI、Modal 等海外平台立刻宣布接入。国内动作更快:腾讯云 ADP、TokenHub、阿里云百炼、国家超算互联网,甚至值得买科技的 OpenHubs,第一时间开通了 K3 的调用接口。无需购买 H100,不用租用机房,直接通过云厂商 API 即可使用 2.8 万亿参数的基座。
小 B 端从"买不起显卡"变成了"挑哪家云",议价地位出现变化。此前只有 Moonshot 一家提供 K3 API,定价权全在厂商;现在多家云厂商同步支持,相当于多了多个供应选择,长期看定价不会被某家独占。
Modified MIT 许可证是另一关键。允许商用、修改、再分发,和 AGPL 那种"改了也必须全开源"的硬性约束截然不同。商业公司能基于 K3 做闭源行业定制,无需公开自身业务代码。闭源 API 从来不能提供这种权限。
更微妙的是 MoE 架构。K3 用的稀疏专家架构,理论上支持选择性蒸馏。未来社区能蒸馏高频激活的专家子集,形成单卡可用的"K3 学生版"。几个月后,70B 甚至 7B 的蒸馏版本可能出现。这只是架构开放后的产业预期,目前尚未实现。
DeepSeek 走的是相似道路。V4 正式版采用峰谷定价和 Flash/Pro 双档位,把 API 价格提到行业最低。Flash 缓存未命中输入价 0.14 美元,Pro 版也远低于行业平均水平。
两者底层逻辑很简单:用开放权重换取生态规模,靠规模摊薄单位成本,最终通过 API 服务和商业方案盈利。做公益、让人人本地部署,从来不是核心目标。
K3 不会完全复制 DeepSeek 的价格战路数。后者靠极低的激活参数实现极致性价比,K3 侧重前沿性能,短期内价格很难降到同等水平。它的价值,在于把前沿性能级的改造权下放。
硬件门槛没变,改造门槛降低了。这套红利通过产业链分层传递:云厂商负责算力支撑,微调团队切入场景,蒸馏生态降低门槛,最终波及小 B 端。个人开发者眼下吃不到红利,游戏规则已改变。
改造权比下载按钮更重要
对比闭源和开源,小 B 端多了什么?闭源模型只有 API 通路,价格由大厂定,定制靠提示词,上限很清楚。开源模型有 API、微调、蒸馏、自托管四条路,可根据预算和技术能力选最适合的方案。








