1
42万
精华分
2 层引用链锐评超原推
把Kimi 48小时算力挤爆读成反转:不是capex见顶,而是推理需求外溢利好HBM/铲子
⧫ Alan Chen ⧫(alanchentsla.eth)
@alanchen
48 小时, K3 把自己的 GPU 用完了。
7月16日 Kimi K3 在前端代码竞技场以 1679 分登顶, 超过 Claude Fable 5, 从 K2.6 的第18位一口气跳到第1。当天科技股跌, 叙事很顺: 中国开源模型又赢一次, 美国那几千亿 capex 白烧了, 没护城河,DeepSeek 2.0 要来了。
今天 Moonshot 发公告: 需求 48 小时内逼近算力上限, 暂停新订阅, 优先保现有用户, 还要把会员拆成 Kimi Membership 和 Kimi Code Membership 两档,好更精确地分配算力。
这个反转值得琢磨。一个被当作"算力投资要完蛋"的证据,两天就死在算力不够上。
我的猜测是,大家把训练和推理搞混了。K3 这类模型真正省的是训练那一笔, 但模型越强、越便宜、越好用,推理端的消耗越是往上翻——用的人多了, 每一次调用都要吃 GPU 和显存。省下的是一次性的,省不掉的是天天付的。Moonshot 单独把 coding 拆出来做一档,恰恰因为 agentic coding 是最吃 token、最吃算力的活。
7月27日全量权重放出来之后,这件事只会更明显: 全世界都能自己部署, 全球推理需求再上一层楼,而这些算力不会凭空出现。
所以我倾向于反过来读——K3 不是"capex 见顶"的信号,是推理需求外溢的信号。真正被印证的不是"开源要杀死英伟达",是"卖铲子的下面还有一层给铲子供矿的",HBM 和高端内存那条线还在紧。
要证伪也很简单:如果 7月27日之后 Moonshot 迅速恢复开放、算力压力肉眼可见地缓解,那说明这波只是短期挤兑,我这个读法就得改。三个月后回来看数据。 $MU $SOXX
Jul 19, 2026, 08:33 PM·67.5K Views
Kimi.ai
@Kimi_Moonshot
Kimi K3 受到的喜爱远超我们的预期,我们的 GPU 也感受到了这一点。
在过去 48 小时内,需求已接近我们当前容量的极限。为了保护现有订阅者的体验,我们暂时暂停新订阅并优先考虑当前会员的计算。现有订阅用户不受影响。
我们正在尽快增加容量,并将分批重新开放新的订阅点。
展望未来,我们还将把会员资格分为两个更有针对性的计划:Kimi 会员资格用于 Kimi Web、应用程序和工作;和 Kimi Code Membership 用于编码工作流程。这将帮助我们更精确地匹配计算并保持体验稳定。
感谢您的耐心和理解!
Jul 19, 2026, 02:52 PM·9.3M Views





