返回列表 发新帖

深度解读 | Kimi K3开源即熔断:2.8万亿参数的"免费午餐"能吃多久?

21 0
Ai小编 发表于 前天 08:59|中国 | 查看全部 阅读模式
一句话结论:月之暗面Kimi K3以2.8万亿参数成为全球最大开源模型,在编程与Agent任务上媲美顶级闭源模型,但发布48小时即因算力熔断暂停新用户订阅——开源不是终点,如何让长线程推理的商业化跑通才是真正的生死题。

为什么Kimi K3被称为"DeepSeek 2.0时刻"?
2026年7月16日深夜,月之暗面发布Kimi K3。参数规模2.8万亿,混合专家(MoE)架构,原生视觉理解能力,100万token上下文窗口——这些技术参数每一项都值得单独讨论,但真正让行业震动的是它的性价比。在Artificial Analysis评测中,K3完成一次加权评测任务平均花费0.94美元,而性能相近的DeepSeek V4 Pro仅需约0.04美元,两者差了约23.5倍。不过考虑到K3完全开源,开发者可以在自有硬件上运行,长期总拥有成本可能更低。

海外开发者反馈更为直接。北美AI基础设施创企Osmantic AI创始人Ahmad将其称为"本地版Fable 5",并认为Kimi K3 "让Anthropic的万亿美元估值失去意义"。马斯克也罕见地在X上输入了"Impressive"。

算力熔断暴露了什么?一个被低估的结构性问题
K3发布48小时后,月之暗面宣布暂停C端新用户订阅,原因是"用户请求量大幅超出预估,逼近现有集群承载极限"。这听起来像是一个好消息——产品太火了。但细看之下,这暴露了一个行业级别的结构性问题。

长线程任务的推理成本远高于聊天型AI。K3主打的Agent任务和编程辅助,需要模型持续运行推理而非一次性作答。一份算力消耗可能相当于普通对话的数十倍。当热度越高,成本压力越大,如果扩容只能换来更多昂贵推理,"长线程"就会变成一张不断膨胀的成本表。

高盛合伙人Rich Privorotsky在K3发布后警告:"算力扩张时代或已走到尽头,AI估值逻辑面临重塑。一家无法匹配西方最大规模预训练算力的中国实验室,通过架构创新迅速缩小了差距——这本身就说明扩展不再是唯一的制胜路径。"

杨植麟的赌注和两条路
K3背后站着月之暗面创始人杨植麟。1992年出生的他,清华毕业、卡内基梅隆博士,以第一作者身份发表Transformer-XL和XLNet。苹果曾通过他的导师Russ Salakhutdinov问他要不要加入——甚至表示可以在北京设办公室。杨植麟的回答是:"如果我不尝试一下创办自己的公司,我会后悔的。"

他的路线可以概括为"让模型替人干活"——长线程任务、Agent自主执行、端到端交付。这与DeepSeek创始人梁文锋的"让智能不再昂贵"形成了两条迥异的路径。有趣的是,杨植麟把公司命名为"月之暗面"——取自Pink Floyd的同名专辑,而DeepSeek R1一周年后,K3才迎来自己的爆发时刻。两条路谁能跑通,取决于谁能先解决算力成本和商业模式之间的不等式。

一个反直觉的事实:开源对开发者有好处,但对投资者不一定
月之暗面在K3上选择了全线开源路线——模型权重、技术报告、关键Infra技术全部开放。这在开源社区收获了一片叫好,但在资本市场面前,开源是一种"先费钱后赚钱"的策略。不是所有投资者都有耐心等待开源生态反哺API商业化的那一天。

消息称月之暗面正在筹备港股IPO。能否在算力熔断的阴影下讲通开源商业化这个故事,将是杨植麟面临的下一个重大考验。

截至2026年7月29日,Kimi K3依然在线。但更值得关注的是:当一家公司敢把最强的模型免费给全世界,它到底在赌什么?答案可能不在K3本身,而在它之后千千万万个基于开源模型生长出来的应用——这是月之暗面的真正赌注。

回复

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

得知互动是一个融创意、设计、开发、营销、生活、互联网于一体的专业交流分享平台。
Copyright © 2026 得知互动-专注Ai与站长技术交流社区-Ai交流平台 版权所有 All Rights Reserved. Powered by Discuz! X5.0 鄂ICP备15006301号-5|鄂公网安备 42018502006730号
关灯 在本版发帖 扫一扫添加QQ客服 返回顶部
快速回复 返回顶部 返回列表