Kimi K3空降:2.8万亿参数封王,国产大模型终于敢卖贵了?揭秘杨植麟和他的万亿帝国

温故智新AIGC实验室

TL;DR:

Kimi突然发布2.8万亿参数的全球最大开源模型K3,性能直逼GPT和Claude,价格却比DeepSeek贵20倍。创始人杨植麟,一个被导师称为“技术天才+商业奇才”的90后,用K3宣告中国AI不再只打价格战——但土豪用户也得排队等算力,新用户暂时被“劝退”了。

2.8万亿参数,到底堆出了啥?

2026年7月16日晚9点,距离上海WAIC开幕不到24小时,月之暗面(Kimi)突然在官网上架了新一代模型K3。这波操作,堪称“精准截胡”——直接把全球AI圈的注意力拉到自己身上。2.8万亿参数,全球最大的开源模型,原生支持视觉,百万级上下文窗口……几个标签甩出来,友商们估计连夜改PPT。

先看成绩单:在Artificial Analysis智能指数中,K3得分57分,仅次于Claude Fable 5的60分和GPT-5.6 Sol的59分,是得分最高的开放权重模型1。在前端代码排名中,ArenaAI显示K3直接拿下了第一2。不少国内从业者直言:“在全模态、长上下文、复杂任务场景里,Kimi K3断层式领先。”

K3的核心技术来自自创的KDA混合线性注意力机制(Kimi Delta Attention)和注意力残差架构。通俗点说,它能在关键任务节点用全注意力保证精度,别的时候切到线性注意力省成本3。官方数据显示,百万上下文解码最高快了6.3倍,训练效率提升约25%,额外成本不到2%。这不就是“既要马儿跑,又要马儿吃得少”吗?

性能提升具体体现在哪?工程师们总结:K3把对话式AI推向了项目式AI。以前你让它写个代码,它给你几段;现在你给它一个代码库,它能帮你跨文件修改、完成工程级任务。前端能力尤其炸裂——在BrowseComp基准测试中以91.2%拿下第一,生成网页几乎可直接上线,视觉完成度碾压其他模型4。贾子健(TalkMe创始人)感叹:“K3将国产大模型前端能力拉到了很高的水平。” 工程师彭明亮说:“K3前端比GPT-5.6 Sol强10%~15%,返工率更低,审美更高。”

杨植麟:那个让导师“下场护犊”的天才

模型火了,创始人杨植麟也被扒了个底朝天。他在清华申请特等奖学金的答辩视频、在CMU读博期间的论文,突然在朋友圈刷屏。硅谷一位风投合伙人在X上质问:“为什么这样的人才,毕业后没有留在美国?” 这条推文热度千万,逼得杨植麟的导师——苹果首任AI总监Russ Salakhutdinov亲自下场维护爱徒。

Russ教授在接受《中国企业家》采访时说:“植麟是CMU最顶尖的学生之一,既能思考研究问题,又具备很强的技术能力,还能做底层编程——通常这些能力是分开的,很少见到这样融合的学生。”5 他甚至透露,杨植麟读博时曾在Google Brain实习,做的都是优化TPU这种底层系统工作,极少数博士生能参与。

而杨植麟在清华的导师、智谱创始人唐杰也曾评价:“毫无疑问,杨植麟是我这几年见过最优秀、最有天赋的学生。”5 在清华,他90%专业课95分以上,编程类课程全部满分,年级第一。大二就加入唐杰实验室,提出的优化算法被腾讯、新浪、华为采用。大三还去斯坦福做访问学者,全球癌症预测大赛中击败斯坦福、哥伦比亚等强队。

更绝的是,他并非书呆子。在清华组了乐队,当鼓手和词曲作者,粉丝众多。Russ说:“他的独特之处在于非常懂技术,是出色的研究者,同时也是优秀的商人。” 读完博,杨植麟跟Russ说:“我想创业,如果我连试都不试一下,我会后悔的。” 然后他回国,创办月之暗面。

一名前员工透露:“杨植麟身上有着独特的号召力,引进人才都是从学校的实验室里‘整锅端’。” 这种技术领军力和商业直觉,让月暗在人才大战中保持领先。

定价权之战:贵,但值得吗?

K3虽强,但价格劝退了不少人。一位开发者吐槽:“用K3不到两天,199元套餐的额度就耗尽了,朋友开了699元套餐也很快烧光。” 更扎心的是,上线48小时后,Kimi不得不宣布K3订阅“暂时对新用户关闭”——因为算力不够了。

黄震昕坦言:“放开全部新用户注册,会严重损害存量付费老用户使用体验。公司最终宁可暂时放弃新增收入,也要守住付费客户的使用体验底线。”5 这波操作,既显得有担当,又透着一丝悲壮——毕竟这是土豪才用得起的模型。

但换个角度,K3的定价也可能是一种策略。“国产大模型不该被贴上低价标签,”黄震昕说,“我们做出了SOTA级模型,也该匹配合理的商业定价。”5 彭明亮则认为:“评价成本应比较完成一个任务的总成本,而非只看单价。K3完成复杂编程任务所需的轮次更少、返工率更低,综合成本未必更高。”5

高盛称之为“定价权新节点”5,这背后是月暗的全球野心:K3价格虽远高于国内同行,却只有Fable 5的30%、GPT-5.6 Sol的60%,对海外用户仍有竞争力。黄震昕透露,月暗对标海外头部AI,暂不提供私有化部署,核心发力基础能力,现阶段收入主要来自API5

至于未来,Russ预测月暗会像GPT一样做分层模型体系:大、中、小三个模型,满足不同需求5。而黄震昕则表示:“参数规模还会持续向上拓展,不会止步于2.8万亿。如果行业继续演进,今天关于价格和Token消耗的所有争论,都只是一个更大故事的开场。”5

所以,K3到底是国产AI的骄傲,还是仅仅富人的玩具?时间会给出答案。但至少,它让全世界看到了中国模型不再只靠便宜取胜,而是开始拼技术、拼定价——这本身,就是一大进步。


  1. “月之暗面推新AI模型,跑分仅次于两大美企龙头”·ZAKER新闻·(2026/7/17)·检索2026/7/24,https://app.myzaker.com/news/article.php?pk=6a5d8254b15ec0731912ed6c ↩︎

  2. “月之暗面上线Kimi K3模型”·北京商报·(2026/7/17)·检索2026/7/24,https://www.sohu.com/a/1051384603_115865 ↩︎

  3. “2.8万亿!中国月之暗面发布全球参数最大开源模型”·维度网·(2026/7/17)·检索2026/7/24,https://www.wedoany.com/shortnews/407397.html ↩︎

  4. “Kimi K3”·月之暗面博客·(2026/7/16)·检索2026/7/24,https://www.kimi.com/blog/kimi-k3 ↩︎

  5. “Kimi冲上3300亿,揭秘杨植麟和他的万亿模型”·中国企业家·孙欣·(2026/7/24)·检索2026/7/24,https://mp.weixin.qq.com/s?__biz=MTI3NTQ1MTY0MQ==&mid=2650671926&idx=1&sn=75f81bc985977b240227efa96f9f3e91 ↩︎ ↩︎ ↩︎ ↩︎ ↩︎ ↩︎ ↩︎ ↩︎ ↩︎