月之暗面于 7 月上线 Kimi K3,并在 7 月 27 日开放模型权重。2.8万亿参数,K3应该算是全球第一个开源的3T级模型。编程能力登顶开源榜第一,逼近Claude Fable 5和GPT 5.6 Sol两大闭源天花板。
但让我真正重视的不是"参数大",参数大谁都会堆,让我重视的是它背后的工程哲学。
一、K3的核心突破
1.精益计算:不是算得多,是算得准
K3用了一套叫KDA(Kimi Delta Attention)的新注意力机制。通俗讲:传统模型处理信息像大水漫灌,每个token都跟所有token做一遍运算。K3的做法是只算"变化量"(Delta),没变的部分不重复算。
这就是我说的"精益损耗"原则,尽量不让计算浪费在无效环节。每一次运算都要有明确产出,像智慧路由一样,信息走最优路径,不走冗余回路。
结果:同等算力下,K3的扩展效率是上一代K2的2.5倍。同样花一块钱的算力,K3比K2多出2.5倍的智能。
2.极度稀疏的专家系统:896个专家只激活16个
K3有896个专家(MoE架构),但每次推理只激活16个。激活率不到2%。
这不是偷懒,这是精准。就像一家大公司有900个专家,但每个问题只调最对口的16个人来解决,效率极高,成本极低。
实际效果:微软内部评估,用K3替代现有闭源模型,Copilot推理成本一年能省6亿美元。
3.百万token上下文 + 注意力残差(AttnRes)
百万token的上下文不新鲜了,但大部分模型到50万token以后信息衰减严重,前面说了什么,后面就忘了。
K3用AttnRes解决这个问题:在模型深层保留浅层的注意力信号,信息不随深度丢失。通俗讲就是"记忆不衰减"。
对应用层的意义:你可以把整本书、整个代码库、整个项目文档扔给它,它真的能全部理解,不是假装理解。
二、为什么这些特点能让K3脱颖而出
一句话:K3不是靠堆参数赢的,是靠把每一分算力都花在刀刃上赢的。
行业过去两年的主流逻辑是"大力出奇迹",参数越大、训练越久、数据越多,模型越强。这个逻辑到GPT-4时代还管用,到今天已经碰到了天花板。
K3代表的是下一阶段的竞争范式:不是比谁花钱多,是比谁花钱精。
KDA =计算层的精益(不做无效运算)。
极度稀疏MoE =推理层的精益(不激活无关专家)。
AttnRes =信息层的精益(不丢失已有认知)。
三层精益叠加,才做到"2.8万亿参数的模型,推理成本只有同级闭源模型的1/3"。
三、对AI创业者意味着什么
1.推理成本下降10-50倍不是口号,是正在发生的事
K3开源意味着:你今天花10万块跑的推理任务,明年可能1万甚至2000块就能跑。底层模型成本暴降,上层应用的商业模型全部要重算。
以前"烧不起推理"是很多AI应用的死因。这个门槛正在被K3们踩碎。
2. "智慧路由"会成为应用层的标配思维
子超认为,K3最大的启发不是具体技术,而是它的工程哲学,即精益损耗。
什么意思?就是你做任何AI产品,从底层模型选择到prompt设计到上下文管理,每个环节都要问一句:"这一步有没有浪费?能不能更精准?"
具体来说:
不是所有请求都需要最贵的模型。简单任务走便宜模型,复杂任务走大模型,这就是智慧路由。
不是所有上下文都要全量送进去。只送关键信息,剩下的让模型按需取,这就是上下文优化。
不是所有Agent都需要实时在线。能异步的异步,能缓存的缓存,这就是计算精益。
K3告诉我们:连底层模型团队都在拼命省每一个FLOP,你做应用的如果还在大水漫灌,那你的成本结构永远跑不过别人。
3.开源正在重定义"护城河"
K3性能逼近Fable 5和GPT 5.6,但它完全开源。这意味着:
闭源模型的性能壁垒正在被击穿。
创业者不再被API定价权卡脖子。
真正的护城河从"用了什么模型"转向"你在模型之上构建了什么不可复制的东西"。
数据、场景理解、用户信任、行业know-how,这些才是今天AI创业的壁垒。底层模型不是。
4. "从底层开始优化"的思维模式
子超认为,K3给创业者最大的启发是:凡是能优化的,都去优化。从内部的底层开始。
很多创业者做AI应用,习惯性地把底层模型当黑箱,"反正API调进去调出来就行"。但K3团队的做法是:从注意力机制的数学公式开始优化,一路优化到专家激活策略、上下文衰减曲线、推理部署方案。
结论:AI应用创业者如果也能建立这种"从底层重塑"的思维,在prompt工程、RAG架构、Agent调度、上下文管理等每一个环节做精益优化,效果会远超"换个更贵的模型"。
省出来的成本,就是你的利润空间,就是你比竞争对手多活半年的资本。
四、核心判断
K3不只是一个模型发布事件。它标志着AI行业竞争从"能力军备竞赛"转入"效率军备竞赛"。
对创业者来说:
短期:推理成本断崖下降,重新算账,很多以前"算不过来"的商业模式现在算得过来了。
中期:应用层的竞争力从"你用了什么模型"转向"你把每一分算力用得多精"。
长期:AI创业的终局不是谁的模型最强,而是谁最懂得在模型之上构建不可替代的价值。
底层越省钱,上层越有想象力,这是K3给AI创业者们最重要的启发。
杨子超:超声波创始人、发光小程序创始人、爱部落轻日记社区创始人、知名AI意见领袖、社交产品经理。
超声波旗下的超声波俱乐部目前成员涵盖了超过2000位AI领域的顶级创业者,连接超过20000位AI领域的创始人、CTO、产品经理和风险投资人。
超声波旗下的AI Open Day城市龙虾大会是中国最有影响力的龙虾大会,2026年联合360、万兴科技等AI企业,打造了全国50场城市龙虾大会。未来是智能体智能的时代,所有以Harness范式为基础的AI应用会迎来井喷式增长,AI创始人们一起加油。