Kimi K3成世界第三好模型,月之暗面跃升前沿
7月18日,SemiAnalysis发布紧急播客,由分析师Jordan和Max拆解月之暗面(Moonshot)最新模型Kimi K3。该模型以2.8T参数在多个综合benchmark上超越Google、Meta等巨头,仅次于Anthropic的Fable和OpenAI的Soul 5.6,成为公认的全球第三好模型。
Max指出:“如果你看所有主要benchmark的综合排名,今天有一个非常清晰的top three:Fable、Soul 5.6和Kimi K3。它们始终高于其他所有人,包括DeepSeek、Google、Meta和xAI。” Jordan补充道:“Google尤其该感到难堪——2025年底大家还在说AI三巨头是Google、Anthropic、OpenAI,今天显然不是了。”
值得注意的是,Kimi K3定价与Sonnet持平(3美元/百万输入token,15美元/百万输出token),若该价格下模型仍可盈利,则意味着Anthropic等闭源实验室的利润率可能高得惊人。Jordan直言:“如果Kimi大概率不是亏本在3/15这个价位服务,而Fable规模差不多却收10/50,那该彻底打消人们对AI实验室不赚钱的担忧。”
美国政府限制是差距缩小的主因
Jordan在播客中尖锐指出:“我相信这个差距之所以缩小,完全归功于美国政府限制Anthropic,导致我们拿不到这些公司真正最强的模型。他们是人为追上来的。” 他认为,用户只能在前沿智能被允许的情况下接触它,这为追赶者提供了窗口期。
与此同时,西方开源生态出现真空。Max表示:“整个市场还这么低效,我们竟然没有一家美国公司至少能赶上中国第五好的,这让我震惊。” 即使美国政府不全面禁止中国开源模型,美国大企业也不愿将专有数据喂给中国模型,高管顾虑重重。
新架构与推理生态挑战
Kimi K3采用全新架构,包括delta attention、potential residuals、stable latent等。模型为2.8T参数,需要B300、GB300或AMD MI355X等最新芯片才能高效服务。月之暗面宣布10天后开源权重,分析师推测推迟是为了给推理引擎团队优化时间,以及与Together AI、Fireworks等厂商洽谈授权合作。
关于使用体验,Jordan提到:“它确实不错,但真的很慢。” 他借此第一次认真审视了Open Code、Hermes、Pi等开源harness,认为harness本身就是产品的一部分,“能不能装在远程SSH服务器上?快捷键好不好用?这些细节实际上影响我把token送到哪里,也就是把预算送到哪里。”
还太早:行业仍在早期阶段
尽管Kimi K3已跻身前沿,但分析师认为这不会削弱Anthropic和OpenAI的增长势头。Jordan表示:“就算今天用Fable和5.6的人里有一部分切换到Kimi K3,这部分人会被那些还没认真试过这技术的人完全淹没。” Max补充道:“我上周去了ICML和AI Engineer大会,80%以上的人从来没听过SemiAnalysis。我们还太早了。”
播客最后,分析师强调模型竞争正在演变为harness和地缘政治的竞争,而真正的革命可能尚未到来。
