近日,月之暗面公司推出其新一代旗舰系统Kimi K3,参数规模高达2.8万亿,并支持100万token的超长上下文窗口,采用混合专家(MoE)架构。这是目前全球开源社区中首个公开的万亿参数级别系统,整体参数量进入3万亿梯队。
根据官方公布的评测结果,Kimi K3的综合智能表现已跻身全球前三,仅次于Claude Fable 5和GPT-5.6 Sol。在编程、自主智能体及视觉理解等细分方向上,Kimi K3与上述两款闭源系统互有胜负,部分前沿基准测试中甚至实现反超。
新系统上线后引发广泛讨论,网友随即展开多项与海外旗舰系统的实测对比。其中一段日本武士拔刀动画的生成效果对比尤为引人关注。实测画面显示,GPT-5.6 Sol生成的动画以深蓝、暗红为主调,呈现简约平和的平面剪纸风格,武士盔甲纹理简洁,动作舒缓,刀光旋转较慢,整体视觉柔和。而Kimi K3生成的动画色彩浓烈,红、黑与浅棕对比鲜明,立体剪纸效果更为突出,鸟居和甲胄细节丰富,武士动作充满力量感,特效立体、旋转迅捷,镜头切换频繁,视觉冲击力明显更强。
从成片效果看,Kimi K3在完整性、视觉表现力和动态张力方面均更胜一筹。不少网友还指出,GPT-5.6 Sol所生成的动画在拔刀瞬间,刀光方向出现相反的错误,存在明显瑕疵。
目前,Kimi K3已上线网页端、移动应用、Work桌面端、Code及API,默认思考强度调整至最高档,low和high两种模式将在后续更新中补全。价格方面,API按每百万Token计费,输入20元,输出100元。换算后,GPT-5.6 Sol输入价格约5美元、输出30美元,Fable 5更为昂贵,输入10美元、输出50美元;Kimi K3的输出单价折合不足14美元,相对更为低廉。不过,与自家上一代K2.6相比,K3的API输入价格实际上涨了3倍多,输出价格上涨近4倍。
月之暗面在官方发布中坦承了Kimi K3的三个主要局限:对历史思考内容较为敏感,中途切换模型可能导致输出质量明显下降;训练偏向长程高难度任务,面对简单日常问题时容易自行替用户做决定;以及与Fable 5和GPT-5.6 Sol相比,在用户体验上仍存在差距。