泓川证券|全球最大、最强的开源模型来了
7月17日凌晨,月之暗面官方正式宣布,推出迄今为止公司能力最强的大模型Kimi K3。
据披露,K3是一个2.8万亿参数模型,拥有100万token上下文窗口,是目前全球参数最大的开源模型,也是首个超2万亿级别的模型,面向软件工程、知识工作和深度推理等前沿智能场景而设计。
在官方测评中,KimiK3展现出前沿级表现。在参与测试的模型中,其综合智能水平仅次于ClaudeFable 5和GPT-5.6 Sol。
全球首个2万亿级开源模型
7月17日凌晨,外界关注已久的Kimi新模型终于公布。
据官方信息披露,Kimi K3是首个达到2.8万亿参数规模的开源模型。记者注意到,在过去一年时间里,Kimi模型已多次刷新开源模型的规模上限。
当前,Coding能力正成为AI大模型商业化落地的关键。据官方披露,此次发布的Kimi K3是公司迄今为止编程能力最强的模型。
据介绍,新模型可以在长时间的软件工程任务中持续推进工作,理解大型代码库,操作终端,协调工具调用,检查运行时行为,并在尝试失败后以较少的人类干预自主恢复。
在实际测试中,KimiK3在结合软件工程、视觉理解和空间推理的任务提升尤为明显。它可以在源代码和渲染结果之间来回切换,结合截图、日志、测试结果和运行状态判断下一步修改方向。因此,Kimi K3尤其适合游戏开发、前端工程、CAD工作流和基础设施优化等场景。
在技术方面,KimiK3基于Kimi DeltaAttention(KDA)和AttentionResiduals(AttnRes)构建。这两项架构更新,都是为了让信息在更长序列和更深模型中流动得更顺畅。
同时,新模型也进一步扩大了Mixture ofExperts(MoE)的稀疏度:结合Stable LatentMoE框架后,模型可以在896个专家中高效激活16个。再加上训练方法和数据配方的优化,这些结构性改进让Kimi K3相比K2的整体扩展效率提升约2.5倍,能更有效地把算力转化为能力。
在此次新模型测评中,公司透露了新模型测评的三类代码基准:长周期软件工程、模型研究能力和智能体编码。
从结果来看,KimiK3在三类基准中整体表现都很强,多数情况下超过Claude Fable5和其他前沿模型,少数基准上仅次于Fable5或GPT-5.6。
转载请在文章开头和结尾显眼处标注:作者、出处和链接。不按规范转载侵权必究。
未经授权严禁转载,授权事宜请联系作者本人,侵权必究。
本文禁止转载,侵权必究。
授权事宜请至数英微信公众号(ID: digitaling) 后台授权,侵权必究。



评论
评论
推荐评论
暂无评论哦,快来评论一下吧!
全部评论(0条)