月之暗面重返基模战场：发布首个开源万亿模子，押注“模子即Agent”

　　炒股就看金麒麟分析师研报，泰斗，专科，实时，全面，助您挖掘后劲主题契机！

图片着手：视觉中国

　　蓝鲸新闻7月12日讯（记者朱俊熹）时隔半年，“大模子六小龙”之一的月之暗面终于推出新一代基座模子Kimi K2。据官方先容，Kimi K2是一款具备更强代码能力、更擅长通用Agent任务的MoE架构基础模子，总参数达1万亿，激活参数为320亿。

　　7月11日发布并同步开源的新模子包括两个版块：基础模子Kimi-K2-Base、更符合通用聊天和智能体任务的后试验模子Kimi-K2-Instruct。在自主编程、器具调用和数学推理关联的能力评测中，Kimi K2均取得了较优的发达。以SWE-bench Verified、AIME 2025等评测集为例，Kimi-K2-Instruct的得分高出了同为开源模子的DeepSeek-V3、阿里Qwen3，靠拢以至大概反超OpenAI GPT-4.1、Anthropic Claude 4 Opus等率先闭源模子。

　　聚会6月底开启内测的新Agent“Kimi-Researcher”不出丑出，月之暗面的念念路正转向“模子即Agent”。模子本人就集成了自主有策划和实践任务的能力，大概手脚智能体处罚复杂任务。

　　在官方释出的用例中，用户条款Kimi K2维护贪图过问Coldplay乐队巡演的行程。该模子通过17次器具调用，涵盖搜索、日期、邮箱、航班、餐厅预订等圭表，制定出一份无缺的机酒与旅游贪图，并造成可视化施展。

　　智能体能力正在成为国表里大模子厂商竞相押注的进化方针。本周，马斯克旗下的东谈主工智能初创公司xAI发布新一代大模子Grok 4，包括单智能体、多智能体两个版块，具备器具使用、实时搜索等功能。Anthropic在推出Claude 4系列模子时也强调，在编程、推理和Agent方面“诞生了全新尺度”，大概处理复杂且长时间运行的任务。

　　月之暗面在Kimi K2的时刻博客里共享了对构建绽开智能体智能的办法。其指出，预试验是智能体智能的关键基础，它让模子领有基本的学问、判辨和推理能力，从而在后续的强化学习中更有用地学习。但“东谈主类数据就像是有限的‘化石燃料’”，因此如安在预试验阶段擢升对有限数据的诈欺恶果，成为现时AI扩张的关键挑战。

　　而在后试验阶段，大模子不再只依赖东谈主类数据，运行从我方的行径和完毕中取得奖励、进行自我优化，以完毕卓著东谈主类能力的可能。

　　“Kimi K2恰是在这些洞见之上铸造而成的。”月之暗面暗示。其同期强调，Kimi K2是构建通用Agent能力的坚实基础，但通用Agent还需要更高档的能力，比如念念考和视觉判辨，方针未来为该模子加入这些能力。此外，长文本处理能力曾是Kimi的中枢上风，这次Kimi K2的高下文长度为128k，不足部分新发布的模子。

　　值得把稳的是，Kimi K2是国内首个开源的万亿参数级别模子。此前虽有其他大模子厂商试验出万亿参数模子，如腾讯混元Turbo、MiniMax abab 6.5等，但皆遴选了闭源路子。

　　在试验Kimi K2这么的万亿参数级别的大模子时，月之暗面取舍了自主篡改的Muon优化器。与传统的Adam优化器比拟，Muon在token诈欺恶果上发达更优，能让大模子学得更快、更有恶果。同期为处罚Muon在超大限度试验时遭受的不稳重问题，团队还建议了MuonClip这一稳重性增强时刻，支合手Kimi K2凯旋完成15.5万亿tokens的预试验，未出现试验亏蚀值的十分峰值。

　　自年头DeepSeek横空出世以来，月之暗面天然接续释出了一些时刻或居品上的更新，但弥远未能重拾外界对其的首要期待，一度发达得颇为低调千里寂。而这次Kimi K2的发布，让这家明星创企终于重回基模舞台的聚光灯下，这场牌局仍未见定论。

海量资讯、精确解读，尽在新浪财经APP

株连剪辑：张恒星

上一篇：签字著述：赖清德所谓“国度”邪说中的十处错误

下一篇：没有了

月之暗面重返基模战场：发布首个开源万亿模子，押注“模子即Agent”

产品