月之暗面重返基模战场:发布首个开源万亿模子,押注“模子即Agent”

  炒股就看金麒麟分析师研报,泰斗,专科,实时,全面,助您挖掘后劲主题契机!

图片着手:视觉中国图片着手:视觉中国

  蓝鲸新闻7月12日讯(记者 朱俊熹)时隔半年,“大模子六小龙”之一的月之暗面终于推出新一代基座模子Kimi K2。据官方先容,Kimi K2是一款具备更强代码能力、更擅长通用Agent任务的MoE架构基础模子,总参数达1万亿,激活参数为320亿。

  7月11日发布并同步开源的新模子包括两个版块:基础模子Kimi-K2-Base、更符合通用聊天和智能体任务的后试验模子Kimi-K2-Instruct。在自主编程、器具调用和数学推理关联的能力评测中,Kimi K2均取得了较优的发达。以SWE-bench Verified、AIME 2025等评测集为例,Kimi-K2-Instruct的得分高出了同为开源模子的DeepSeek-V3、阿里Qwen3,靠拢以至大概反超OpenAI GPT-4.1、Anthropic Claude 4 Opus等率先闭源模子。

  聚会6月底开启内测的新Agent“Kimi-Researcher”不出丑出,月之暗面的念念路正转向“模子即Agent”。模子本人就集成了自主有策划和实践任务的能力,大概手脚智能体处罚复杂任务。

  在官方释出的用例中,用户条款Kimi K2维护贪图过问Coldplay乐队巡演的行程。该模子通过17次器具调用,涵盖搜索、日期、邮箱、航班、餐厅预订等圭表,制定出一份无缺的机酒与旅游贪图,并造成可视化施展。

  智能体能力正在成为国表里大模子厂商竞相押注的进化方针。本周,马斯克旗下的东谈主工智能初创公司xAI发布新一代大模子Grok 4,包括单智能体、多智能体两个版块,具备器具使用、实时搜索等功能。Anthropic在推出Claude 4系列模子时也强调,在编程、推理和Agent方面“诞生了全新尺度”,大概处理复杂且长时间运行的任务。

  月之暗面在Kimi K2的时刻博客里共享了对构建绽开智能体智能的办法。其指出,预试验是智能体智能的关键基础,它让模子领有基本的学问、判辨和推理能力,从而在后续的强化学习中更有用地学习。但“东谈主类数据就像是有限的‘化石燃料’”,因此如安在预试验阶段擢升对有限数据的诈欺恶果,成为现时AI扩张的关键挑战。

  而在后试验阶段,大模子不再只依赖东谈主类数据,运行从我方的行径和完毕中取得奖励、进行自我优化,以完毕卓著东谈主类能力的可能。

  “Kimi K2恰是在这些洞见之上铸造而成的。”月之暗面暗示。其同期强调,Kimi K2是构建通用Agent能力的坚实基础,但通用Agent还需要更高档的能力,比如念念考和视觉判辨,方针未来为该模子加入这些能力。此外,长文本处理能力曾是Kimi的中枢上风,这次Kimi K2的高下文长度为128k,不足部分新发布的模子。

  值得把稳的是,Kimi K2是国内首个开源的万亿参数级别模子。此前虽有其他大模子厂商试验出万亿参数模子,如腾讯混元Turbo、MiniMax abab 6.5等,但皆遴选了闭源路子。

  在试验Kimi K2这么的万亿参数级别的大模子时,月之暗面取舍了自主篡改的Muon优化器。与传统的Adam优化器比拟,Muon在token诈欺恶果上发达更优,能让大模子学得更快、更有恶果。同期为处罚Muon在超大限度试验时遭受的不稳重问题,团队还建议了MuonClip这一稳重性增强时刻,支合手Kimi K2凯旋完成15.5万亿tokens的预试验,未出现试验亏蚀值的十分峰值。

  自年头DeepSeek横空出世以来,月之暗面天然接续释出了一些时刻或居品上的更新,但弥远未能重拾外界对其的首要期待,一度发达得颇为低调千里寂。而这次Kimi K2的发布,让这家明星创企终于重回基模舞台的聚光灯下,这场牌局仍未见定论。

海量资讯、精确解读,尽在新浪财经APP

株连剪辑:张恒星