月之暗面重返基模战场:发布首个开源万亿模型,押注“模型即Agent”
炒股就看,权威,专业,及时,全面,助您挖掘潜力主题机会!

蓝鲸新闻7月12日讯(记者 朱俊熹)时隔半年,“大模型六小龙”之一的月之暗面终于推出新一代基座模型Kimi K2。据官方介绍,Kimi K2是一款具备更强代码能力、更擅长通用Agent任务的MoE架构基础模型,总参数达1万亿,激活参数为320亿。
7月11日发布并同步开源的新模型包括两个版本:基础模型Kimi-K2-Base、更适合通用聊天和智能体任务的后训练模型Kimi-K2-Instruct。在自主编程、工具调用和数学推理相关的能力评测中,Kimi K2均取得了较优的表现。以SWE-bench Verified、AIME 2025等评测集为例,Kimi-K2-Instruct的得分超过了同为开源模型的DeepSeek-V3、阿里Qwen3,逼近甚至能够反超OpenAI GPT-4.1、Anthropic Claude 4 Opus等领先闭源模型。
结合6月底开启内测的新Agent“Kimi-Researcher”不难看出,月之暗面的思路正转向“模型即Agent”。模型自身就集成了自主决策和执行任务的能力,能够作为智能体解决复杂任务。
在官方释出的用例中,用户要求Kimi K2帮忙规划参加Coldplay乐队巡演的行程。该模型通过17次工具调用,涵盖搜索、日历、邮箱、航班、餐厅预订等环节,制定出一份完整的机酒与旅游规划,并形成可视化报告。
智能体能力正在成为国内外大模型厂商竞相押注的进化方向。本周,马斯克旗下的人工智能初创公司xAI发布新一代大模型Grok 4,包括单智能体、多智能体两个版本,具备工具使用、实时搜索等功能。Anthropic在推出Claude 4系列模型时也强调,在编程、推理和Agent方面“树立了全新标准”,能够处理复杂且长时间运行的任务。
月之暗面在Kimi K2的技术博客里分享了对构建开放智能体智能的看法。其指出,预训练是智能体智能的关键基础,它让模型拥有基本的知识、理解和推理能力,从而在后续的强化学习中更有效地学习。但“人类数据就像是有限的‘化石燃料’”,因此如何在预训练阶段提升对有限数据的利用效率,成为当前AI扩展的关键挑战。
而在后训练阶段,大模型不再只依赖人类数据,开始从自己的行为和结果中获得奖励、进行自我优化,以实现超越人类能力的可能。
“Kimi K2正是在这些洞见之上锻造而成的。”月之暗面表示。其同时强调,Kimi K2是构建通用Agent能力的坚实基础,但通用Agent还需要更高级的能力,比如思考和视觉理解,计划未来为该模型加入这些能力。此外,长文本处理能力曾是Kimi的核心优势,此次Kimi K2的上下文长度为128k,不及部分新发布的模型。
值得注意的是,Kimi K2是国内首个开源的万亿参数级别模型。此前虽有其他大模型厂商训练出万亿参数模型,如腾讯混元Turbo、MiniMax abab 6.5等,但都采取了闭源路线。
在训练Kimi K2这样的万亿参数级别的大模型时,月之暗面采用了自主创新的Muon优化器。与传统的Adam优化器相比,Muon在token利用效率上表现更优,能让大模型学得更快、更有效率。同时为解决Muon在超大规模训练时遇到的不稳定问题,团队还提出了MuonClip这一稳定性增强技术,支撑Kimi K2顺利完成15.5万亿tokens的预训练,未出现训练损失值的异常峰值。
自年初DeepSeek横空出世以来,月之暗面虽然陆续释出了一些技术或产品上的更新,但始终未能重拾外界对其的热切期待,一度表现得颇为低调沉寂。而此次Kimi K2的发布,让这家明星创企终于重回基模舞台的聚光灯下,这场牌局仍未见定论。
- • 2025中国汽车产业发展(泰达)国际论坛新闻发布会举办
- • 加拿大总理特鲁多自我隔离:防疫责任重于泰山
- • 免费博客:开启个人品牌建设的全新平台
- • 秘鲁发生6.0级地震 震源深度100公里
- • 直通部委 | 司法部:坚决遏制趋利性执法 发改委:今年将推出约3万亿优质项目
- • 《消防培训课件免费下载:提升消防安全意识,共建平安家园》
- • 关税下Temu美区“急转弯”,力推新模式承接流量
- • 《梦幻西游85级剧情全攻略:探索神秘副本,解锁精彩故事》
- • 伊朗外长与俄罗斯外长通话,讨论地区最新局势
- • 广西科学调度保障春灌面积1373.53万亩
- • 美国与G7成员达成协议 将建立“并行”体系以避免全球税收战
- • 《数学奇遇记:五年级的数学小故事》
- • 红利类资产再度发力,红利低波ETF(512890)连续两周获得资金周度净流入
- • 岸迈生物拟港股上市,此前靠对外授权补血近5亿
- • 离散31年,他们一家三代在上海终团圆
- • 歌手陈奕迅发文报平安:复活后先吃肉
- • 保洁岗位职责及要求:打造洁净环境的关键要素
- • 地方新闻精选 | 浙江仙居回应烈士纪念设施遭人为破坏 广东梅州回应宣传片抄袭质疑
- • 河南高考最高分:梦想照进现实,拼搏铸就辉煌
- • 探寻世界阴展艺术的独特魅力
- • 数码单反相机:揭秘摄影爱好者的得力助手
- • 美国上诉法院暂时恢复特朗普关税政策,对“紧急状态”的司法解释成焦点
- • 特朗普无意与马斯克对话 称将考虑是否取消后者的政府合同
- • 美国股市:标普500指数站上6000点大关 就业数据带来惊喜
- • 兴证国际:华润饮料产能结构优化 毛利率有望持续提升 首予“增持”评级
- • 《解放战争大揭秘全集:一段波澜壮阔的历史画卷》
- • 苹果13 Pro色彩盛宴:探索五种独特配色,彰显个性品味
- • 伊朗警方逮捕2名以色列特工,发现超200公斤爆炸物
- • 面临50%关税威胁,巴西为啥也被特朗普针对?
- • 问答实录|贵州茅台2024年度业绩说明会
- • “玻尿酸女王”赵燕下一线,管理营销及护肤品牌业务
- • 化妆品代购:跨境购物的便捷新选择
- • 马斯克正将全部精力重新放到电动车和火星事业上
- • 福建执业注册管理中心:助力专业人才发展的坚实后盾
- • 秋瓷炫美人图未删减:揭秘韩国女神的绝世容颜
- • 中年人生:探索中年的年龄范围及其特征
- • 幼儿园学年度工作计划:创新教育,培养未来之星
- • 美团旅行:上周末江苏旅游订单全国第一
- • 高盛:维持对A股和港股超配建议,预计沪深300指数目标点位为4600点
- • 云闪付客服热线人工服务:您的贴心金融助手
- • mpp电缆保护管:守护电力传输的安全卫士
- • 上海银行召开2024年度暨2025年第一季度业绩说明会
- • 轻歌曼舞,花间buff,探寻古典诗意生活之美
- • 可姐的美食探索:黑蒜的独特风味
- • 《软件开发协议范本:保障合作双方的权益与利益的关键文件》
- • 中国高速公路网高清图:展现国家交通发展新面貌
- • 崇仁九银村镇银行被罚28万元:违反金融统计相关规定等
- • 《在线畅玩“锄大地”:重温经典牌技的乐趣时光》
- • 龙虾店后厨叼烟炒菜,当地监管部门回应
- • 《我的未来不是梦——致敬经典原唱者张雨生》
- • “184839:数字背后的历史密码”
- • OpenAI否认有采用谷歌自研芯片的计划
- • 探秘“盆景艺术在线”:数字时代下的盆景艺术盛宴
- • 贵州茅台酱香酒营销有限公司2025年半年市场工作会召开
- • 界面早报 | 国务院发文复制推广自贸试验区试点措施;王毅:稀土不会成为中欧之间的问题
- • 德国DAX指数创下纪录新高 成为首个突破3月峰值的欧洲主要股指
- • 胖东来和田玉专柜销售火爆,已改为线上约号模式
- • 我在迪拜做科创
- • 2025广州米其林指南发布
- • 门头广告:城市繁华的窗口与商业活力的催化剂
- • 卷烟销售网:便捷购物体验,轻松满足烟民需求
- • 《求索的博客:中国网络文化的璀璨明珠》
- • 中尺寸OLED持续升温,TCL华星下一步要打开IT市场
- • 世卫:“孤独”每小时致全球100人死亡,过多使用屏幕引发担忧
- • 福建省汽车工业集团董事长陈建业,调任省工信厅厅长
- • 北大名师网:汇聚顶尖教育资源,助力学子成就未来
- • 土耳其伊斯坦布尔:四季分明,气候宜人的地中海风情
- • 《吻床大全:揭秘卧室中的浪漫艺术》
- • 关颖颖高清肉搏画面引热议:模特界的“辣眼睛”现象再引关注
- • 江苏证监局处罚“世界铜王”王文银
- • 齐建功获批担任建信理财董事长
- • 美国第三大储能商破产,欠了宁德时代、中集普威6.6亿
- • 我国第三次土地调查:精准描绘新时代土地资源蓝图
- • 中国共产党河南省委员会:引领中原大地发展的坚强核心
- • 五月天,激荡青春的旋律
- • 妻子巧妙助力,实现我心中的“绿帽”梦想
- • 莫畏浮云遮望眼,风物长宜放眼量——人生哲理的启示
- • 食品安全,守护健康——食品安全视频宣传片深度解析
- • 金爵红毯|冯小刚雷佳音两个人的红毯,他们一起《抓特务》
- • 色欲影视:揭秘影视作品中色情元素的演变与影响
- • 黄群宋月才姜开斌王继才:忠诚奉献的楷模,时代精神的传承者
- • 穿越乃堆拉山口:探寻川藏线的壮丽与挑战
- • 特朗普政府计划对哈佛大学采取更多行动
- • 2018年中国城镇化率:迈向全面小康社会的坚实步伐
本文 快租网 原创,转载保留链接!网址:https://mip.kuaizu.me/post/19056.html