月之暗面重返基模战场:发布首个开源万亿模型,押注“模型即Agent”
炒股就看,权威,专业,及时,全面,助您挖掘潜力主题机会!

蓝鲸新闻7月12日讯(记者 朱俊熹)时隔半年,“大模型六小龙”之一的月之暗面终于推出新一代基座模型Kimi K2。据官方介绍,Kimi K2是一款具备更强代码能力、更擅长通用Agent任务的MoE架构基础模型,总参数达1万亿,激活参数为320亿。
7月11日发布并同步开源的新模型包括两个版本:基础模型Kimi-K2-Base、更适合通用聊天和智能体任务的后训练模型Kimi-K2-Instruct。在自主编程、工具调用和数学推理相关的能力评测中,Kimi K2均取得了较优的表现。以SWE-bench Verified、AIME 2025等评测集为例,Kimi-K2-Instruct的得分超过了同为开源模型的DeepSeek-V3、阿里Qwen3,逼近甚至能够反超OpenAI GPT-4.1、Anthropic Claude 4 Opus等领先闭源模型。
结合6月底开启内测的新Agent“Kimi-Researcher”不难看出,月之暗面的思路正转向“模型即Agent”。模型自身就集成了自主决策和执行任务的能力,能够作为智能体解决复杂任务。
在官方释出的用例中,用户要求Kimi K2帮忙规划参加Coldplay乐队巡演的行程。该模型通过17次工具调用,涵盖搜索、日历、邮箱、航班、餐厅预订等环节,制定出一份完整的机酒与旅游规划,并形成可视化报告。
智能体能力正在成为国内外大模型厂商竞相押注的进化方向。本周,马斯克旗下的人工智能初创公司xAI发布新一代大模型Grok 4,包括单智能体、多智能体两个版本,具备工具使用、实时搜索等功能。Anthropic在推出Claude 4系列模型时也强调,在编程、推理和Agent方面“树立了全新标准”,能够处理复杂且长时间运行的任务。
月之暗面在Kimi K2的技术博客里分享了对构建开放智能体智能的看法。其指出,预训练是智能体智能的关键基础,它让模型拥有基本的知识、理解和推理能力,从而在后续的强化学习中更有效地学习。但“人类数据就像是有限的‘化石燃料’”,因此如何在预训练阶段提升对有限数据的利用效率,成为当前AI扩展的关键挑战。
而在后训练阶段,大模型不再只依赖人类数据,开始从自己的行为和结果中获得奖励、进行自我优化,以实现超越人类能力的可能。
“Kimi K2正是在这些洞见之上锻造而成的。”月之暗面表示。其同时强调,Kimi K2是构建通用Agent能力的坚实基础,但通用Agent还需要更高级的能力,比如思考和视觉理解,计划未来为该模型加入这些能力。此外,长文本处理能力曾是Kimi的核心优势,此次Kimi K2的上下文长度为128k,不及部分新发布的模型。
值得注意的是,Kimi K2是国内首个开源的万亿参数级别模型。此前虽有其他大模型厂商训练出万亿参数模型,如腾讯混元Turbo、MiniMax abab 6.5等,但都采取了闭源路线。
在训练Kimi K2这样的万亿参数级别的大模型时,月之暗面采用了自主创新的Muon优化器。与传统的Adam优化器相比,Muon在token利用效率上表现更优,能让大模型学得更快、更有效率。同时为解决Muon在超大规模训练时遇到的不稳定问题,团队还提出了MuonClip这一稳定性增强技术,支撑Kimi K2顺利完成15.5万亿tokens的预训练,未出现训练损失值的异常峰值。
自年初DeepSeek横空出世以来,月之暗面虽然陆续释出了一些技术或产品上的更新,但始终未能重拾外界对其的热切期待,一度表现得颇为低调沉寂。而此次Kimi K2的发布,让这家明星创企终于重回基模舞台的聚光灯下,这场牌局仍未见定论。
- • 飞书发布知识问答等多款AI产品
- • 揭开命运之谜:出生年月日时辰算命的艺术
- • 重庆一13岁男孩掉入绿化带雨水井内身亡,官方通报
- • 在上海这座电影之城,创新服务体系助力电影创作
- • 《火影忍者553集:命运之轮的转动,忍者世界的未来之战》
- • 周星驰配音:跨越时空的喜剧魅力
- • 毕业季|上科大校长、南科大校长现身同一场毕业典礼,他们说了什么
- • 探寻兰州美食:揭秘兰州摸吧的独特魅力
- • 司法所安置帮教计划:助力社区矫正,共建和谐社会
- • 河南481开奖直播:见证幸运时刻,感受快乐生活
- • 网易全球投资部总裁朱原离职,丁迎峰接管第一方工作室
- • 4月黑猫投诉娱乐票务领域企业红黑榜:银河左岸不遵守买新退旧公告拒绝退款
- • 保洁服务合同模板:规范服务,保障权益
- • “应下调整整一个百分点”,美总统特朗普再次要求美联储降息
- • 卢伟冰谈小米YU7:比SU7有更大的受众面
- • 征服之海:人类航海史上的辉煌篇章
- • 提前涨停!002875,重大宣布!明日停牌
- • 《小小:容祖儿的音乐旅程与情感共鸣》
- • IPO雷达|《长恨歌》背后公司再冲上交所主板,入局泰山项目能成功吗?
- • 年内涨幅跑赢黄金!现货铂金价格突破2014年以来新高
- • 青春绽放:18岁少女Elsa的成长故事
- • 流感疫苗出现八元/支的历史新低价
- • 《欢声笑语,童趣无限:小学一年级儿歌大全推荐》
- • 揭秘免费一级大录像大全:网络资源与版权保护的边界探讨
- • 海姆斯沃斯:揭秘挪威小镇的独特魅力
- • 汽车早报|比亚迪欧洲总部落户匈牙利 奇瑞12.8亿成立智能科技公司
- • 卢特尼克:欧洲可能已经到了贸易谈判的“最后阶段”
- • 《梦回千年,情系男主名字——探寻古风小说中的男子风采》
- • 浙商银行:股东横店集团累计减持公司0.88%股份
- • 圆通在线:助力快递行业数字化转型,打造智慧物流新格局
- • 王楚钦微博取关孙颖莎:一段乒乓情缘的微妙变化
- • 俄外长与美国务卿通电话,讨论即将举行的俄乌谈判
- • 柳岩晒健身照,健身女神魅力四射,健康生活态度感染众人
- • 云南省政协原党组成员、秘书长车志敏接受审查调查
- • 云南省红十字会原副会长田华兵主动投案,接受审查调查
- • 探索外国免费网站:资源丰富,便捷高效的生活方式
- • 2014年世界杯:激情燃烧的足球盛宴
- • 四大民营石化龙头年度成绩单:恒力石化独涨,东方盛虹巨亏23亿
- • “英桃小丸子:一个充满童趣的动漫传奇”
- • CWG Markets外汇:俄罗斯拟对天然气巨头减税
- • 国产电影2014:中国电影产业的崛起与挑战
- • 纳瓦罗:鲍威尔的货币政策正在给美国造成严重经济损害
- • 民营银行存款利率一降再降 经营承压瞄准“数字化”突围
- • 002128,宣布重大资产重组!明天复牌
- • KPII:企业绩效评估的新趋势
- • 籽料与山料:探寻玉石界的两大瑰宝之别
- • 道德讲堂诵经典,传承文明之光
- • 港亚控股因行使可转换票据的转换权而发行7500万股
- • 纽约汇市:美元空头回归 贸易风险升温推动日元走高
- • 中国纪检监察刊文:力戒形式主义官僚主义关键是要坚持实事求是
- • 揭秘爱泼斯坦丑闻:一场震惊世界的权力与金钱交易
- • “85后”孔大力任国家天文台副台长、上海天文台台长
- • 《枕边有张脸2》:恐怖悬疑,再掀惊悚狂潮
- • 字节跳动Seed前员工因严重违反制度被辞退,并扣发全额年终奖
- • 脸上起白色小豆豆,揭秘皮肤健康隐患
- • 2019年研究生国家线:突破与挑战并存的一年
- • 古代女子杖刑臀部:一段被尘封的历史记忆
- • 郭德纲:相声界的传奇人物
- • 英伟达正在就投资PsiQuantum进行深入谈判
- • 大块强光碎片:揭秘分解装备背后的神秘力量
- • 演员辛柏青发讣告,妻子朱媛媛去世
- • Lululemon因削减全年盈利指引并提及“动态宏观环境”股价暴跌23%
- • 特朗普宣布美伊下周将重启谈判,伊朗外长:不会放弃核技术
- • 机构:美国贸易法院叫停特朗普关税有助提振风险偏好
- • 分析师:若伊朗能源供应告急 欧佩克+出手增产恐将引火烧身
- • 《斗罗大陆4:极限斗罗》漫画版:激情燃烧的斗罗世界再掀热潮
- • 德国上半年破产企业数量创近十年新高,超14万员工受影响
- • 广东河源市源城区发生3.5级地震,震源深度11公里
- • 青草影院:一家充满绿色情怀的电影院
- • 投资中国意味着更高的确定性!证监会最新发声
- • 比亚迪今年前四月新加坡销量排名第一,首次超过丰田
- • 世界和平论坛|鸠山由纪夫:应对特朗普关税,“狭路相逢勇者胜”
- • 2019年高考一分一段表湖南:揭秘高考成绩分布与录取趋势
- • 四大会计师事务所招聘信息:开启职业生涯新篇章
- • 尾盘:美股继续下滑 道指下跌300点
- • 常用消防器材及其使用方法详解
- • 兔死狗烹,鸟尽弓藏:历史中的权力游戏与人性反思
- • 伊朗总统:已准备好开启与波斯湾邻国关系新篇章
- • 哈马斯称正在研究新收到的加沙停火协议草案
- • 一文读懂|美联储连续第四次维持利率不变 降息还需继续观望 鲍威尔拒绝回应特朗普侮辱言语
- • 君子兰烂根的原因及防治方法
- • 郭艾伦与郭士强:血缘与篮球的交织,一段深厚的父子情
- • 阿里千问3全球下载量破千万
- • 特朗普:将于周一上午10点与普京通话
本文 快租网 原创,转载保留链接!网址:https://wap.kuaizu.me/post/19056.html