虎科技
业界资讯 手机产品 数码产品 移动互联 软件产品 智能汽车 生活家电 关于我们 热点资讯

月之暗面Kimi K2万亿参数模型开源:编程与Agent能力实测体验分享

2025-07-12来源:ITBEAR编辑:瑞雪

国内大模型领域的先锋企业月之暗面,近日震撼发布了其最新力作——Kimi K2,一款总参数量高达1万亿(1T)的MoE架构基础模型,并慷慨地选择了开源。这款模型已在Kimi的Web端和App端上线,供用户体验。

Kimi K2作为月之暗面的旗舰之作,首次开源便交出了亮眼的成绩单。在SWE Bench Verified(编程)、Tau2(智能体)、AceBench(工具调用)三大基准测试中,它均取得了开源模型中的顶尖成绩。这一表现,无疑为月之暗面在国内乃至全球的大模型舞台上赢得了更多关注。

在具体能力上,Kimi K2在自主编程、工具调用和数学推理方面均展现出了强大的实力。尽管在某些基准测试中,它略逊于Claude 4 Opus、OpenAI GPT-4.1等顶尖模型,但相较于DeepSeek-V3-0324、Qwen-235B-A22B等模型,Kimi K2的优势依然明显。

月之暗面在Kimi K2的训练过程中,采用了创新的“MuonClip”优化器,这一优化器有效提高了Token的利用效率,并缓解了高质量人类数据短缺的问题。他们还引入了大规模Agentic Tool Use数据合成技术和通用强化学习机制,进一步提升了模型的通用智能能力。

Kimi K2的API服务也同步上线,支持最长128K的上下文长度,为用户提供了极大的便利。在计费方案上,Kimi K2采取了每百万输入tokens 4元、每百万输出tokens 16元的策略,这一价格虽然较DeepSeek V3翻倍,但考虑到其强大的功能和性能,依然具有极高的性价比。

为了满足不同用户的需求,Kimi K2系列提供了两个模型版本供用户选择。其中,Kimi-K2-Base是基础预训练模型,未经指令微调,适合科研与自定义场景;而Kimi-K2-Instruct则是经过通用指令微调的版本,可用于大多数问答与Agent任务。这两个版本均已开源,用户可根据自己的需求进行下载和使用。

用户还可以通过无问芯穹Infini-AI异构云平台以与官方API同样的价格调用Kimi K2,这无疑为用户提供了更多的选择和便利。

在编程能力方面,Kimi K2展现出了惊人的实力。它能够生成具有设计感和视觉表现力的代码,支持粒子系统、可视化和3D场景等多种形式。在官方Demo中,Kimi K2成功开发了一个支持昼夜循环的山川峡谷3D景观和粒子特效银河,令人叹为观止。然而,在实际测试中,虽然Kimi K2交付的网页渲染效果并未完全达到官方Demo的水平,但其交互性和功能丰富度依然令人印象深刻。

在个人网站开发任务上,Kimi K2同样展现出了不俗的规划能力。它能够主动梳理网站的目录结构,打造出可扩展性更好的网站。与Kimi K1.5相比,Kimi K2在UI审美水平上有了一定的提升,虽然进步有限,但足以看出月之暗面在模型优化上的不懈努力。

除了编程能力外,Kimi K2的Agent工具调用能力也得到了显著增强。它能够解析复杂指令,将需求自动拆解为一系列格式规范、可直接执行的ToolCall结构。这意味着开发者可以将Kimi K2接入各种Agent/Coding框架,完成复杂任务或自动化编码。在实际演示中,Kimi K2展现出了强大的Agentic能力,如分析远程办公比例对薪资的影响、自动生成统计图表和回归模型解读等。

Kimi K2还具备了更强的风格化写作能力。它能够模仿各种风格的文案,如苹果广告文案等,为用户提供了更多的创作灵感。在通用知识推理、数学、规划等任务中,Kimi K2的表现同样出色,能够轻松应对各种挑战。

雷军晒小米YU7前向碰撞测试实拍 展现硬核安全实力
快科技11月14日消息,就在刚刚雷军发布视频称:小米YU7前向碰撞测试实拍:包括正面100%重叠、50%重叠两个场景。 事实上,在这之前小米汽车官网已经发布了这个视频,而雷军又一次转发了这个信息,为的是让更多…

2025-11-15

iPhone 17系列中国市场激活量破千万 性能升级受消费者青睐
【环球网科技综合报道】11月14日消息,据科技博主@数码闲聊站披露,苹果 iPhone 17 系列本周在中国市场的激活量已突破1000万台,创下该系列上市以来的阶段性销量新高,印证了中国消费者对其产品升级的认…

2025-11-15

华为顶级旗舰价格大降,16GB+512GB直降2100元,为新机腾位
这段时间虽然登场了很多新旗舰,但阿维觉得挺遗憾的,因为绝大多数新旗舰都只是常规升级,单纯为了启用第五代骁龙8至尊版和天玑9500,在这种情况下,甚至就连小米17 Pro系列上并不算多大创新的背屏也成为了大家津…

2025-11-14

安谋科技发布“周易”X3 NPU IP,端侧AI性能飙升助力多领域落地
智东西11月14日消息,昨日,安谋科技正式发布了专为端侧大模型而生的最新一代NPUIP——“周易”X3,其能够与Arm架构CPU、GPU协同,组成基于Arm生态的异构算力解决方案。 新的“周易”X3 NP…

2025-11-14

联想明年再发力!moto razr折叠机与Y700平板将携骁龙8系新平台登场
【CNMO科技消息】11月14日,有数码博主爆料称,联想明年将继续迭代拯救者Y700平板和moto razr系列折叠手机。这两款产品将搭载第五代骁龙8至尊版和第五代骁龙8移动平台,其中,Y700平板屏幕比例为…

2025-11-14

华为Mate70 Air深度体验:打破常规,超大屏“Air”的另类演绎
可以确定,华为Mate70 Air的影像没有因为“Air”的定义做妥协,在同价位机型中是能打的,硬件配置方面也是这个思路。这也符合华为Mate70 Air的技术路径,虽然重量不可避免地来到208g,但是保…

2025-11-14

欧加9K级大电池定版试产,一加骁龙8系直屏新机测试,中端机竞争升级
IT之家 11 月 14 日消息,博主 @数码闲聊站 今天在微博透露,欧加的 9K 级别大电池现已定版试产。 博主表示,这块电池采用单块4.51V 单电芯设计,额定容量 32.59Wh,额定电池 8760m…

2025-11-14

联发科天玑8系芯片屠榜安卓次旗舰性能榜 性能能效双优成市场新宠
以榜单第一的真我Neo7 SE为例,通过与MTK联发科技的深度联合调校,该机在同价位段中展现出极为出色的游戏性能,搭配真我GT性能引擎,通过芯片级调校,实现了持久稳定的高帧率表现,同时能耗最高可降低7%,帧…

2025-11-14

真我neo 8新机曝光:8000mAh大电池+3D超声波指纹,2000元档性价比新选择
真我手机从2018年成立到现在,也是走过了7个年头,如今真我手机全球销量达到三亿,在全球范围内跻身手机圈的第一梯队,虽说份额还是差小米等品牌很多,可知名度已经起来了。在今年真我尝试冲击高端,发布的真我GT …

2025-11-14

第45周国内手机市场格局:苹果领跑,小米vivo紧随其后竞争激烈
据CNMO了解,截至11月2日,该系列在国内的激活数量已突破825万台,其中iPhone 17 Pro Max约395.7万台、iPhone17 Pro约246.2万台、标准版iPhone 17约172.8…

2025-11-14