虎科技
业界资讯 手机产品 数码产品 移动互联 软件产品 智能汽车 生活家电 关于我们 热点资讯

华为云Tokens服务升级,384超节点助力实现2400TPS高性能算力

2025-08-28来源:ITBEAR编辑:瑞雪

在第四届828 B2B企业节的盛大开幕式上,华为云公布了一项重大进展:其Tokens服务已成功融入CloudMatrix384超节点体系。这一融合得益于xDeepServe架构的革新,使得单芯片的处理能力突飞猛进,达到了前所未有的2400TPS(每秒事务处理数),同时保持了50ms的TPOT(任务处理总时间),这一成绩远超当前行业标准。

面对中国AI算力需求的爆炸式增长,华为云展现出其“全栈创新”的实力。数据显示,从2024年初至2025年6月底,中国日均Token消耗量从1000亿飙升至30万亿,这一300多倍的增长凸显了人工智能应用的迅猛扩张,也对算力基础设施提出了更高要求。

早在今年3月,华为云便推出了基于MaaS(模型即服务)的Tokens服务,旨在满足不同应用与场景的性能和时延需求。该服务提供多种规格,如在线版、进线版、离线版及尊享版,为大模型和Agent智能体等AI工具提供了灵活、高效且成本优化的算力解决方案。

此次,Tokens服务与CloudMatrix384超节点的结合,通过xDeepServe框架的再次升级,将吞吐量从年初的1920TPS提升至2400TPS,TPOT则缩短至50ms。这一成就背后,是华为云从硬件到软件、从算子到存储、从推理框架到超节点的全方位技术创新。

CloudMatrix384超节点以其独特的计算架构,打破了性能瓶颈,奠定了坚实的算力基础。同时,CANN(昇腾计算架构)硬件使能技术优化了算子与通信策略,使得云端算力得以高效调用。EMS弹性内存存储则打破了AI内存墙,实现了“以存强算”,进一步释放了芯片算力。而xDeepServe分布式推理框架,则通过Transformerless的极致分离架构,让超节点能够释放出更高效的算力。

xDeepServe将MoE大模型拆解为可独立伸缩的Attention、FFN、Expert三个微模块,这些“积木”被分配到不同的NPU上同步处理任务,然后通过高效的XCCL通信库与FlowServe自研推理引擎重新组合,形成超高吞吐量的LLM服务平台。这一创新架构,使得单卡吞吐量从600tokens/s跃升至2400tokens/s。

XCCL作为专为超节点上的大语言模型服务设计的高性能通信库,充分发挥了CloudMatrix384的UB互联架构潜力,为Transformerless的全面分离提供了坚实的带宽与时延支持。而FlowServe作为“去中心”式分布式引擎,将CloudMatrix384划分为完全自治的DP小组,每个小组自给自足,确保了千卡并发时的流畅运行。

华为云MaaS服务目前已支持DeepSeek、Kimi、Qwen、Pangu、SDXL、Wan等主流大模型及versatile、Dify等主流Agent平台。通过大量的模型性能优化与效果调优,华为云实现了“源于开源,高于开源”,让大模型在昇腾云上展现出更卓越的性能。例如,在文生图大模型上,通过量化与融合算子等技术,华为云MaaS平台在轻微损失画质的情况下,实现了出图速度的两倍提升,最大支持2K×2K尺寸。在文生视频大模型上,则通过量化与通算并行等方式,大幅提升了视频生成速度,相较于竞争对手实现了3.5倍的性能优势。

在应用层面,华为云已与超过100家合作伙伴携手,深入行业场景,共同开发丰富的Agent应用。这些应用覆盖了调研分析、内容创作、智慧办公、智能运维等多个领域,解决了众多产业难题,帮助企业更便捷地拥抱AI创新,加速智能化转型。例如,基于MaaS平台推出的今日人才数智员工解决方案,集成了先进的自然语言处理、机器学习和深度学习技术,能够智能交互并处理任务,显著提升服务效率与客户满意度。而北京方寸无忧科技开发的无忧智慧公文解决方案,则提升了公文处理效能,推动了政企办公的智能化转型。

雷军晒小米YU7前向碰撞测试实拍 展现硬核安全实力
快科技11月14日消息,就在刚刚雷军发布视频称:小米YU7前向碰撞测试实拍:包括正面100%重叠、50%重叠两个场景。 事实上,在这之前小米汽车官网已经发布了这个视频,而雷军又一次转发了这个信息,为的是让更多…

2025-11-15

iPhone 17系列中国市场激活量破千万 性能升级受消费者青睐
【环球网科技综合报道】11月14日消息,据科技博主@数码闲聊站披露,苹果 iPhone 17 系列本周在中国市场的激活量已突破1000万台,创下该系列上市以来的阶段性销量新高,印证了中国消费者对其产品升级的认…

2025-11-15

华为顶级旗舰价格大降,16GB+512GB直降2100元,为新机腾位
这段时间虽然登场了很多新旗舰,但阿维觉得挺遗憾的,因为绝大多数新旗舰都只是常规升级,单纯为了启用第五代骁龙8至尊版和天玑9500,在这种情况下,甚至就连小米17 Pro系列上并不算多大创新的背屏也成为了大家津…

2025-11-14

安谋科技发布“周易”X3 NPU IP,端侧AI性能飙升助力多领域落地
智东西11月14日消息,昨日,安谋科技正式发布了专为端侧大模型而生的最新一代NPUIP——“周易”X3,其能够与Arm架构CPU、GPU协同,组成基于Arm生态的异构算力解决方案。 新的“周易”X3 NP…

2025-11-14

联想明年再发力!moto razr折叠机与Y700平板将携骁龙8系新平台登场
【CNMO科技消息】11月14日,有数码博主爆料称,联想明年将继续迭代拯救者Y700平板和moto razr系列折叠手机。这两款产品将搭载第五代骁龙8至尊版和第五代骁龙8移动平台,其中,Y700平板屏幕比例为…

2025-11-14

华为Mate70 Air深度体验:打破常规,超大屏“Air”的另类演绎
可以确定,华为Mate70 Air的影像没有因为“Air”的定义做妥协,在同价位机型中是能打的,硬件配置方面也是这个思路。这也符合华为Mate70 Air的技术路径,虽然重量不可避免地来到208g,但是保…

2025-11-14

欧加9K级大电池定版试产,一加骁龙8系直屏新机测试,中端机竞争升级
IT之家 11 月 14 日消息,博主 @数码闲聊站 今天在微博透露,欧加的 9K 级别大电池现已定版试产。 博主表示,这块电池采用单块4.51V 单电芯设计,额定容量 32.59Wh,额定电池 8760m…

2025-11-14

联发科天玑8系芯片屠榜安卓次旗舰性能榜 性能能效双优成市场新宠
以榜单第一的真我Neo7 SE为例,通过与MTK联发科技的深度联合调校,该机在同价位段中展现出极为出色的游戏性能,搭配真我GT性能引擎,通过芯片级调校,实现了持久稳定的高帧率表现,同时能耗最高可降低7%,帧…

2025-11-14

真我neo 8新机曝光:8000mAh大电池+3D超声波指纹,2000元档性价比新选择
真我手机从2018年成立到现在,也是走过了7个年头,如今真我手机全球销量达到三亿,在全球范围内跻身手机圈的第一梯队,虽说份额还是差小米等品牌很多,可知名度已经起来了。在今年真我尝试冲击高端,发布的真我GT …

2025-11-14

第45周国内手机市场格局:苹果领跑,小米vivo紧随其后竞争激烈
据CNMO了解,截至11月2日,该系列在国内的激活数量已突破825万台,其中iPhone 17 Pro Max约395.7万台、iPhone17 Pro约246.2万台、标准版iPhone 17约172.8…

2025-11-14