虎科技
业界资讯 手机产品 数码产品 移动互联 软件产品 智能汽车 生活家电 关于我们 热点资讯

阿里发布4B小模型Qwen3系列:性能超GPT-4.1-nano,端侧部署更友好

2025-08-08来源:ITBEAR编辑:瑞雪

近日,通义千问在其技术更新中揭晓了两款全新的小型语言模型——Qwen3-4B-Instruct-2507与Qwen3-4B-Thinking-2507,这两款模型以其精简的尺寸和卓越的性能引起了业界的广泛关注。

据悉,Qwen3-4B系列的两款新模型在设计上充分考虑了端侧硬件的部署需求,旨在为用户提供更加高效、灵活的AI解决方案。其中,Qwen3-4B-Thinking-2507在推理能力上展现出了与中尺寸模型相当的实力,而Qwen3-4B-Instruct-2507则在知识、推理、编程、对齐及agent能力等多个方面全面超越了闭源的GPT-4.1-nano模型。

这两款新模型的上下文理解能力得到了显著提升,扩展至256K,使其能够处理更长的文本,并支持复杂的文档分析、长篇内容生成及跨段落推理等应用场景。在性能测试中,Qwen3-4B-Thinking-2507在复杂问题推理、数学能力、代码能力及多轮函数调用等方面均表现出色,而Qwen3-4B-Instruct-2507则在Arena-Hard v2基准测试中取得了43.4分的高分。

值得注意的是,Qwen3-4B-Instruct-2507在非推理领域同样展现出了强大的实力,全面超越了GPT-4.1-nano模型,并且其性能已接近中等规模的Qwen3-30B-A3B(non-thinking)模型。该模型覆盖了更广泛的语言知识,与人类偏好在主观和开放性任务中的对齐性得到增强,能够提供更贴近用户需求的答复。

在推理领域,Qwen3-4B-Thinking-2507更是表现出色,其推理能力足以媲美中等模型Qwen3-30B-Thinking。特别是在数学能力的测试中,该模型以4B的参数量取得了81.3分的高分。其通用能力也得到了显著提升,Agent分数甚至超越了更大尺寸的Qwen3-30B-Thinking模型。

通义千问此次推出的Qwen3-4B系列新模型,不仅实现了性能上的优化,更在通用能力上展现出了超越同级别模型甚至逼近中大规模模型的实力。同时,这两款小型语言模型对端侧硬件的友好度也更高,为用户提供了更加灵活、高效的AI解决方案。这一创新举措无疑将加速AI技术在端侧设备的渗透,推动更多轻量化、场景化的智能应用落地。

苹果小米新机首月销售亮眼:iPhone 17与小米17齐头并进创佳绩
IT之家 11 月 15 日消息,市场调查机构 CounterPoint Research 昨日(11 月 14 日)发布博文,基于最新中国智能手机周度销量追踪报告,苹果与小米凭借各自的旗舰新品,在上市首月的…

2025-11-15

华为Mate X7或本月登场 首发20GB超大内存 配色丰富性能强劲
11月份的机圈将会是华为的主场,不仅新一代的直板旗舰华为Mate80系列会震撼亮相,还会有迭代的大折叠屏手机华为Mate X7发布。@定焦数码爆料,华为Mate X7将会首发定制20GB超大内存,这是华为史…

2025-11-15

苹果联名iPhone Pocket:争议中售罄,高价能否续写品牌忠诚传奇?
苹果与日本时尚品牌三宅一生日前联名推出的iPhone Pocket(iPhone 口袋)11月14日正式开售,1299元至1899元的定价引发全网热议,成为科技圈与时尚圈跨界合作的又一争议焦点。尽管争议不断,…

2025-11-14

iPhone 17系列上市两月中国市场激活破千万,配置亮眼预售火爆
2025年11月14日,知名数码博主“数码闲聊站”爆料称,iPhone 17系列于本周完成中国市场激活超1000万台。 据了解,iPhone 17系列于2025年9月10日苹果秋季发布会推出,含标准版、Air…

2025-11-14

中芯国际三季度业绩亮眼:月产能破百万,全年收入或创新高
赵海军指出,中国区收入的显著增长主要受益于国内产业链自主化进程加快,为应对客户紧急需求,公司及时优化了产能分配策略。赵海军补充表示,在当前国内企业加速替代海外供应链的背景下,公司长期合作的客户成功把握了市场机…

2025-11-14

iPhone17系列销售势头猛 本周国内激活量或冲破1000万台大关
【CNMO科技消息】11月14日,据数码博主爆料称,iPhone17系列国内激活量将于本周突破1000万台。截至11月2日,该系列在国内的激活数量已突破825万台,其中iPhone 17 Pro Max约3…

2025-11-14

小尺寸也有大能量!vivo X300全方位体验测评
测试中平均帧率为61帧,5% Low帧为60帧,全程几乎没有变化——小屏机的游戏性能完全不需要担心。 续航测试,vivo X300从100%到20%的电量区间内连续运行了6小时54分,对于小尺寸机型来说是合…

2025-11-14

2025年游戏手机大比拼:OPPO Find X9、红魔10 Pro、一加13谁更胜一筹?
如果你是追求极致游戏体验,对游戏性能、续航和散热都有极高要求的重度游戏玩家,那么 OPPO Find X9 系列是你的首选。 而如果你想要一款配置较为均衡,在游戏性能、屏幕显示和续航等方面都有不错表现的手机…

2025-11-13

华为PC业务双线并行:鸿蒙PC加速突破,智选PC延续Windows生态
11月13日消息,虽然有了鸿蒙PC,但华为似乎短期并不想放弃Windows系统。 有博主给出的消息显示,华为在PC业务上仍将维持“鸿蒙PC”与“智选PC”双线并行的策略,短期内不会放弃基于Windows系统的…

2025-11-13