标签

阿里开源千问新模型Qwen3.8Flash,性能碾压Opus4.6售价低至3%

发布时间:2026-08-26 21:10阅读:4

新浪科技讯 8月26日晚间消息,阿里巴巴正式推出并同步开源千问系列最新版本Qwen3.8-Flash。该模型基于全新下一代架构打造,总参数规模达千亿级别,但运行时仅需激活60亿(6B)参数,即可实现超越Claude Opus4.6的顶尖表现,刷新了全球模型效率领域的最高基准。

由于架构与训练方法的双重革新,Qwen3.8-Flash的训练开销相较于Qwen3.7-Plus大幅缩减近九成,推理成本也显著下降,每百万Tokens输入价格低至1元、输出3元,最低价格仅为DeepSeek-V4-Flash的三分之一。Qwen3.8-Flash将于今晚率先在"千问办公"平台上线,开发者及企业用户也可通过千问AI平台调用新模型的API接口服务。

Qwen3.8-Flash属于多模态混合专家(MoE)模型,采用下一代(Next)模型架构,Transformer总参数125B仅激活6B,性能表现超越Opus4.6、逼近Opus4.8。仅经过预训练阶段的Qwen3.8-Flash基座(Base)模型,在通用能力(SuperGPQA)、数学推理(GSM8K)、编程(SWEBench-Pretrain)等基础测试中均跑赢了体积为自身三倍的Qwen3.7-Plus基座模型。经后训练优化后,Qwen3.8-Flash性能迎来质的飞跃:在评估智能体编程能力的SWE-bench Pro评测中以9.1分的优势领先Opus4.6;在长程专业任务CoWorkBench及真实工具调用Toolathlon Verified等智能体任务中,均胜出DeepSeek-V4-Flash。

Qwen3.8系列的技术突破,使训练与推理两端成本实现了大幅压缩。Qwen3.8-Flash性能与上一代Qwen3.7-Plus接近,却仅耗费九分之一的资源便完成了训练,训练成本缩减九成;推理时,每百万Tokens输入低至1元、输出3元,价格仅为Claude Opus4.6的3%,相较DeepSeek-V4-Flash闲时价格为三分之二、忙时价格为三分之一。(文猛)

责任编辑:孙同怀

新浪财经声明:本消息系转载自合作媒体,新浪财经刊载此文旨在传递更多信息,文章内容仅供阅读参考,不构成任何投资建议。

郑重声明:1.依据《证券法》规定,严禁编造、传播虚假信息或误导性信息,不得扰乱证券市场秩序;2.用户在本社区发布的所有资料、言论等仅代表其个人观点,与本网站立场无关,亦不构成任何投资建议。用户须基于自身独立判断,自行决定证券投资并承担相应风险。