站长之家 - 业界 2026-08-27 09:01

超越V4 Flash 千问Qwen3.8-Flash大模型开源:提前用上下代Qwen4架构

8月26日晚间,多家厂商集中发布开源模型,阿里千问团队也推出了Qwen3.8-Flash。该版本名称仍属于3.X系列,但官方指出其内部已切换至下一代Qwen4架构,是为开源社区准备的技术预览版,以便提前试用新架构能力。

官方资料显示,Qwen3.8-Flash是一款多模态混合专家(MoE)模型,总参数规模为125B,包含51B的N-gram嵌入,单个令牌仅激活6B参数。其原生上下文窗口为262K,可通过YaRN机制扩展至1M。

在定价上,该模型输入费用为每百万令牌0.16美元,输出费用为每百万令牌0.47美元。相比之下,DS V4 Flash的输入和输出价格分别为0.22美元和0.66美元,高峰时段还会翻倍,因此Qwen3.8-Flash的性价比优势较为突出。

架构方面,该版本采用GDN QSA混合注意力、门控残差、N-gram嵌入和Muon优化器,这些技术也被视为Qwen4架构的基础组成部分。

测试成绩方面,Qwen3.8-Flash在DeepSWE 1.1中取得58.7分,在SWE-bench Pro中取得62.5分,在CoWorkBench中取得73.9分,在AndroidWorld中取得84.5分,在MathVision(带CI)中取得95.7分。官方称其综合表现已经超越V4 Flash,结合更低的调用成本,有望成为新的替代选项。

超越V4 Flash 千问Qwen3.8-Flash大模型开源:提前用上下代Qwen4架构

超越V4 Flash 千问Qwen3.8-Flash大模型开源:提前用上下代Qwen4架构

推荐关键词

24小时热搜

查看更多内容

大家正在看