核心亮点
阿里千问发布 Qwen3.8-Flash,并同步开源权重版 Qwen3.8-Flash-Next(率先采用下一代 Qwen4 架构)。该模型为多模态 MoE,主模型 125B 参数,激活参数仅 6B,另增 51B N-gram Embedding 以存储换计算。
性能表现
官方评测中,模型在多项 Agent 任务上超越 Claude Opus4.6:
- SWE-bench Pro:高 9.1 分
- JobBench:高近 20 分
- AndroidWorld:高 22.5 分
- MathVision:高 25.1 分
原生支持 262K 上下文,可扩展至 1M。
价格与成本
生产版已上线 Qwen Cloud,默认支持 1M 上下文与工具调用,每百万 Token 输入 1 元、输出 3 元。官方称其整体能力接近 Qwen3.7-Plus,但训练成本仅约 1/9,以更少算力实现旗舰级性能。