核心亮点

阿里千问发布 Qwen3.8-Flash,并同步开源权重版 Qwen3.8-Flash-Next(率先采用下一代 Qwen4 架构)。该模型为多模态 MoE,主模型 125B 参数,激活参数仅 6B,另增 51B N-gram Embedding 以存储换计算。

性能表现

官方评测中,模型在多项 Agent 任务上超越 Claude Opus4.6:

  • SWE-bench Pro:高 9.1 分
  • JobBench:高近 20 分
  • AndroidWorld:高 22.5 分
  • MathVision:高 25.1 分

原生支持 262K 上下文,可扩展至 1M。

价格与成本

生产版已上线 Qwen Cloud,默认支持 1M 上下文与工具调用,每百万 Token 输入 1 元、输出 3 元。官方称其整体能力接近 Qwen3.7-Plus,但训练成本仅约 1/9,以更少算力实现旗舰级性能。