阿里巴巴发布 Qwen3.8 系列:2.4T 开源权重旗舰与混合架构 Flash-Next
2026 年 8 月,阿里巴巴发布开源权重模型 Qwen3.8(2.4T 参数、前沿级性能),并推出预览版 Qwen3.8-Flash-Next——采用 125B 总参 / 6B 激活的混合架构与 262K 可扩展至 1M 上下文,预览 Qwen4 架构方向。
阿里巴巴在 2026 年 8 月密集更新 Qwen 系列:Qwen3.8 Max 为 2.4T 参数的开源权重模型,官方称其达到前沿级性能,回应了此前核心研究员出走后对阿里开源领先地位的质疑。
同期发布的 Qwen3.8-Flash-Next 是 Qwen4 架构的预览:采用 GDN 与 QSA 混合注意力,125B 总参数中仅激活 6B,原生支持 262K 上下文并可扩展至 1M token;通过 QwenCloud 以约 $0.16 / $0.47 每百万输入 / 输出 token 的价格提供。
这些更新显示头部厂商在「开源权重 + 长上下文 + 高效架构」上的竞争持续升温,也为本地与云端部署提供了更强且更省算力的选项。
相关资讯
DeepSeek-V4-Pro 正式版上线,Agent 能力大幅跃升并实行分时定价
8 月 12 日晚 DeepSeek 与 xAI 同日发布新模型。V4-Pro 正式版主打智能体能力,DeepSWE 得分由 12.8 升至 62.7、多项 Agent 测试超过 Claude Opus 4.8;8 月 17 日起实行分时定价,高峰输出价涨至现行 4.5 倍。
Gemini 3.7 Flash 发布:编程与智能体升级,API 价格年内直降 50%
Google DeepMind 推出 Gemini 3.7 Flash,软件工程、调试与多步智能体工作流显著提升,登 WebDev Code Arena 第 8、Agent Arena 第 20;上下文扩至 100 万 token,API 价格年内下调 50%。
智谱发布 GLM-5.3 开源大模型,编程能力跃居开源模型首位
智谱发布 GLM-5.3,基于 GLM-5.2 基座、通过后训练 Scaling 提升智能上限;Terminal-Bench 3.0 编程能力较前代提升 50%、居开源模型第一,模型权重将于两周后开源。
OpenAI 被曝测试 GPT Image 2.5,官方为 GPT Image 2 API 加透明背景
多名海外用户发现名为 luna-lisa-alpha 的神秘模型现身 LMArena 盲测平台,重点提升人物一致性、真实感与文字生成能力,社区猜测其为 GPT Image 2.5 早期版本;同期 GPT Image 2 API 预览支持透明背景生成。OpenAI 尚未公开确认该模型存在。