DeepSeek-V4-Pro 正式版上线,Agent 能力大幅跃升并实行分时定价
8 月 12 日晚 DeepSeek 与 xAI 同日发布新模型。V4-Pro 正式版主打智能体能力,DeepSWE 得分由 12.8 升至 62.7、多项 Agent 测试超过 Claude Opus 4.8;8 月 17 日起实行分时定价,高峰输出价涨至现行 4.5 倍。
DeepSeek 自 V2 时代起就以「低成本、高性能」搅动全球大模型格局。本次 V4-Pro 正式版把重心放在智能体(Agent)与工具调用能力上——DeepSWE 基准得分从 12.8 跃升至 62.7,多项智能体测试成绩超过 Claude Opus 4.8,意味着模型在自主完成多步软件工程任务上有了质的提升。
价格方面,DeepSeek 宣布自 8 月 17 日起实行分时定价,高峰时段输出价格涨至现行的 4.5 倍。这既反映了推理算力成本的压力,也延续了其「低价普惠 + 稀缺时段溢价」的一贯策略,引导用户把非紧急任务调度到闲时。
对开发者而言,Agent 能力的跃升意味着更复杂的自动化工作流可以在单一模型内闭环完成;但高峰溢价也提示生产环境需要做好任务调度、结果缓存与成本监控,避免账单失控。
相关资讯
Gemini 3.7 Flash 发布:编程与智能体升级,API 价格年内直降 50%
Google DeepMind 推出 Gemini 3.7 Flash,软件工程、调试与多步智能体工作流显著提升,登 WebDev Code Arena 第 8、Agent Arena 第 20;上下文扩至 100 万 token,API 价格年内下调 50%。
智谱发布 GLM-5.3 开源大模型,编程能力跃居开源模型首位
智谱发布 GLM-5.3,基于 GLM-5.2 基座、通过后训练 Scaling 提升智能上限;Terminal-Bench 3.0 编程能力较前代提升 50%、居开源模型第一,模型权重将于两周后开源。
OpenAI 被曝测试 GPT Image 2.5,官方为 GPT Image 2 API 加透明背景
多名海外用户发现名为 luna-lisa-alpha 的神秘模型现身 LMArena 盲测平台,重点提升人物一致性、真实感与文字生成能力,社区猜测其为 GPT Image 2.5 早期版本;同期 GPT Image 2 API 预览支持透明背景生成。OpenAI 尚未公开确认该模型存在。
阿里巴巴发布 Qwen3.8 系列:2.4T 开源权重旗舰与混合架构 Flash-Next
2026 年 8 月,阿里巴巴发布开源权重模型 Qwen3.8(2.4T 参数、前沿级性能),并推出预览版 Qwen3.8-Flash-Next——采用 125B 总参 / 6B 激活的混合架构与 262K 可扩展至 1M 上下文,预览 Qwen4 架构方向。