xAI 发布 Grok Code Fast 1:专为智能体编程打造的高速推理模型
8 月 29 日,xAI 推出专为 agentic coding 工作流设计的 Grok Code Fast 1,主打高速工具调用与低成本;已在 Cursor、GitHub Copilot、Cline、Windsurf、Roo Code、Kilo Code、opencode 等主流编程平台限时免费开放。定价 $0.20/$1.50 每百万输入/输出 token,SWE-bench Verified 得分 70.8%。
Grok Code Fast 1 是 xAI 从零构建的专用编程模型:采用全新架构、在富含编程内容的预训练语料上训练,并基于真实 Pull Request 与实际编码任务做后训练,重点优化 grep、终端命令与文件编辑等工具调用,深度融入开发者日常环境。
速度是其最大卖点。xAI 称模型吞吐约 190 token/秒(部分伙伴工作流实测约 92 token/秒),明显领先 GPT-5、Gemini 2.5 Pro 与 Claude Sonnet 4;典型 Cline 工作流缓存命中率超 90%,后续请求近乎瞬时。模型支持 256K 上下文窗口,覆盖 TypeScript、Python、Java、Rust、C++、Go 等语言。
定价上,Grok Code Fast 1 为 $0.20 / $1.50 每百万输入 / 输出 token(缓存输入仅 $0.02),并以 SWE-bench Verified 70.8% 的内部评测成绩亮相。xAI 强调真实工作流中的人工评估权重更高,并预告多模态变体已在训练,将支持并行工具调用与更长上下文。
对开发者而言,这标志着「编程模型」的竞争从「基准峰值」转向「速度与工具集成」——在 agentic coding 成为主流的当下,更快、更省、更懂 IDE 的模型,可能比单纯更高的榜单分数更具实用价值。
相关资讯
DeepSeek-V4-Pro 正式版上线,Agent 能力大幅跃升并实行分时定价
8 月 12 日晚 DeepSeek 与 xAI 同日发布新模型。V4-Pro 正式版主打智能体能力,DeepSWE 得分由 12.8 升至 62.7、多项 Agent 测试超过 Claude Opus 4.8;8 月 17 日起实行分时定价,高峰输出价涨至现行 4.5 倍。
Gemini 3.7 Flash 发布:编程与智能体升级,API 价格年内直降 50%
Google DeepMind 推出 Gemini 3.7 Flash,软件工程、调试与多步智能体工作流显著提升,登 WebDev Code Arena 第 8、Agent Arena 第 20;上下文扩至 100 万 token,API 价格年内下调 50%。
智谱发布 GLM-5.3 开源大模型,编程能力跃居开源模型首位
智谱发布 GLM-5.3,基于 GLM-5.2 基座、通过后训练 Scaling 提升智能上限;Terminal-Bench 3.0 编程能力较前代提升 50%、居开源模型第一,模型权重将于两周后开源。
OpenAI 被曝测试 GPT Image 2.5,官方为 GPT Image 2 API 加透明背景
多名海外用户发现名为 luna-lisa-alpha 的神秘模型现身 LMArena 盲测平台,重点提升人物一致性、真实感与文字生成能力,社区猜测其为 GPT Image 2.5 早期版本;同期 GPT Image 2 API 预览支持透明背景生成。OpenAI 尚未公开确认该模型存在。