OpenAI 被曝测试 GPT Image 2.5,官方为 GPT Image 2 API 加透明背景
多名海外用户发现名为 luna-lisa-alpha 的神秘模型现身 LMArena 盲测平台,重点提升人物一致性、真实感与文字生成能力,社区猜测其为 GPT Image 2.5 早期版本;同期 GPT Image 2 API 预览支持透明背景生成。OpenAI 尚未公开确认该模型存在。
自 8 月以来,LMArena 盲测平台陆续出现 mona-lisa-1、luna-lisa-alpha 等匿名图像模型代号,测试者普遍推测其来自 OpenAI、且很可能是 GPT Image 2.5 的早期 checkpoint。反馈中「一致性」成为高频词:相比前代,连续生成同一角色时人物外观、服饰与整体风格更稳定,颗粒感与噪点也明显减少。
在模型曝光的同时,OpenAI 为 GPT Image 2 API 上线了透明背景生成预览,可直接输出无底色 PNG 或 WebP,便于产品图、网页设计与营销素材的二次合成。这被外界解读为 OpenAI 正围绕「一致性与文字/版式能力」打磨下一代图像模型。
需要明确的是,目前 luna-lisa-alpha 仍停留在社区猜测阶段,OpenAI 尚未官宣其存在与命名;最终是否会定名 GPT Image 2.5,仍需等待官方发布确认。
相关资讯
DeepSeek-V4-Pro 正式版上线,Agent 能力大幅跃升并实行分时定价
8 月 12 日晚 DeepSeek 与 xAI 同日发布新模型。V4-Pro 正式版主打智能体能力,DeepSWE 得分由 12.8 升至 62.7、多项 Agent 测试超过 Claude Opus 4.8;8 月 17 日起实行分时定价,高峰输出价涨至现行 4.5 倍。
Gemini 3.7 Flash 发布:编程与智能体升级,API 价格年内直降 50%
Google DeepMind 推出 Gemini 3.7 Flash,软件工程、调试与多步智能体工作流显著提升,登 WebDev Code Arena 第 8、Agent Arena 第 20;上下文扩至 100 万 token,API 价格年内下调 50%。
智谱发布 GLM-5.3 开源大模型,编程能力跃居开源模型首位
智谱发布 GLM-5.3,基于 GLM-5.2 基座、通过后训练 Scaling 提升智能上限;Terminal-Bench 3.0 编程能力较前代提升 50%、居开源模型第一,模型权重将于两周后开源。
阿里巴巴发布 Qwen3.8 系列:2.4T 开源权重旗舰与混合架构 Flash-Next
2026 年 8 月,阿里巴巴发布开源权重模型 Qwen3.8(2.4T 参数、前沿级性能),并推出预览版 Qwen3.8-Flash-Next——采用 125B 总参 / 6B 激活的混合架构与 262K 可扩展至 1M 上下文,预览 Qwen4 架构方向。