OpenAI 可能正在测试一款全新的 AI 图像生成模型。
这两天,多位海外用户发现,一个名为 luna-lisa-alpha 的神秘模型出现在 LMArena 测试平台中。

从目前流出的测试结果来看,luna-lisa-alpha 主要针对几个关键方向进行了优化,包括人物一致性、图像真实感、文字生成能力,以及此前 GPT Image 系列长期存在的噪点问题。

虽然 OpenAI 目前尚未公开确认该模型的存在,但不少测试者推测,这很可能是 GPT Image 2.5 或下一代 GPT Image 图像模型的早期测试版本。
Neuro Pulse 是最早发现 luna-lisa-alpha 的用户之一。他在 X 上表示,这是一个正在测试中的「新 GPT Image checkpoint」,而此前同系列的测试版本则是 mona-lisa-1。

checkpoint 指的是模型训练过程中的阶段性版本,通常用于内部测试、能力验证和效果评估,并不意味着它就是最终对外发布的正式版本。
在大量测试反馈中,「一致性」成为被提及频率最高的关键词。与此前版本相比,luna-lisa-alpha 在连续生成同一个角色时,能够更稳定地保持人物外观、服装细节和整体视觉风格。
一名测试者 Token Gremlin 表示,luna-lisa-alpha 最大的变化可能并不是单张图片质量的明显跃升,而是整体生成稳定性的增强。
他认为,新版本正在重点改善两个问题:一是不同生成结果之间的人物一致性,二是 GPT Image 过去多个版本中较为明显的颗粒感和噪点问题。
另一名用户 Mirochill 在测试后也提到,相比此前的 mona-lisa-1,新版本图像中的 grain(颗粒感)似乎有所减少,同时角色一致性也有了较为明显的提升。
不过,部分测试者仍然发现,在复杂纹理、云朵、植物等细节区域,图片中依旧存在异常 pattern(重复纹理)的问题。

除了真实感提升之外,luna-lisa-alpha 的文字生成能力同样受到关注。
GPT Image 2 在这一方面本就已经有了较大进步,如今一些测试者用它生成手机界面、网页设计稿等内容时发现,模型已经能够输出更复杂的 UI 元素和版面结构。

没错,连可折叠 iPhone 的官网界面图都可以轻松直出,只不过和目前泄露的机模外观还不太一样(doge)。
Mark Kretschmann 认为,AI 图像模型的重要性可能被外界低估,因为它们未来不仅可以生成图片,还可能直接参与网站设计、产品原型制作,甚至代码转换等更广泛的应用场景。

此外,一些测试者也开始将 luna-lisa-alpha 与当前主流 AI 图像生成模型进行直接对比。
用户 Harshith 也分享了自己首次使用 luna-lisa-alpha 的测试结果,并将它与 GPT Image 2.0、Nano Banana Pro 等模型放在同一组提示词下进行了横向对比。
就在社区发现 luna-lisa-alpha 的同时,OpenAI 也在今天发布了 GPT Image 2 API 的一项新功能。
OpenAI 表示,GPT Image 2 API 已开始预览支持透明背景生成,用户可以生成可直接应用于不同背景的素材,适用于产品图片、网页设计、营销内容等多个使用场景。

一些用户猜测,OpenAI 可能正在通过多个 checkpoint 版本进行 A/B 测试,以验证不同模型路线的效果表现。
除了此前出现的 mona-lisa-1,LMArena 上还出现过 lina-alpha 等名称,有测试者认为,这些名字可能对应同一系列模型的不同实验版本。

当然,目前距离正式发布仍存在较大不确定性。luna-lisa-alpha 最终是否会成为 GPT Image 2.5,还是仅仅停留在内部测试阶段的一个实验版本,仍有待 OpenAI 官方进一步公布信息。
某种程度上,luna-lisa-alpha 的出现,也让人重新思考 AI 竞争的真正方向。
过去一年,编程能力几乎成为 AI 行业关注度最高的焦点。从 Claude Code 到各种 Coding Agent,模型能否写代码、改代码、完成开发任务,逐渐成为衡量 AI 能力进步的重要指标。
但回过头看,AI 进入普通用户日常生活的入口不应只有代码,AI 图片生成、视觉创作等多模态内容同样属于高频需求,只是在过去一段时间里长期被低估。
AI 不应该只是帮助少数人提升生产效率的工具,也应该成为更多人表达想法、进行创造和解决问题的新入口。
(转载自:APPSO)
