ARTICLE SIGNAL
OpenAI暗测GPT Image 2.5:最强生图模型全解析
OpenAI,GPT Image 2.5,luna-lisa-alpha,AI生图,ChatGPT国内使用,ChatGPT镜像站,揭秘OpenAI最新测试的神秘图像模型,深入探讨其在人物一致性、真实感与文字生成上的重大突破,以及国内如何高效体验最新AI技术。
type
status
date
slug
summary
tags
category
icon
password
网址
OpenAI 可能正在测试一款新的 AI 图像模型。
这两天,多名海外用户发现,一个名为 luna-lisa-alpha 的神秘模型出现在 LMArena 测试平台中。
从目前流出的测试结果来看,luna-lisa-alpha 重点提升了几个方向,包括人物一致性、图像真实感、文字生成能力,以及此前 GPT Image 系列一直存在的噪点问题。
虽然 OpenAI 尚未公开确认该模型的存在,但不少测试者猜测,这很有可能是 GPT Image 2.5 或下一代 GPT Image 模型的早期版本。
最早发现 luna-lisa-alpha 的用户之一 Neuro Pulse 在 X 上表示,这是一个正在测试中的「新 GPT Image checkpoint」,此前同系列测试版本为 mona-lisa-1。
checkpoint 是模型训练过程中的阶段性版本,通常用于内部测试和能力评估,并不代表最终公开发布版本。
在大量测试反馈中,「一致性」成为出现频率最高的关键词。相比此前版本,luna-lisa-alpha 在连续生成同一个角色时,能够更好地保持人物外观、服饰和整体风格。
一名测试者 Token Gremlin 表示,luna-lisa-alpha 最大的变化可能不是单张图片质量提升,而是稳定性增强。
他认为,新版本正在改善两个问题:一是不同生成结果之间的人物一致性,二是 GPT Image 过去几个版本中存在的颗粒感和噪点。
另一名用户 Mirochill 测试后也提到,新版本相比此前的 mona-lisa-1,图像中的 grain(颗粒感)似乎减少,同时角色一致性出现明显提升。
向左滑动查看更多内容
不过,部分测试者仍然发现,在复杂纹理、云朵、植物等细节区域,图片中依旧存在异常 pattern(重复纹理)问题。
除了真实感提升,luna-lisa-alpha 的文字生成能力也受到关注。
GPT Image 2 在这一块已经有了较大的进步,现在一些测试者使用它生成手机界面、网页设计稿等内容,发现模型能够生成较复杂的 UI 元素。
没错,连可折叠 iPhone 的官网界面图也能够轻松直出,就是跟现在泄露的机模长得不太一样(doge)。
Mark Kretschmann 认为,图像模型的重要性可能被低估,因为它们未来不仅可以生成图片,还可能直接参与网站设计、产品原型甚至代码转换。
此外,一些测试者也开始将 luna-lisa-alpha 与当前主流图像模型进行直接对比。
X 用户 Harshith 也分享了自己第一次使用 luna-lisa-alpha 的测试结果,并将其与 GPT Image 2.0、Nano Banana Pro 等模型放在同一组提示词下进行比较。
依次为 luna-lisa-alpha、Nano Banana Pro、GPT Image 2.0、
还有网友@ HarshithLucky3 使用同一组提示词,让 luna-lisa-alpha、GPT Image 2.0、Nano Banana Pro 和 Grok Imagine 同时生成图片,对比不同模型在人物还原、真实感以及细节处理上的差异。
依次为 luna-lisa-alpha、GPT Image 2.0、Nano Banana Pro、Grok Imagine image 2.0、
就在社区发现 luna-lisa-alpha 的同时,今天 OpenAI 也发布了一个 GPT Image 2 API 的新功能。
OpenAI 表示,GPT Image 2 API 正在预览支持透明背景生成,用户可以生成能够直接应用于不同背景的素材,用于产品图片、网页设计、营销内容等场景。
一些用户猜测,OpenAI 可能正在通过多个 checkpoint 进行 A/B 测试。
除了此前出现的 mona-lisa-1,LMArena 上还出现过 lina-alpha 等名称,有测试者认为这些可能是同一系列模型的不同实验版本。
当然,目前距离正式发布仍存在不确定性。luna-lisa-alpha 最终是否会成为 GPT Image 2.5,或者只是内部测试阶段的一个版本,还需要等待 OpenAI 官方公布。
某种程度上,luna-lisa-alpha 的出现,也让人重新思考 AI 竞争的方向。
过去一年,编程能力几乎成了 AI 行业的注意力黑洞。从 Claude Code 到各种 Coding Agent,模型能不能写代码、改代码、完成开发任务,逐渐成为衡量 AI 能力进步的重要指标。
但回头看,AI 进入普通用户日常的入口不应该只有代码,图片的生成创作等多模态内容同样是高频需求,只是在过去一段时间里长期被低估。
AI 不应该只是帮少数人提高生产效率的工具,也应该成为更多人表达、创造和解决问题的新入口。
文章来自于微信公众号 “APPSO”,作者 “APPSO”
Loading...