
8 月 9 日有一款代号为“mona-lisa-1”的图像生成模型出现在 AI 竞技场的盲测列表中
从目前社区流出的图片来看,更像是GPT‑Image 2 的迭代版本,大概率是2.5:
真实感大幅优化,缓解 “AI 塑料脸”
人像皮肤纹理、毛孔、发丝细碎细节更强,光影过渡更自然;人像不会出现过去 GPT‑Image2 常见的过度磨皮、蜡质感,照片氛围感更接近实拍照片。
实景、环境细节提升
城市街景、物体材质、文字标识、背景虚化处理更好;同等提示词下物体纹理、材质质感优于 GPT‑Image2 Medium 档位,部分样本接近 GPT‑Image2 High 档位效果。
提示词遵从度小幅提升
对长提示词、复杂构图指令理解更好,多物体共存场景出错概率下降,人物五官崩坏、肢体错误的概率有所降低。
推测定位:中等尺寸 Checkpoint
不是完全重训的新一代大模型,是基于 GPT‑Image2 基座微调的中间版本,推理成本大概率会更低,适合大批量出图场景。

有网友用 OpenAI 验证工具检测生成图片后,确认图片中带有 OpenAI 的 SynthID 水印
评论区