参考图一致性
两个模型都在可用的角色设定表中保留了服装概念。Mona Lisa 1 保留了稍饱满的轮廓;GPT Image 2 提供了更多姿势变化。
编辑结论
接近
“根据提供的参考图制作角色设定表。”


AI 图像模型对比 · 2026 年 8 月
Mona Lisa 1 是一个在 Arena 中出现的实验性代号,社区结果颇具潜力;GPT Image 2 则是已经发布且文档完备的生产模型。如何选择,取决于你是在探索前沿能力,还是要立即交付可重复的工作流。
两张图都在回答“描绘模型创造者”的相同需求。应把它视为社区直接对比,而不是受控实验室基准。
提示词: “生成一张你的创造者的图片。”


视觉证据
三组带有明确标注的同任务图片展示了两个模型的共同点及视觉决策差异。这些都是单次输出,适合用来形成测试假设,而不是得出通用排名。
两个模型都在可用的角色设定表中保留了服装概念。Mona Lisa 1 保留了稍饱满的轮廓;GPT Image 2 提供了更多姿势变化。
编辑结论
接近
“根据提供的参考图制作角色设定表。”


两个模型都抓住了所要求的动画视觉语言。在这一组中,Mona Lisa 1 更干净地保留了颁奖礼构图,而 GPT Image 2 增加了更丰富的花卉和服装细节。
编辑结论
Mona Lisa 1 略占优势
“以《超人:动画系列》的风格重绘参考图。”


两个模型都呈现出了《未来蝙蝠侠》的锐利视觉语言。在这一次输出中,GPT Image 2 对麦克风和手部的处理更加连贯。
编辑结论
GPT Image 2 略占优势
“以《未来蝙蝠侠》的动画风格重绘参考图。”


定性评分
基于证据给出定性结论,而不是编造基准测试数字。
照片级真实感方向
Mona Lisa 1
社区早期信号很有潜力
GPT Image 2
已发布模型中的强劲基线
Mona Lisa 1 暂时略占优势
参考图一致性
Mona Lisa 1
在所评测样例中表现优秀
GPT Image 2
在所评测样例中表现优秀
接近
图像编辑工作流
Mona Lisa 1
没有已验证的公开 API
GPT Image 2
有文档的图像编辑端点
GPT Image 2
生产 API 就绪度
Mona Lisa 1
实验性 Arena 访问
GPT Image 2
已发布的 API 别名和快照
GPT Image 2
运行可预测性
Mona Lisa 1
目前还无法确定
GPT Image 2
访问方式和限制均有文档
GPT Image 2
结论结合了当前 GPT Image 2 官方文档、社区直接对比,以及截至 2026 年 8 月 12 日核查的 Reddit 用户不同反馈。
先看已验证事实
最重要的差异并非某个像素级功能,而是产品成熟度,以及目前究竟有哪些能力可以得到验证。
维度
当前状态
GPT Image 2Mona Lisa 1
在 Arena 测试中观察到的实验性代号
GPT Image 2
OpenAI 已发布的图像模型
维度
已验证模型 ID
GPT Image 2Mona Lisa 1
没有公开文档
GPT Image 2
gpt-image-2
维度
版本固定
GPT Image 2Mona Lisa 1
无文档
GPT Image 2
gpt-image-2-2026-04-21 快照
维度
生成 API
GPT Image 2Mona Lisa 1
未验证
GPT Image 2
有文档的图像生成端点
维度
编辑 API
GPT Image 2Mona Lisa 1
未验证
GPT Image 2
有文档的图像编辑端点
维度
公开证据
GPT Image 2Mona Lisa 1
社区 Arena 对比
GPT Image 2
官方文档、发布材料及社区使用情况
维度
当前最适合
视情况而定Mona Lisa 1
前沿探索与评估
GPT Image 2
生产级生成与编辑工作流
结论
目前还不存在诚实可信的绝对赢家。实际的分界在于实验探索,还是生产就绪度。
你想探索早期真实感、复杂提示词理解、参考图一致性,以及不断变化的 Arena 行为。
为了追求特定的视觉结果,你可以接受重试、无文档行为和不确定的可用性。
你的工作流以探索为主,能够承受模型身份、发布状态或接口正式确定后的变化。
你需要有文档的模型别名、固定快照选项,以及官方生成和编辑端点。
你的团队以输入图片为基础进行迭代,需要受支持的工作流,而不是实验性对比通道。
相较于部分社区测试中的早期视觉优势,你更看重可用性、速率限制和供应商文档。
按使用场景选择
先找出最可能拖垮工作流的限制,再选择能够消除这一限制的模型。
Mona Lisa 1
如果自然纹理和复杂提示词理解是主要评估目标,值得进行测试。
GPT Image 2
有文档的别名、快照、端点和访问模式,使其成为更可靠的集成选择。
两个都测试
所评测样例的表现非常接近,应由你自己的角色、姿势要求和重试预算来决定。
GPT Image 2
编辑功能得到官方支持;Mona Lisa 1 目前没有已验证的公开编辑 API。
两个都测试
两组直接对比得出了不同的编辑结论,说明应针对具体任务测试,而不是笼统地选出赢家。
FAQ
哪些信息已经得到验证,哪些仍处于实验阶段,以及如何避免过度解读早期样例。