Grok 的生图模型,这次不是“小修小补”。
SpaceXAI 8 月 7 日上线 Grok Imagine Image 2.0 后,最抢眼的数据只有一个:Arena 的文生图和单图编辑榜单,它都冲到了全球第 2,前面只剩 GPT Image 2。
![]()
配图 1|Grok 官方公布的 Arena 排名,中文翻译截图。|来源:新浪科技/IT之家
但先别急着下结论说“Grok 已经追平 GPT”。数据没有那么简单。
Arena 当前文生图榜单里,GPT Image 2 是 1380±5,Grok Image 2.0 是 1320±12;单图编辑则是 1463±4 对 1439±8。也就是说,Grok 在编辑上的距离已经很近,但文生图还有明显差距。更重要的是,Grok 新模型的票数只有 2722 和 5931,两项都还标着 Preliminary。
所以“全球第 2”是真的,“已经和 GPT Image 2 五五开”目前还不是。
真正值得看的,是它开始从“生图模型”变成“图片工作台”
这次 Image 2.0 最有价值的变化,并不是再把人脸画得更精致一点,而是把编辑做进了核心流程:你可以用 Magic Wand 只改一个区域,用 Segmentation 精确选区,直接抠透明背景,单次塞进最多 5 张参考图,还能把一张图扩成 9 种比例。
![]()
配图 2|官方重点展示局部编辑、精确选区与智能改尺寸。|来源:新浪科技/IT之家
这对普通创作者的意义很直接:以前 AI 生图经常是“第一张好看,但一改就崩”;现在竞争点正在从“谁第一张更惊艳”,转向“谁能连续改五六次,主体、构图和文字还不乱”。
那真实用户怎么说?反馈其实是分裂的
我检索了发布后两天的中文用户反馈,比较一致的一点是:快。有人认为初步效果已经不输 GPT Image 2,也有人明确说画质还有一点差距,只是 Grok 的生成速度明显更激进。
这恰好说明一个问题:现在还没有足够证据证明 Grok 在“纯画质”上完成反超。Arena 给它第 2,说明它已经进入第一梯队;但用户最终会不会换模型,取决于中文文字、局部编辑、人物一致性和连续改图这些生产环节。
还有一个细节,反而更值得警惕
网上已经出现所谓“Image 2.0 六项独立实测”,但我继续追源后发现,同样的六类测试、相同的测试方法和主要结论,早在 5 月 15 日就用于旧版 Grok Imagine。换句话说,在没有确认重新跑过 2.0 之前,这类结果不能直接算新模型的证据。
对于一个刚发布两天的模型,最容易犯的错就是把旧版测试、新版宣传和零散体验混在一起,然后得出“吊打 GPT”的结论。
现在该怎么选?
如果你追求稳定的中文海报、复杂排版和最终成片质量,GPT Image 2 目前仍然是更稳的默认选择;如果你大量做参考图重绘、局部修改、电商素材、多尺寸适配,或者非常在意生成速度,Grok Image 2.0 已经值得立刻并行测试。
我的判断是:Grok 这次真正危险的地方,不是“榜单第 2”,而是它把差距压到了普通用户能明显感知的范围。GPT Image 2 还在第一,但它第一次有了一个足够接近、又更强调编辑工作流的直接对手。
接下来只看三个指标:Arena 票数上万后排名能不能守住;中文复杂文本是否稳定;连续多轮编辑时能不能真正做到“只改你要改的地方”。这三项如果站住,才有资格谈反超。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.