xAI发布图像模型升级版主打局部编辑能力
IT时代网8月8日消息,马斯克旗下的xAI正式推出Grok Imagine Image 2.0图像生成模型。新版本以全新的质量模式上线Grok网页端和iOS、安卓移动应用,同时开放了配套的开发者接口。
按官方介绍,Image 2.0这一版把重心放在专业图像编辑上,局部修改和素材复用是两个核心优化方向,针对的是商业设计、产品实拍这类真实工作场景。
指令遵循度是提升幅度较大的一项。面对多元素复合画面,模型可以自主规划版式与文字排版,画面里小字号文字的渲染清晰度显著提升,多轮迭代生成时主体设定也能稳定保留——这一点对需要反复改稿的用户比较关键。
编辑工具是这次的重头。魔棒工具允许单独选中画面的指定区域调整,其余画面元素不会跟着产生改动;分割选区支持精准框选局部,然后单独调色或替换素材;背景移除工具可以直接导出透明底的主体素材,方便拿到其他软件里二次合成。
参考图这块,单次最多支持输入5张,系统自动完成多素材融合,省去手动拼接的操作步骤。智能尺寸适配覆盖从1:2到2:1共9种主流画面比例,切换画幅时模型会自动补齐缺失的画面内容,边缘区域不用人工再补绘。
xAI还为这一版内置了多套预制创作模板,涵盖商品静物拍摄、人物专业形象照、电商宣传图、游戏原画、营销海报等使用频率较高的商用场景。模板把生成参数标准化,用户只需补充基础素材与文字需求就能快速产出成品,专业图像创作的门槛因此降低不少。
成绩方面,截至8月7日的一份国际图像模型评测榜单显示,Grok Imagine Image 2.0在文生图、图像编辑两大赛道的综合评分位列全球第二名,仅落后于OpenAI的GPT Image 2模型。
该模型针对摄影、平面设计、插画三类创作方向做了专项训练,在光影还原、材质细节、色彩一致性上完成迭代优化,画面崩坏、元素错位这类老毛病相应减少。

注:本文中包含AI辅助创作的内容。