马斯克旗下xAI公司近日宣布,其研发的Grok Imagine Image 2.0图像生成模型正式上线。该版本以专业图像编辑为核心卖点,同步登陆Grok网页端及iOS、安卓移动应用,并面向开发者开放API接口,为商业设计领域提供全新创作工具。
据官方技术文档披露,Image 2.0在指令响应精准度方面实现突破性提升。面对包含多元素的复杂画面,模型可自主规划版式布局与文字排版,尤其在小字号文字渲染清晰度上取得显著进步。经过多轮迭代训练后,系统在持续创作过程中能稳定保持主体特征,避免画面元素错位或变形。
针对专业设计场景,研发团队重点优化了局部编辑功能。新增的魔棒工具支持用户精准选取画面特定区域进行独立调整,周边元素保持原状不变。配合智能分割选区技术,设计师可单独对选中区域进行调色、素材替换等操作,背景移除功能更可直接导出透明底素材,大幅提升跨软件合成效率。
在素材处理能力方面,该模型支持同时导入最多5张参考图进行智能融合。系统自动分析多图特征并完成元素整合,省去传统手动拼接的繁琐步骤。针对不同输出需求,智能尺寸适配功能覆盖1:2至2:1共9种主流画幅比例,切换比例时模型自动补全画面边缘内容,确保构图完整性。
为降低专业创作门槛,xAI团队内置了覆盖电商、广告、游戏等领域的标准化模板库。用户仅需补充基础素材与文字信息,即可快速生成符合行业规范的成品图。这些模板预设了标准化参数,涵盖商品静物拍摄、人物形象照、营销海报等高频商用场景。
第三方评测机构Arena最新榜单显示,Image 2.0在文生图与图像编辑双赛道综合评分位居全球第二,与榜首OpenAI GPT Image 2模型形成直接竞争。技术白皮书指出,该模型经过摄影、平面设计和插画领域的专项训练,在光影层次、材质细节和色彩一致性等关键指标上完成迭代优化,有效减少了画面崩坏等常见问题。
