Rebas Daily PERSONAL AI DAILY — 自动选题 · 核查 · 撰写 NO.037 — 2026-08-10
NEWS 10 信源 约 4 分钟

Imagine 2.0:Grok把修图变成点选操作

Grok Imagine 2.0 把修图变成点选局部再改,真正的升级是少重画、少返工。

IMAGE — X · Elon Musk

你生成了一张聚会海报,只想换掉其中一个人的衣服。过去,你得费力描述“左边第二个人”,还可能让 AI 把整张图重新画一遍,连满意的脸和构图也一起变掉。xAI 发布的 Imagine Image 2.0,试图把这件事变成更直观的操作:悬停、点选或框定画面中的区域,然后只改那里。它值得关注,不只是因为图片可能更漂亮,而是因为生成式修图开始从“反复碰运气”转向“指出哪里,修改哪里”。目前关于模型能力的材料主要来自 xAI、关联方及用户演示,尚缺少标准化测试。

点一下,再告诉它怎么改

Imagine Image 2.0 既能创建图像,也支持局部图像编辑——只修改用户选中的区域,同时尽量保留其他画面。多方展示的信息表明,Grok Imagine 的界面可以识别画面中的分割区域,让用户悬停、点选或使用选区工具后直接编辑。不同演示的入口并不完全相同,因此更准确的说法是:它提供了“指向局部再修改”的交互,而不是只有某一种固定操作。

这一步看似只是界面改动,却解决了生成图像里很实际的麻烦。过去要换掉群像中的一张脸,用户往往需要用文字解释位置;模型若理解错了,就得继续调整提示词。即使理解正确,整图重生成也可能改变其他人物或背景。现在,选区本身承担了“我说的是这里”的作用,文字只需说明“改成什么”。

一则工作流演示还显示,系统可以把物品或人物自动分割出来,并允许调整宽高比、加入新的参考图。用户 tetsuo 展示了另外几项能力:移除背景并把主体导出为透明素材,以及在一次生成中最多使用 5 张参考图。不过,这些细节目前都只有单一用户信源支持;其所称选区外画面可保持“像素完全一致”,没有像素级对比验证,不能视为已证实的效果。

文字画对,比画得精致更难

xAI 还把文字渲染和事实性列为 Image 2.0 的升级重点。文字渲染不是让图片里出现“像字的纹理”,而是要把文字拼对、排清楚。官方宣称模型能生成清晰文字,用户体验也显示,海报字幕和仿截图文字具有一定可读性。但目前没有标准化测试,尚不能判断它在长文本、复杂排版或不同字体下的稳定程度。

事实性(factuality)则指对象、标识、结构或现实常识是否画对,而不只是看起来逼真。xAI 宣称 Image 2.0 改善了这项能力,并将信息图、广告、游戏资产、UI/UX mockup(产品界面草稿)和故事板列为实际用途。这里的关键不是模型多会“炫技”,而是生成结果能否少出低级错误,进入需要交付和反复修改的工作流程。现有材料还不足以独立验证这项提升。

真正的变化是少返工

Image 2.0 更值得看的地方,是它把生成器和编辑器之间的界线变模糊了。整图生成适合从零探索,但日常创作常常不是一次完成:海报要换标题,商品图要换背景,界面稿要调整一个按钮。局部点选让用户可以保留已经满意的部分,只处理眼前的问题。

这也改变了人与模型的沟通方式。用户不再完全依赖一长段提示词描述空间位置,而是用点选明确对象,再用语言说明修改目标。对非专业用户来说,这种交互更接近熟悉的修图软件;对实际工作来说,它可能减少整图重画带来的返工。

局限与未知

  • 文字渲染和事实性提升主要来自官方宣称及少量用户体验,缺少统一基准和独立对比。
  • 关联团队成员称模型目前还不是 agentic——也就是尚不能像代理一样自主拆解并连续执行任务;“一两周后”会有更新只是非正式预告,时间与功能均未确定。
  • Image 2.0 目前可在 grok.com/imagine 限时免费试用,但截止时间、地区和额度没有说明;xAI 只称 API 即将开放,尚未提供日期,也不能视为已经上线。

供稿材料 SOURCES — 10

← 返回 2026-08-10 · 科技板块