魔術棒點選區域:只改你要改的那一塊
xAI 在 2026 年 8 月 7 日發表 Imagine Image 2.0,把它定位為「為真實創作而生的精準圖像生成與編輯」模型,即日起作為新的 Quality Mode,在 grok.com/imagine 與 iOS、Android App 全面可用。這一代最值得注意的不是「會畫圖」,而是「會改圖」——而且改得很精準。
官方把編輯哲學講得很直白:真實的創作是反覆的,第一次生成的結果很少就是最終成品,所以 Image 2.0 加進了「讓你只改你想改、其餘不動」的工具。其中最核心的是魔術棒——官方原文是「魔術棒編輯你指到的區域,其餘紋風不動」,並以分割選取精確區域、去背、多參考一次補齊。換句話說,不必整張重畫,只要點中想修改的那一塊,模型就只動那一塊。
「hover-to-edit(滑鼠懸停即編輯)」是網路流傳的通俗講法;但 xAI 官方公告的措辭是「點選你指到的區域」加上「分割(segmentation)」,並未使用「hover」一字。兩者描述的是同一套區域級編輯能力——指向一塊、只改該處。
一整套精準編輯:分割、去背、多參考、智慧變形
魔術棒之外,Imagine Image 2.0 一次補齊了一整套區域級工具:
- 分割:選取圖中精確的區域來替換,比魔術棒更細緻地框定要改的範圍。
- 去背:把任何主體匯出為透明背景,方便直接套進其他作品。
- 多參考編輯:單次生成最多接受 5 張輸入圖,免去手動合成,影音端的同類設計見〈Seedance 2.5〉。
- 智慧變形:一張圖、任意長寬比——選一個比例,模型自動補滿畫面,官方列出從 1:2 到 2:1 共九種比例。

把這些兜起來看,Imagine Image 2.0 想解決的是生成式圖像長年的痛點:改一個細節往往得整張重畫。魔術棒與分割把「局部修改」變成原生操作,去背與多參考則把「素材拼接」收進同一個流程。
Aurora 家族與「編輯是一等公民」
Imagine Image 2.0 背後是 xAI 的 Aurora 模型家族。官方將 Aurora 描述為自迴歸混合專家網路、從交錯的文字與圖像資料預測下一個 token,並具備原生多模態輸入與圖像編輯能力——也就是說,從模型設計階段就把「拿圖當輸入、直接改圖」算進去,而非事後再掛一層。
這也解釋了官方為何把編輯稱為「一等公民」:Image 2.0 針對攝影、設計、插畫等不同類型的擬真度做訓練,並自評在文字生圖與圖像編輯兩項皆位居全球第二(截至 2026 年 8 月 7 日的 Arena 排行)。官方同時強調它對排版與構圖的掌握——「像設計師那樣規劃字體與版面」,讓密集、多元件的視覺能撐得起來、小字也清晰。此外,Image 2.0 也在既有的生成之外加入了一批模板,把照片編輯、商品照、大頭照、圖示、遊戲素材等常見工作流程打包成現成起點。
消費端先上、API 隨後
這套魔術棒、分割等區域級工具目前是消費端能力——官方列出 grok.com、iOS、Android 三個入口,消費端 API 則標示「即將推出」。在開發者側,xAI 的圖像編輯 API 文件走的是另一條路:模型 id 為 grok-imagine-image-quality,採提示詞驅動的整圖編輯與多輪迭代——丟一張圖加一段描述,模型理解內容後套用你指定的變更,目前尚未提供魔術棒/分割這類區域級控制。
換句話說,想用「點一塊就改一塊」的體驗,現在得透過 Grok 應用本身;想在自家程式裡呼叫,目前能做的是整圖改寫與多輪迭代。在圖像生成的版圖裡,xAI 這一步押的是「編輯」——把生成之後的反覆修改,變成模型與介面一起支援的一等公民;資料生產端則可對照螞蟻 ConceptEdit 以自動產線生成 1,200 萬組圖像編輯配對的另一條路。主打美學與個人化的〈Midjourney V8.2〉則代表以風格調控為核心的產品方向。





