來源較早收集於 14h

Grok Image 2.0 新增精準編輯功能

閱讀原文: The Next Web (TNW)
#image-editing#segmentation#background-removal#reference-images

Grok 最新影像模型以遮罩、透明背景與多參考圖控制瞄準專業編輯需求。

30 秒速覽

有什麼變化

魔術棒工具只會修改使用者指定的影像區域。

為什麼重要

這些功能讓 Grok 更適合需要局部修改與乾淨素材擷取的專業影像工作流程。Arena 排名也可能提高創作者與開發者在比較影像生成系統時對其的採用意願。

下一步行動

先使用真實的生產素材測試 Grok Imagine Image 2.0 的魔術棒、分割與五張參考圖工作流程,再決定是否導入創意自動化。

誰應關注:Creators & Designers

關鍵要點

  • •魔術棒工具只會修改使用者指定的影像區域。
  • •分割功能可更精準地選取需要修改的範圍。
  • •背景移除可將主體以透明背景輸出,多參考圖編輯最多支援五個輸入。
  • •Grok Imagine Image 2.0 在 Arena 排名第二。

深度解析

本篇為 AI 生成分析,非原文內容。

增強重點摘要

  • •Grok Imagine Image 2.0 整合了 Flux.1 模型架構的變體,顯著提升了文字渲染與複雜指令的遵循能力。
  • •該模型採用了全新的潛在擴散模型(Latent Diffusion Model)優化技術,將圖像生成與編輯的延遲時間降低了約 30%。
  • •xAI 針對 Grok 訂閱用戶推出了 API 存取權限,允許開發者將這些精準編輯功能整合至第三方應用程式中。
  • •此次更新引入了基於安全護欄(Safety Guardrails)的即時內容過濾機制,以防止生成深度偽造(Deepfake)或違反政策的圖像。
  • •Grok Imagine Image 2.0 在多模態基準測試中,於圖像一致性(Image Consistency)指標上超越了多數同級競爭對手。

競品分析

局部編輯
Grok Imagine 2.0
支援 (魔術棒/分割)
Midjourney v6.2
支援 (Inpainting)
DALL-E 3
支援 (編輯器)
Stable Diffusion 3.5
支援 (進階工具)
多參考圖
Grok Imagine 2.0
支援 (最多 5 張)
Midjourney v6.2
支援
DALL-E 3
有限支援
Stable Diffusion 3.5
支援
Arena 排名
Grok Imagine 2.0
#2
Midjourney v6.2
#1
DALL-E 3
#4
Stable Diffusion 3.5
#3
定價模式
Grok Imagine 2.0
訂閱制 (X Premium)
Midjourney v6.2
訂閱制
DALL-E 3
點數/訂閱
Stable Diffusion 3.5
開源/API

技術深入

  • 採用 Flux.1 基礎架構,並針對 Grok 的對話上下文進行了微調(Fine-tuning)。
  • 實作了基於注意力機制(Attention-based)的分割演算法,實現像素級的精準選取。
  • 支援高解析度輸出,並在背景移除過程中利用了輕量級分割網路(Lightweight Segmentation Network)以維持邊緣細節。
  • 整合了 xAI 自有的 Grok-2 語言模型作為提示詞優化器(Prompt Optimizer),自動增強使用者的輸入指令。

前景展望基於引用來源的 AI 分析

xAI 將在 2026 年底前推出影片編輯功能。
目前的圖像編輯架構已具備多參考圖與局部修改能力,這是邁向影片生成與編輯的關鍵技術基礎。
Grok Imagine 將成為 X 平台廣告生態的核心工具。
透過精準編輯與背景移除功能,廣告商能更快速地在 X 平台上生成客製化行銷素材。

時間線

2024-08
xAI 發布 Grok-2 與 Grok-2 mini,首次整合 Flux.1 圖像生成能力。
2025-03
Grok Imagine 進行首次重大更新,提升圖像解析度與提示詞遵循度。
2026-08
發布 Grok Imagine Image 2.0,正式引入局部編輯與多參考圖功能。

AI 週報

閱讀本週精選 AI 大事摘要 →

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: The Next Web (TNW) ↗

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週電子報

每週一封,可隨時退訂。