
SenseTime 開源具原生 4K 輸出的 8B 模型
SenseTime 已開源 SenseNova U1.5 Lite,這是一款結合視覺理解、影像生成與編輯功能的 80 億參數多模態模型。模型支援原生 4K 影像輸出,並針對主體、數量、空間關係、文字、版面與視覺風格等要求進行設計。
Tag: #image-editing22 results

SenseTime 已開源 SenseNova U1.5 Lite,這是一款結合視覺理解、影像生成與編輯功能的 80 億參數多模態模型。模型支援原生 4K 影像輸出,並針對主體、數量、空間關係、文字、版面與視覺風格等要求進行設計。

OpenAI的GPT Image 2上線12小時內橫掃三個Arena榜單:文生圖、單圖編輯、多圖編輯。實現「全勝」,大幅領先Google等對手。此為奧特曼5個月前「紅色警戒」後的成果。

SpaceXAI 發布 Grok Imagine Image 2.0,進一步強化影像編輯能力。更新加入局部魔術棒編輯、分割選取、透明背景移除、多參考圖編輯,以及 Arena 排名第二的成績。

xAI 的 Grok Imagine Image 2.0 Preview 現已透過 Vercel AI Gateway 提供使用。它能遵循詳細指令、維持文字排版與布局,並支援跨多次生成的一致性圖片編輯。

SenseTime 開源了 SenseNova U1.5-Lite-Preview,這是一款採用 NEO-Unify 架構的 8B-MoT 輕量級統一多模態模型。它支援原生 4K 輸出、精準影像編輯,以及在資訊圖表與創意內容中複製設計框架。

X 推出由 Grok 驅動的自動翻譯功能,打破語言障礙。同時引入 AI 照片編輯器,使用簡單文字提示即可調整圖像。這些功能提升了 X 平台上 Grok 的實用性。

SuperCLUE 發布 2026 年 3 月中文原生圖像編輯測評榜單,涵蓋 19 個主流模型。OpenAI 的 GPT-Image-1.5 以 87.03 分穩居全球第一。騰訊 Hunyuan-Image-3.0-Instruct 以 83.00 分拿下中國第一,後有字節、阿里等模型緊隨。

騰訊混元團隊推出 HY-WU 框架,在推理階段動態生成任務特定參數,提升圖像編輯適配性。其在人類評測(勝率高達 78%)、自動指標及 GEdit-Bench 等基準上超越基線。透過輸入條件化 LoRA 適配器,有效處理去模糊 vs. 模糊等衝突任務。

xAI 透過 Grok 推廣的 Imagine Image 2.0,不只競逐生成品質,也以互動式圖片編輯能力脫穎而出。它能自動將圖片分割成圖層,支援精準區域編輯與透明背景匯出,並可融合最多五張參考圖片。
OpenClaw 2026.5.10-beta.5 新增 Fly Machines 運行時偵測、fal 提供者對 GPT Image 2 與 Nano Banana 2 編輯的擴充支援,以及 UI 復原面板。代理功能提升,包括更高的最大 ping-pong 回合數、訊息覆寫與更好預覽。建置升級至 pnpm 11,並強化 linting 與 TypeScript 檢查。