
Nano Banana 2 在 AI Gateway 上線
Gemini 3.1 Flash Image Preview(Nano Banana 2)現已在 AI Gateway 上線,提升視覺品質同時維持 flash 階層的速度與成本。它使用 Google Image Search 以真實世界資料 grounding 影像,並引入可配置思考等級(Minimal/High)來處理複雜提示。新解析度如 512p 及長寬比(1:4、1:8)支援更多創意資產。
Tag: #image-generation59 results

Gemini 3.1 Flash Image Preview(Nano Banana 2)現已在 AI Gateway 上線,提升視覺品質同時維持 flash 階層的速度與成本。它使用 Google Image Search 以真實世界資料 grounding 影像,並引入可配置思考等級(Minimal/High)來處理複雜提示。新解析度如 512p 及長寬比(1:4、1:8)支援更多創意資產。

WordPress.com 新增 AI 助理,讓使用者能編輯內容、調整風格、生成圖像等。不需精確提示詞,即可有效運作,對一般使用者更友善。

Apple Machine Learning 研究用於影像生成的 Diffusion Transformer 中的高範數異常 Token。研究發現,異常 Token 同時出現在預訓練 ViT 編碼器與 DiT 去噪器中;它們可能在攜帶有限局部資訊的情況下吸引不成比例的注意力。

COMPASS 是一個全新的統一多模態框架,旨在提升細粒度組合識別與控制能力。透過在感知與生成任務中共享專家標記,該模型實現了對圖像生成的精確佈局控制。

Meta 正在推進其自主代理 Hatch,早洩代碼顯示支援影像創作、研究及社群媒體技能。該代理即將透過等待名單推出。

華人 15 人團隊推出超越香蕉與 GPT Image 的第三條 AI 生圖之路。只需 40 小時完成廣告公司一年工作量。量子位點名為黑馬新星。

Docker Model Runner 透過 Docker 容器實現本地 AI 圖像生成,並與 Open WebUI 整合提供使用者友善介面。它解決雲端服務的痛點,如提示詞隱私疑慮、點數限制及內容過濾器。使用者可無限制生成圖像,例如穿商務套裝的龍,而無需外部依賴。

一家低調的中國視覺大模型公司浮出水面,其AI生圖工具被定位為硬剛GPT-Image-2。宣稱再次打破國產AI生圖的天花板。
OpenClaw 2026.4.23-beta.4 透過 Codex OAuth 實現 OpenAI 的圖像生成與參考圖像編輯,無需 API 金鑰,並為 OpenRouter 新增類似支援。代理獲得子代理的分叉上下文、生成工具的每次呼叫超時,以及可配置的本地嵌入上下文大小。更新包括 Pi 依賴升級至 0.70.0,以及多平台穩定性修復。

OpenAI 已重新奪回 AI 圖像生成領域的領先地位。此更新強調其在該領域的新領導力。此外,還提到使用 Claude Live Artifacts 建置每日指令中心。