
Zhipu AI 推出免費 GLM-Image 圖像生成器
Zhipu AI 發布了全新的 AI 圖像生成工具 GLM-Image,可於 image.z.ai 使用。該工具在中文文字渲染能力上表現優異,超越了 Midjourney 等國際競爭對手。
Tag: #text-to-image16 results

Zhipu AI 發布了全新的 AI 圖像生成工具 GLM-Image,可於 image.z.ai 使用。該工具在中文文字渲染能力上表現優異,超越了 Midjourney 等國際競爭對手。

Google 更新了其開源的 DiffusionGemma 模型,帶來了 4 倍的效能提升。此項改進旨在為開發者加速文字生成圖像的工作流程。

DiffGraph是一種新型代理驅動的圖形基礎框架,用於合併線上專家文字轉圖像模型,以滿足多樣化使用者需求。它透過節點註冊和校準建構可擴展圖形組織專家,然後根據使用者需求動態激活子圖以實現靈活組合。實驗證實其有效利用豐富線上資源。

Hugging Face 部落格的 PRX 第3部分介紹在僅24小時內從頭訓練文字轉圖像模型。它強調使用開源工具的快速模型開發高效技巧。此舉讓生成式 AI 實驗加速。
不同 AI 文字轉圖像模型產生獨特風格,反映商業假設:Image-2 強調原始真實感、Nano Banana 精緻廣告風、豆包注重情感深度、可靈追求敘事戲劇性。這些「模型風味」將競爭從能力轉向審美匹配。用戶應依用途如素材或廣告選擇。
一名 Reddit 使用者正在尋求研究建議,希望打造能將自然語言提示轉換為 ASCII 藝術圖像的擴散模型。這項計畫需要結合文字條件控制、離散字元生成,以及從零開始建立擴散模型。