
Tencent HY 延攬 OpenAI 研究員領導多模態 AI 團隊
Tencent HY 延攬 OpenAI 研究科學家 Tian Yonglong 領導其多模態模型開發。他將直接向首席 AI 科學家 Yao Shunyu 匯報,此舉為該公司戰略性人才招募的一環。
Tag: #multimodal329 results

Tencent HY 延攬 OpenAI 研究科學家 Tian Yonglong 領導其多模態模型開發。他將直接向首席 AI 科學家 Yao Shunyu 匯報,此舉為該公司戰略性人才招募的一環。

Meta 將其 Muse 圖像生成模型與 Instagram 整合,允許使用者將社群媒體個人檔案作為 AI 生成圖像的基礎。該模型目前也正被部署於 WhatsApp 的圖像生成功能,以及 Stories 的創意特效中。

openJiuwen 推出了全新的多模態範式 Skill-Omni,讓 AI 代理能夠從視覺數據而非僅僅是文字說明書中學習。此轉變使代理能夠建立更直觀且全面的經驗庫。

在上海舉辦的「電動版F1」賽事中,Google的Gemini AI提供了實時解說,標誌著多模態AI在體育轉播中的獨特應用。
AI 影片開發的重心正從視覺保真度轉向功能性智慧。下一代虛擬人將優先考慮「看」與「聽」的能力,從而實現更具互動性與情境感知能力的體驗。

Om AI 發布了 VLX,這是一款專為物理世界互動而設計的流式多模態模型,旨在推動端側 AI 應用的發展。

智譜 AI 唐杰發起全球意見徵集,探討即將推出的 GLM-5.3 模型開發方向。社群反饋顯示,使用者對增強視覺處理能力有強烈需求。

虎牙發布了 VAM 1.0 即時多模態數位人,支援 24 小時不間斷直播。該技術僅需一張照片即可生成能聊天、唱跳並與觀眾互動的虛擬形象。

COMPASS 是一個全新的統一多模態框架,旨在提升細粒度組合識別與控制能力。透過在感知與生成任務中共享專家標記,該模型實現了對圖像生成的精確佈局控制。
由日本多家大企業共同出資的 AI 開發公司宣布更名為「Noetra」。該公司正與產業技術總合研究所(AIST)合作,開發國產多模態 AI 基礎模型。