LobsterAI 上線圖片與影片生成模型矩陣
網易有道旗下的 LobsterAI 整合了一系列先進生成式模型,包括 Seedream、Seedance、HappyHorse 及 MiniMax-Hailuo。此更新大幅擴展了平台在圖片與影片合成方面的能力。
Tag: #multimodal329 results
網易有道旗下的 LobsterAI 整合了一系列先進生成式模型,包括 Seedream、Seedance、HappyHorse 及 MiniMax-Hailuo。此更新大幅擴展了平台在圖片與影片合成方面的能力。

Vercel 已將具備 100 萬 token 上下文窗口與原生多模態能力的 MiniMax M3 模型整合至 AI Gateway。開發者現在可以透過統一的 API 使用其強大的代理(agentic)功能與多模態輸入。

快手 2026 年第一季財報顯示,可靈 AI 業務成長強勁,單季營收超過 65 億人民幣。其影片生成技術已擴展至全球 42 個國家與地區,商業化進程顯著加速。

ByteDance 發布了全新的開源多模態模型 Lance,專為在具備 40GB VRAM 的硬體上本地運行而設計。該模型在發布後迅速於 Hugging Face 獲得高度關注。

ByteDance 開源了 Lance,這是一款擁有 30 億參數的輕量級多模態 AI 模型。它旨在單一高效架構內處理影像理解、生成和影片任務。

CapCut 宣布與 Google 合作,將其創意編輯工具直接整合至 Gemini 應用程式中。此整合旨在為影像與影片編輯提供更流暢、對話式的創作工作流程。
Qwen-code v0.16.0 針對 CLI 進行了重大改進,包括批次刪除對話與整合 ModelScope。此次更新還提升了子代理(subagent)效能,新增 Qwen3.6-35B-A3B 的多模態支援,並優化了 MCP 的可用性。
網易有道宣佈 Ziyue 大模型升級至 4.0 版本,正式邁入全模態時代。官方同步宣佈將核心的多模態模型與 TTS 模型進行開源。

智象未來正式發布基於 Unified Transformer (UiT) 架構的 HiDream-O1-Image-Pro,這是一款參數超過 2000 億的原生全模態圖像大模型。該模型通過將圖像、文本與任務條件統一於共享標記空間,在複雜文字渲染與圖像編輯任務中達到了 SOTA 水準。

曾參與 Google Gemini 與 PaLM 開發的核心科學家 Andrew Dai 離開 Google 並創立 Elorian AI。該新創公司專注於多模態視覺推理模型,旨在超越純語言模型架構。