
Tencent 灰度測試旗艦模型 Hunyuan Hy4
據報 Tencent 的 Hunyuan Hy4 已出現在 Yuanbao App 的模型選擇清單中,被標示為專家級模型,並具備工具使用能力。它的定位高於 Hy3,並與 DeepSeek 並列;此前 Tencent 曾表示,更大參數規模的 Hy4 將很快推出,並提升效能與多模態能力。
Tag: #model-testing6 results

據報 Tencent 的 Hunyuan Hy4 已出現在 Yuanbao App 的模型選擇清單中,被標示為專家級模型,並具備工具使用能力。它的定位高於 Hy3,並與 DeepSeek 並列;此前 Tencent 曾表示,更大參數規模的 Hy4 將很快推出,並提升效能與多模態能力。

Google 正在測試名為 Omni 的全新影片生成模型,可能為 Gemini 工具。使用者介面洩漏顯示其即將於 2026 I/O 亮相。這顯示 Google 進軍進階多媒體 AI 的意圖。

Anthropic 已開始對 Claude Jupiter V1 P 模型進行內部紅隊測試。此測試在 5 月 6 日 Code with Claude 開發者大會前進行。這暗示潛在新模型即將推出。

文章實測DeepSeek V4長文本、程式碼與推理能力。DeepSeek被定位為主動「認輸」。

OpenAI 正在 LM Arena 和 ChatGPT 上低調測試新一代 Image V2 模型。早期測試者指出提示準確性強且 UI 渲染逼真。這顯示影像生成能力的進展。

Meta 正在測試多種 Avocado AI 模型變體,包括 Avocado 9B 和 Avocado Mango Agent。這些包含多模態功能。開發部分依賴 Google 的 Gemini。