全球首個醫療視頻理解大模型開源
全球首個專注醫療視頻理解的大模型已開源。它同步推出超過6,000組精標測試集與公開英雄榜。開發者受邀測試與貢獻。
Tag: #leaderboard25 results
全球首個專注醫療視頻理解的大模型已開源。它同步推出超過6,000組精標測試集與公開英雄榜。開發者受邀測試與貢獻。

小米 CEO 雷軍宣布 MiMo 大模型調用量超過 1 萬億 Token。小米 MiMo-V2-Pro 在 Text Arena 邏輯推理、長指令遵循及多輪對話評測中闖入全球前五,並領跑 OpenRouter 日榜、周榜及趨勢榜。
ClawBench發布最新大模型榜單,智譜、字節、小米共4款模型闖入全球前十。智譜GLM-5-Turbo以93.9分領先,字節Doubao-Seed-2.0-lite居第二、使用成本最低,小米MiMo-V2-Omni第9、速度最快。

阿里巴巴的 Qwen3.5-Max-Preview 在 LMArena 亮相,登頂全球 AI 模型排行榜。它超越國際領先者和國內競爭對手,顯示出強大性能提升。

Microsoft 的 MAI-Image-2 在 Arena.ai 排行榜上位居第 3,仅次於 Google 與 OpenAI 模型。今天起於 Copilot 與 Bing Image Creator 推出。此為從依賴 OpenAI 圖像生成技術的轉變。

昆侖科技的 SkyReels-V4 模型在 Artificial Analysis 排行榜的「文字轉影片(含音訊)」類別中獲得全球第一名。它超越了 Kling 3.0、Google Veo 3.1 和 OpenAI Sora 2 等主流競爭對手。

小米認領了排行榜首位的神秘模型 Hunter Alpha。該模型擁有萬億參數和百萬 token 上下文長度。即使「龍蝦之父」等知名人士也忍不住打聽。

這個最初源自 UC Berkeley 研究計畫的群眾外包 AI 排行榜,在推出首款商業產品僅八個月後,年化營收已達到 1 億美元。

Papers With Code 更新平台,納入 GPT-5.5 與 Mythos 5 等閉源模型的效能評測。使用者現在可以切換開源與閉源模型的排行榜,更全面地比較 AI 的頂尖效能。

Hugging Face 推出 QIMMA,這是一個專注於以品質指標評估阿拉伯語大型語言模型的新排行榜。它旨在以標準化方式突顯表現最佳的阿拉伯語 LLM。此工具支援阿拉伯語 NLP 研究與開發的進展。