開源 AI最新動態
開放權重是行業對抗閉源實驗室的力量。追蹤 Llama、Qwen、DeepSeek 等的發佈、授權與跑分。
324 篇文章
三行獎勵程式碼讓 PPO 學會反應式遊玩
在 Atari Breakout 上進行 124 次 PPO 實驗後,作者發現僅靠環境隨機化仍會讓模型持續學出記憶式動作腳本。加入一項鼓勵球拍在球下降時靠近球的小額獎勵後,模型學會了反應式追蹤策略,並能轉移到標準 Breakout 評估環境。
Genspark 推出開源 GenOffice
Genspark 推出免費開源的 GenOffice AI 辦公套件,支援文件、試算表、簡報與 PDF,並可在 PC 與 Mac 上使用。創辦人景鯤將其視為 Genspark 從 AI 搜尋轉向一體化 AI Workspace、協助使用者完成完整工作任務的一部分。
MiniMax H3 開源,API 價格僅為三分之一
MiniMax 已開源 H3-Base,這是一款擁有 330 億參數的稠密單流 Omni-Transformer。據報其可與 Seedance 2.0 進行基準比較,API 價格僅為其三分之一,並能在兩張 RTX 5090 GPU 上本地執行。
Z.ai 推出開源 GLM-5.1,在 SWE-Bench 上擊敗 Opus 與 GPT
Z.ai 發布 GLM-5.1,一款 754B 參數開源 MoE LLM,採用 MIT 授權在 Hugging Face 上提供,可自主工作長達 8 小時。它透過「階梯模式」優化,在 SWE-Bench Pro 上超越 Claude Opus 4.6 與 GPT 5.4。模型可處理 1,700 步驟與數千工具呼叫而不偏離策略。
OpenAI 對開源權重模型及美國政策的擔憂
圍繞是否禁止中國製開源權重 LLM 的爭論,凸顯了 AI 商業模式與國家安全之間複雜的交集。OpenAI 的立場反映了業界對強大且易於取得的 AI 模型擴散的普遍焦慮。
Moonshot AI 發布全球最大開源 AI 模型
總部位於北京的 Moonshot AI 發布了擁有 2.8 兆參數的開源模型 Kimi K3。該公司聲稱此模型在特定能力上超越了 OpenAI 和 Anthropic 等頂尖美國競爭對手。
Kimi K3:全球最大規模開源模型發布
Kimi K3 模型作為全球最大規模的開源模型發布,具備原生視覺理解能力與 100 萬 token 上下文窗口。該模型針對軟體工程與深度研究等複雜任務進行了優化。
中國「媽祖」大模型全球落地,助力多國防災預警
「媽祖」城市多災種早期預警 AI 模型已在全球 35 個國家落地,協助巴基斯坦等國進行氣候災害預測。此外,中國開源大模型生態發展迅速,累計下載量已突破 100 億次。
世界模型與 AI 產業趨勢辯論
VC Weekly 報導討論了閉源 AI 巨頭與開源社群之間的緊張關係,並強調了 Pete Florence 對機器人「世界模型」的質疑。報告指出產業正轉向專注於特定任務的 AI 代理。
中國AI大模型動態:千問、騰訊混元與美團LongCat-2.0更新
多家中國科技巨頭發布重要AI更新,包括阿里巴巴的實時語音識別模型Fun-ASR-Realtime、騰訊混元Hy3模型,以及美團LongCat-2.0的開源。
Nvidia 開源機器人技能庫,推動具身智能發展
Nvidia 開源了其機器人技能庫,標誌著具身智能模型訓練方式的重大轉變。此發布專注於機器人代理的全新持續學習範式。
華為開源 920 億參數 openPangu-2.0-Flash 模型
華為正式開源了擁有 920 億參數的 openPangu-2.0-Flash 模型。此舉是華為強化其 AI 生態系統並為開發者提供高效能開源選項的策略性佈局。
華為正式開源 openPangu-2.0-Flash 模型
華為正式宣布開源 openPangu-2.0-Flash 模型。盤古模型系列的其他相關組件將於6月30日起陸續開放。
華為開源 920 億參數 openPangu-2.0-Flash 模型
華為正式開源了擁有 920 億參數的 openPangu-2.0-Flash 模型。此次發布是華為支援昇騰 AI 生態系統廣泛策略的一部分。
混合 Mamba+MoE 模型實現 504K 上下文窗口
本地 LLM 部署的突破:混合 Mamba+MoE 模型在消費級硬體 (4x3090) 上實現了高達 504K token 的完美檢索。該架構使用固定大小的循環狀態來避免 KV 快取膨脹。
DeepReinforce 發布 Ornith-1.0 開源程式碼模型
DeepReinforce 推出了全新的 Ornith-1.0 開源程式碼模型系列。該模型具備編寫自我強化學習 (RL) 架構的能力,並在程式碼基準測試中達到與 Claude Opus 4.7 相當的效能。
SpaceX 與 Reflection AI 簽署 63 億美元算力協議
SpaceX 與開源 AI 新創公司 Reflection AI 簽署了一項價值高達 63 億美元的算力合作協議。該協議使 Reflection 能使用 NVIDIA GB300 晶片來訓練先進模型。
Noiz AI 開源音頻生成大模型,4步出聲
Noiz AI 聯合香港科技大學與清華大學,開源了一款音頻生成大模型,實現了4步出聲,單卡推理延遲僅0.24秒。
智譜 AI 發布 GLM-5.2,支援 1M 長上下文
智譜 AI 宣布推出 GLM-5.2,具備 100 萬 token 的上下文視窗,並提升了長序列任務的表現。該模型將於下週以 MIT 授權正式開源。
月之暗面發布並開源 Kimi K2.7 Code 程式模型
月之暗面(Moonshot AI)發布並開源了 Kimi K2.7 Code 程式模型,顯著提升了長上下文指令遵循能力與程式編寫效能。相比前代 K2.6 模型,該模型平均 token 消耗減少了 30%。
Harness-1:開源搜尋代理效能超越 GPT-5.4
研究人員發表了 Harness-1,這是一個 200 億參數的開源搜尋代理,在資訊檢索任務中超越了 GPT-5.4。該模型採用 Apache 2.0 授權,並使用 Tinker 分散式訓練 API 進行訓練。
清華AIR開源UniLab,實現機器人運控訓練分鐘級突破
清華大學AIR開源了全新的強化學習訓練架構UniLab,將人形機器人的運控訓練時間縮短至3分鐘內。該架構不僅速度提升了10倍,還具備極高的硬體兼容性,甚至能在Mac上運行。
τ0-WM:最大規模開源具身世界模型發布
τ0-WM 作為目前最大規模的開源具身世界模型正式發布。該模型基於高達 17,800 小時的真實機器人操作數據進行訓練。
全新開源工具實現 AI 代碼庫全局可視化
一個擁有 3 萬 Star 的開源項目推出了一種代碼庫映射方法,為 AI 模型提供了複雜代碼庫的「全局視圖」。這解決了 AI 在理解大型項目結構時長期存在的困難。
智能進入月更時代
Anthropic Opus 4.7、OpenAI GPT-5.5、DeepSeek V4 等模型高密度發布。長視野任務、代理編碼、多模態提升,Opus 文字退步等權衡。DeepSeek 開源性價比領先。
全球首個醫療視頻理解大模型開源
全球首個專注醫療視頻理解的大模型已開源。它同步推出超過6,000組精標測試集與公開英雄榜。開發者受邀測試與貢獻。
開源 20GB MedQA 84% LLM
Empirisch Tech 開源 Chaperone-Thinking-LQ-1.0,這是 4-bit GPTQ 量化與 QLoRA 微調的 DeepSeek-R1-32B 模型,在 MedQA 上達 84%。可在單一 L40 GPU 的 20GB VRAM 運行,比基底快 1.6 倍。設計用於本地醫療保健,尊重資料主權。
阿里巴巴開源 Qwen3.6-35B-A3B 僅 3B 活躍參數編碼模型
阿里巴巴開源 Qwen3.6-35B-A3B,這款 35B 參數模型僅啟用 3B 活躍參數。在代理編碼任務中實現頂級性能。
OpenAI-Cloudflare 實現 GPT-5.4 企業部署
OpenAI 與 Cloudflare 合作,讓數百萬企業透過 Agent Cloud 直接部署 GPT-5.4 等前沿模型,推動 AI 原生應用全球擴展。斯坦福 2026 年 AI 指數報告顯示全球 AI 投資達 5810 億美元創歷史新高,中美在模型研發與機器人部署各具優勢。微軟開源 Phi-4 多模態推理模型,Transformer 注意機制與量子計算亦有突破。
Claude之父拒絕源碼洩露甩鍋員工
Anthropic 的 Boris Cherny 回應 Claude 源碼洩露,稱這是 NPM 打包的無心之過,不會讓員工背鍋。全球開發者瘋狂 fork 儲存庫並快速發布分析工具。此事件點燃 AI 社群熱潮。