開源 AI最新動態

開放權重是行業對抗閉源實驗室的力量。追蹤 Llama、Qwen、DeepSeek 等的發佈、授權與跑分。

324 篇文章

🤖
Reddit r/MachineLearning2h ago

三行獎勵程式碼讓 PPO 學會反應式遊玩

在 Atari Breakout 上進行 124 次 PPO 實驗後,作者發現僅靠環境隨機化仍會讓模型持續學出記憶式動作腳本。加入一項鼓勵球拍在球下降時靠近球的小額獎勵後,模型學會了反應式追蹤策略,並能轉移到標準 Breakout 評估環境。

🐯
虎嗅Yesterday

Genspark 推出開源 GenOffice

Genspark 推出免費開源的 GenOffice AI 辦公套件,支援文件、試算表、簡報與 PDF,並可在 PC 與 Mac 上使用。創辦人景鯤將其視為 Genspark 從 AI 搜尋轉向一體化 AI Workspace、協助使用者完成完整工作任務的一部分。

🐼
PandailyYesterday

MiniMax H3 開源,API 價格僅為三分之一

MiniMax 已開源 H3-Base,這是一款擁有 330 億參數的稠密單流 Omni-Transformer。據報其可與 Seedance 2.0 進行基準比較,API 價格僅為其三分之一,並能在兩張 RTX 5090 GPU 上本地執行。

💼
VentureBeat118d ago

Z.ai 推出開源 GLM-5.1,在 SWE-Bench 上擊敗 Opus 與 GPT

Z.ai 發布 GLM-5.1,一款 754B 參數開源 MoE LLM,採用 MIT 授權在 Hugging Face 上提供,可自主工作長達 8 小時。它透過「階梯模式」優化,在 SWE-Bench Pro 上超越 Claude Opus 4.6 與 GPT 5.4。模型可處理 1,700 步驟與數千工具呼叫而不偏離策略。

💰
TechCrunch AI14d ago

OpenAI 對開源權重模型及美國政策的擔憂

圍繞是否禁止中國製開源權重 LLM 的爭論,凸顯了 AI 商業模式與國家安全之間複雜的交集。OpenAI 的立場反映了業界對強大且易於取得的 AI 模型擴散的普遍焦慮。

🇭🇰
SCMP Technology18d ago

Moonshot AI 發布全球最大開源 AI 模型

總部位於北京的 Moonshot AI 發布了擁有 2.8 兆參數的開源模型 Kimi K3。該公司聲稱此模型在特定能力上超越了 OpenAI 和 Anthropic 等頂尖美國競爭對手。

💰
钛媒体18d ago

Kimi K3:全球最大規模開源模型發布

Kimi K3 模型作為全球最大規模的開源模型發布,具備原生視覺理解能力與 100 萬 token 上下文窗口。該模型針對軟體工程與深度研究等複雜任務進行了優化。

🏠
IT之家21d ago

中國「媽祖」大模型全球落地,助力多國防災預警

「媽祖」城市多災種早期預警 AI 模型已在全球 35 個國家落地,協助巴基斯坦等國進行氣候災害預測。此外,中國開源大模型生態發展迅速,累計下載量已突破 100 億次。

🐯
虎嗅23d ago

世界模型與 AI 產業趨勢辯論

VC Weekly 報導討論了閉源 AI 巨頭與開源社群之間的緊張關係,並強調了 Pete Florence 對機器人「世界模型」的質疑。報告指出產業正轉向專注於特定任務的 AI 代理。

🔥
36氪29d ago

中國AI大模型動態:千問、騰訊混元與美團LongCat-2.0更新

多家中國科技巨頭發布重要AI更新,包括阿里巴巴的實時語音識別模型Fun-ASR-Realtime、騰訊混元Hy3模型,以及美團LongCat-2.0的開源。

⚛️
量子位34d ago

Nvidia 開源機器人技能庫,推動具身智能發展

Nvidia 開源了其機器人技能庫,標誌著具身智能模型訓練方式的重大轉變。此發布專注於機器人代理的全新持續學習範式。

🐼
Pandaily35d ago

華為開源 920 億參數 openPangu-2.0-Flash 模型

華為正式開源了擁有 920 億參數的 openPangu-2.0-Flash 模型。此舉是華為強化其 AI 生態系統並為開發者提供高效能開源選項的策略性佈局。

🔥
36氪35d ago

華為正式開源 openPangu-2.0-Flash 模型

華為正式宣布開源 openPangu-2.0-Flash 模型。盤古模型系列的其他相關組件將於6月30日起陸續開放。

🏠
IT之家35d ago

華為開源 920 億參數 openPangu-2.0-Flash 模型

華為正式開源了擁有 920 億參數的 openPangu-2.0-Flash 模型。此次發布是華為支援昇騰 AI 生態系統廣泛策略的一部分。

🦙
Reddit r/LocalLLaMA38d ago

混合 Mamba+MoE 模型實現 504K 上下文窗口

本地 LLM 部署的突破:混合 Mamba+MoE 模型在消費級硬體 (4x3090) 上實現了高達 504K token 的完美檢索。該架構使用固定大小的循環狀態來避免 KV 快取膨脹。

📋
TestingCatalog40d ago

DeepReinforce 發布 Ornith-1.0 開源程式碼模型

DeepReinforce 推出了全新的 Ornith-1.0 開源程式碼模型系列。該模型具備編寫自我強化學習 (RL) 架構的能力,並在程式碼基準測試中達到與 Claude Opus 4.7 相當的效能。

🏠
IT之家43d ago

SpaceX 與 Reflection AI 簽署 63 億美元算力協議

SpaceX 與開源 AI 新創公司 Reflection AI 簽署了一項價值高達 63 億美元的算力合作協議。該協議使 Reflection 能使用 NVIDIA GB300 晶片來訓練先進模型。

⚛️
量子位50d ago

Noiz AI 開源音頻生成大模型,4步出聲

Noiz AI 聯合香港科技大學與清華大學,開源了一款音頻生成大模型,實現了4步出聲,單卡推理延遲僅0.24秒。

🏠
IT之家52d ago

智譜 AI 發布 GLM-5.2,支援 1M 長上下文

智譜 AI 宣布推出 GLM-5.2,具備 100 萬 token 的上下文視窗,並提升了長序列任務的表現。該模型將於下週以 MIT 授權正式開源。

🇨🇳
cnBeta (Full RSS)53d ago

月之暗面發布並開源 Kimi K2.7 Code 程式模型

月之暗面(Moonshot AI)發布並開源了 Kimi K2.7 Code 程式模型,顯著提升了長上下文指令遵循能力與程式編寫效能。相比前代 K2.6 模型,該模型平均 token 消耗減少了 30%。

💼
VentureBeat56d ago

Harness-1:開源搜尋代理效能超越 GPT-5.4

研究人員發表了 Harness-1,這是一個 200 億參數的開源搜尋代理,在資訊檢索任務中超越了 GPT-5.4。該模型採用 Apache 2.0 授權,並使用 Tinker 分散式訓練 API 進行訓練。

⚛️
量子位63d ago

清華AIR開源UniLab,實現機器人運控訓練分鐘級突破

清華大學AIR開源了全新的強化學習訓練架構UniLab,將人形機器人的運控訓練時間縮短至3分鐘內。該架構不僅速度提升了10倍,還具備極高的硬體兼容性,甚至能在Mac上運行。

⚛️
量子位65d ago

τ0-WM:最大規模開源具身世界模型發布

τ0-WM 作為目前最大規模的開源具身世界模型正式發布。該模型基於高達 17,800 小時的真實機器人操作數據進行訓練。

💰
钛媒体66d ago

全新開源工具實現 AI 代碼庫全局可視化

一個擁有 3 萬 Star 的開源項目推出了一種代碼庫映射方法,為 AI 模型提供了複雜代碼庫的「全局視圖」。這解決了 AI 在理解大型項目結構時長期存在的困難。

🐯
虎嗅97d ago

智能進入月更時代

Anthropic Opus 4.7、OpenAI GPT-5.5、DeepSeek V4 等模型高密度發布。長視野任務、代理編碼、多模態提升,Opus 文字退步等權衡。DeepSeek 開源性價比領先。

⚛️
量子位100d ago

全球首個醫療視頻理解大模型開源

全球首個專注醫療視頻理解的大模型已開源。它同步推出超過6,000組精標測試集與公開英雄榜。開發者受邀測試與貢獻。

🤖
Reddit r/MachineLearning104d ago

開源 20GB MedQA 84% LLM

Empirisch Tech 開源 Chaperone-Thinking-LQ-1.0,這是 4-bit GPTQ 量化與 QLoRA 微調的 DeepSeek-R1-32B 模型,在 MedQA 上達 84%。可在單一 L40 GPU 的 20GB VRAM 運行,比基底快 1.6 倍。設計用於本地醫療保健,尊重資料主權。

🐼
Pandaily109d ago

阿里巴巴開源 Qwen3.6-35B-A3B 僅 3B 活躍參數編碼模型

阿里巴巴開源 Qwen3.6-35B-A3B,這款 35B 參數模型僅啟用 3B 活躍參數。在代理編碼任務中實現頂級性能。

💰
钛媒体112d ago

OpenAI-Cloudflare 實現 GPT-5.4 企業部署

OpenAI 與 Cloudflare 合作,讓數百萬企業透過 Agent Cloud 直接部署 GPT-5.4 等前沿模型,推動 AI 原生應用全球擴展。斯坦福 2026 年 AI 指數報告顯示全球 AI 投資達 5810 億美元創歷史新高,中美在模型研發與機器人部署各具優勢。微軟開源 Phi-4 多模態推理模型,Transformer 注意機制與量子計算亦有突破。

🇨🇳
cnBeta (Full RSS)125d ago

Claude之父拒絕源碼洩露甩鍋員工

Anthropic 的 Boris Cherny 回應 Claude 源碼洩露,稱這是 NPM 打包的無心之過,不會讓員工背鍋。全球開發者瘋狂 fork 儲存庫並快速發布分析工具。此事件點燃 AI 社群熱潮。

開源 AI最新動態 | SetupAI | SetupAI