
OpenAI 對開源權重模型及美國政策的擔憂
圍繞是否禁止中國製開源權重 LLM 的爭論,凸顯了 AI 商業模式與國家安全之間複雜的交集。OpenAI 的立場反映了業界對強大且易於取得的 AI 模型擴散的普遍焦慮。
TechCrunch AI · 61 天前
開放權重是行業對抗閉源實驗室的力量。追蹤 Llama、Qwen、DeepSeek 等的發佈、授權與跑分。
367 篇文章

圍繞是否禁止中國製開源權重 LLM 的爭論,凸顯了 AI 商業模式與國家安全之間複雜的交集。OpenAI 的立場反映了業界對強大且易於取得的 AI 模型擴散的普遍焦慮。
TechCrunch AI · 61 天前

總部位於北京的 Moonshot AI 發布了擁有 2.8 兆參數的開源模型 Kimi K3。該公司聲稱此模型在特定能力上超越了 OpenAI 和 Anthropic 等頂尖美國競爭對手。
SCMP Technology · 64 天前

Kimi K3 模型作為全球最大規模的開源模型發布,具備原生視覺理解能力與 100 萬 token 上下文窗口。該模型針對軟體工程與深度研究等複雜任務進行了優化。
钛媒体 · 64 天前

「媽祖」城市多災種早期預警 AI 模型已在全球 35 個國家落地,協助巴基斯坦等國進行氣候災害預測。此外,中國開源大模型生態發展迅速,累計下載量已突破 100 億次。
IT之家 · 67 天前

VC Weekly 報導討論了閉源 AI 巨頭與開源社群之間的緊張關係,並強調了 Pete Florence 對機器人「世界模型」的質疑。報告指出產業正轉向專注於特定任務的 AI 代理。
虎嗅 · 69 天前

多家中國科技巨頭發布重要AI更新,包括阿里巴巴的實時語音識別模型Fun-ASR-Realtime、騰訊混元Hy3模型,以及美團LongCat-2.0的開源。
36氪 · 75 天前

Nvidia 開源了其機器人技能庫,標誌著具身智能模型訓練方式的重大轉變。此發布專注於機器人代理的全新持續學習範式。
量子位 · 80 天前

華為正式開源了擁有 920 億參數的 openPangu-2.0-Flash 模型。此舉是華為強化其 AI 生態系統並為開發者提供高效能開源選項的策略性佈局。
Pandaily · 81 天前
華為正式宣布開源 openPangu-2.0-Flash 模型。盤古模型系列的其他相關組件將於6月30日起陸續開放。
36氪 · 81 天前
華為正式開源了擁有 920 億參數的 openPangu-2.0-Flash 模型。此次發布是華為支援昇騰 AI 生態系統廣泛策略的一部分。
IT之家 · 81 天前

本地 LLM 部署的突破:混合 Mamba+MoE 模型在消費級硬體 (4x3090) 上實現了高達 504K token 的完美檢索。該架構使用固定大小的循環狀態來避免 KV 快取膨脹。
Reddit r/LocalLLaMA · 84 天前

DeepReinforce 推出了全新的 Ornith-1.0 開源程式碼模型系列。該模型具備編寫自我強化學習 (RL) 架構的能力,並在程式碼基準測試中達到與 Claude Opus 4.7 相當的效能。
TestingCatalog · 86 天前
SpaceX 與開源 AI 新創公司 Reflection AI 簽署了一項價值高達 63 億美元的算力合作協議。該協議使 Reflection 能使用 NVIDIA GB300 晶片來訓練先進模型。
IT之家 · 89 天前

Noiz AI 聯合香港科技大學與清華大學,開源了一款音頻生成大模型,實現了4步出聲,單卡推理延遲僅0.24秒。
量子位 · 96 天前

智譜 AI 宣布推出 GLM-5.2,具備 100 萬 token 的上下文視窗,並提升了長序列任務的表現。該模型將於下週以 MIT 授權正式開源。
IT之家 · 98 天前

月之暗面(Moonshot AI)發布並開源了 Kimi K2.7 Code 程式模型,顯著提升了長上下文指令遵循能力與程式編寫效能。相比前代 K2.6 模型,該模型平均 token 消耗減少了 30%。
cnBeta (Full RSS) · 99 天前

研究人員發表了 Harness-1,這是一個 200 億參數的開源搜尋代理,在資訊檢索任務中超越了 GPT-5.4。該模型採用 Apache 2.0 授權,並使用 Tinker 分散式訓練 API 進行訓練。
VentureBeat · 102 天前

清華大學AIR開源了全新的強化學習訓練架構UniLab,將人形機器人的運控訓練時間縮短至3分鐘內。該架構不僅速度提升了10倍,還具備極高的硬體兼容性,甚至能在Mac上運行。
量子位 · 109 天前

τ0-WM 作為目前最大規模的開源具身世界模型正式發布。該模型基於高達 17,800 小時的真實機器人操作數據進行訓練。
量子位 · 111 天前

一個擁有 3 萬 Star 的開源項目推出了一種代碼庫映射方法,為 AI 模型提供了複雜代碼庫的「全局視圖」。這解決了 AI 在理解大型項目結構時長期存在的困難。
钛媒体 · 112 天前

Anthropic Opus 4.7、OpenAI GPT-5.5、DeepSeek V4 等模型高密度發布。長視野任務、代理編碼、多模態提升,Opus 文字退步等權衡。
虎嗅 · 143 天前
全球首個專注醫療視頻理解的大模型已開源。它同步推出超過6,000組精標測試集與公開英雄榜。
量子位 · 146 天前
Empirisch Tech 開源 Chaperone-Thinking-LQ-1.0,這是 4-bit GPTQ 量化與 QLoRA 微調的 DeepSeek-R1-32B 模型,在 MedQA 上達 84%。可在單一 L40 GPU 的 20GB VRAM 運行,比基底快 1.6 倍。
Reddit r/MachineLearning · 150 天前
Harbor Adapters 提供統一基礎設施,讓任意代理能在超過 80 個代理基準上接受評估。配套的 Harbor-Index 從 29 個基準中精選 82 項具挑戰性的任務,以更低成本實現可重現的代理能力與失效模式評估。
ArXiv AI · 12 天前

AWS 推出 HyperPod InstantStart,這是一個結合 Amazon EKS 編排與 Amazon SageMaker HyperPod 託管能力的開源控制平面。它透過網頁介面與 AI 代理提供受控操作,涵蓋叢集建立、容量、訓練、推論與儲存。
AWS Machine Learning Blog · 15 天前
NVIDIA 推出 Personal AI Router(PAIR)測試版,這是一款免費開源、專為本地 AI 推理設計的虛擬路由器。它能在同一區域網路中發現相容電腦,整合閒置運算資源,支援 AI 代理與本地模型工作負載。
cnBeta (Full RSS) · 15 天前

CNAS《主權 AI 指數》2.0 顯示,全球主權 AI 項目已從 2023 年的 1 個增至 184 個,覆蓋 67 個國家及歐盟。美國基礎模型仍居主導,但中國模型已透過 Qwen 與 01.AI 進入 6 國,且從零建立模型的項目比例升至約 40%。
虎嗅 · 16 天前
Jasper Research 發布互動式 cookbook,說明如何從零打造文字生成圖像模型,並公開完整推理過程與中間結果。專案也提供 nano t2i 程式碼庫,以及可用於實際訓練的 1 億張圖像 Monet 資料集。
Reddit r/MachineLearning · 17 天前

Anthropic 推出 Model Hardware Standard,旨在讓 AI 代理控制機器人、顯微鏡等實體硬體。該框架可能應用於藥物開發及量子電腦雷射校準,並計畫在完成測試後開放原始碼。
Computerworld · 22 天前
Tencent 開源了 Hunyuan Hy4 預覽版,並邀請使用者參與訓練與改進。InfoQ 對 WorkBuddy 的實測顯示,它具備小型團隊般的交付能力,但仍需要人工監督。
InfoQ中国 · 22 天前