Drummer 新版 8B-70B LLM 更新發布
TheDrummer 安靜發布 Skyfall 31B v4.1、Valkyrie 49B v2.1、Anubis 70B v1.2,以及 Anubis Mini 8B v1(Llama 3.3 微調)。這些升級符合 Gen 4.0 風格如 Cydonia 24B,並獲社群正面回饋。未來將支援 Qwen 3.5 和 Mistral 4。
Tag: #open-weights77 results
TheDrummer 安靜發布 Skyfall 31B v4.1、Valkyrie 49B v2.1、Anubis 70B v1.2,以及 Anubis Mini 8B v1(Llama 3.3 微調)。這些升級符合 Gen 4.0 風格如 Cydonia 24B,並獲社群正面回饋。未來將支援 Qwen 3.5 和 Mistral 4。
一篇 Reddit 貼文建議 Google 推出具開放權重的 120B dense multimodal Gemma 模型。這項構想目前仍屬推測,但認為西方企業可能更偏好 Google 品牌的模型,而非中國開源模型或 OpenAI、Anthropic 等封閉式服務。

Reddit 使用者在 ms-swift 的 GitHub 提交中發現 Qwen 3.8 35BA3B 的參照。目前貼文沒有提供發布細節,顯示這可能是尚未發布或即將推出的模型變體。
DeepSeek、智譜與 Kimi 等中國模型廠商推動了新一輪開放模型熱潮,NVIDIA 執行長 Jensen Huang 也正推動全球開放模型聯盟。文章指出,業界所稱的「開源模型」多數實際上是開放權重,並不代表完整開放訓練資料、程式碼與訓練方法。
NVIDIA 探討開放世界模型如何透過更廣泛的生態系參與,推進實體 AI 的發展前沿。該公司也加入超過 200 家企業與組織,共同簽署「Open Weights and American AI Leadership」公開信,以支持開放式 AI 發展。

這篇深度分析探討開源大型語言模型的快速發展,是否可能帶來具顛覆性、甚至具有破壞性的後果。現有摘錄主要反思開放式 AI 發展所帶來的智慧與風險,未提及特定模型或產品發布。

中國的開源 AI 策略正對美國模型公司造成價格與能力上的雙重擠壓。處於市場中間地帶的企業,既難以與免費的中國模型競爭,也難以支撐前沿模型供應商所收取的高價。
這是一場關於目前最佳開源視覺語言模型 (VLM) 的社群討論。開發者們正分享其硬體配置與應用場景,以應對 VLM 評估中缺乏標準與工具不成熟的挑戰。

Anthropic執行長Dario Amodei對無限制開源AI模型的安全性與潛在危險表示擔憂。此言論在本地LLM社群中引發了廣泛討論。

推測指出中國開源 AI 模型即將發布,且背後存在重大的戰略佈局。該貼文提醒開發者需為 Fable5 之外的生態系統重大變動做好準備。