
Meta 押注開放模型,尋求 AI 東山再起
Meta 將新的開放模型視為重整其陷入困境之 AI 策略的可能途徑。此舉反映 Mark Zuckerberg 試圖縮小與競爭對手之間的差距。
Tag: #open-models36 results

Meta 將新的開放模型視為重整其陷入困境之 AI 策略的可能途徑。此舉反映 Mark Zuckerberg 試圖縮小與競爭對手之間的差距。

Hugging Face 執行長 Clément Delangue 告訴 CNBC,過去一年中國開發的模型占該平台下載量的 41%。據報導,中國在每月及累計模型下載量上都已超越美國,凸顯其在開放式 AI 模型領域日益增長的影響力。

據報導,Trump 政府評估先進 AI 網路安全風險的自願性框架,將開放模型排除在測試範圍之外。框架也明確表示,模型發布後不能用此框架限制開放模型。

各實驗室畏懼字節跳動崛起,讚譽 DeepSeek 模型。美國研究員 36 小時遊覽中國 AI 設施。體現中國強大開源 AI 精神。

Mistral AI 宣布與 NVIDIA 合作,加速開放前沿模型開發。此夥伴關係旨在提升大規模開放權重 AI 系統效能。
摩爾線程宣布其 AI 訓推一體全功能 GPU MTT S5000 已完成對阿里三款全新 Qwen3.5 模型的全方位適配。這三款模型包括 Qwen3.5-35B-A3B、Qwen3.5-122B-A10B 和 Qwen3.5-27B,繼大型 Qwen3.5-397B-A17B 之後。此舉實現了全面的訓練與推論支援。
8 月 29 日的 GenAI Build Lab 工作坊將教導參與者使用完全開源的模型,建置並評測可上線的 retrieval-augmented generation 系統。課程涵蓋混合式檢索、重新排序、RAGAS 評估、護欄,以及部署成本與效能基準測試。
Hugging Face 執行長 Clement Delangue 指出,權力集中是 AI 面臨的最大風險之一,尤其當政府介入過度時更是如此。他也談到近期涉及 Hugging Face 的 OpenAI 模型駭客事件,以及如何讓 AI 代理留在安全的測試沙盒內。

貼文強調 Kimi、Minimax、Qwen、Gemma、GLM 等模型快速進展,可在平價硬體本地運行。基準顯示超越數字的趨勢;預期 Qwen 3.6 27B 即將推出。用戶現可本地完成複雜任務,對抗 Claude 或 GPT-4o。

企業正面臨AI擴散、GPU推論成本飆升,以及50,000個Copilot授權等投資ROI不明朗的問題。隨著試點轉向生產,董事會層級審查要求成本控制、治理與可衡量價值。組織正從token消費者轉向生產者,考慮DeepSeek等開源模型與自管GPU。