
Meta 發布 Muse Spark 1.1 並擴大算力部署
Meta 發布了高效能且具成本效益的 Muse Spark 1.1 模型,並確認了向長期算力租賃業務轉型的戰略。該公司正積極擴展其數據中心基礎設施,以同時支援內部 AI 開發與外部雲端服務需求。
Tag: #llm-performance11 results

Meta 發布了高效能且具成本效益的 Muse Spark 1.1 模型,並確認了向長期算力租賃業務轉型的戰略。該公司正積極擴展其數據中心基礎設施,以同時支援內部 AI 開發與外部雲端服務需求。

北京新創公司 Zhipu AI 發布了 GLM-5.2,該模型在網路安全漏洞檢測任務中展現出與 Anthropic 的 Claude Opus 4.8 相當的競爭力。此進展凸顯了中國 AI 模型與美國頂尖模型之間的差距正在縮小。

Google 將最新的 Gemini 3.5 模型整合至全產品線,卻引發用戶強烈批評。本文探討了高層宣傳與實際用戶體驗之間的落差。

GLM 5.1 在開源模型的程式碼競技場排行中奪得首位。此消息由 u/Auralore 在 Reddit r/LocalLLaMA 分享,引發社群討論。

Kimi K3 模型在 ArtificialAnalysis 排行榜上取得第三名的佳績。在這次基準測試評估中,它顯著超越了 Claude Opus 4.8 模型。

DeepSeek 發布了採用 MIT 授權的 DSpark,這是一個旨在顯著提升 LLM 推論速度的投機解碼框架。該系統利用「偵察」模型預測標記路徑,在不影響輸出品質的前提下加速生成。

北京大學與 DeepSeek 共同發布了 DSpark,這是一個旨在顯著提升大型語言模型(LLM)推論效能的推測解碼框架。該框架在嚴格的延遲限制下,實現了顯著的速度提升與吞吐量增加。

DeepSeek 發布了 DSpark,這是一項旨在優化大型模型推理效能的新解決方案。該更新解決了延遲問題,確保 AI 回應能更流暢地生成。

智譜 AI 大幅優化了模型推理效能,達到每秒 400 tokens 的吞吐量。此更新使該模型成為目前頂尖大型語言模型中速度最快的模型之一。

研究人員發現,告訴AI模型它是程式專家反而降低其程式設計表現。角色基礎提示可提升安全性對齊,但無法改善事實準確性或程式技能。這挑戰了使用專家角色的常見提示做法。