
DeepSeek 實施峰谷電價調整
DeepSeek 引入了與電力成本掛鉤的動態定價機制,凸顯了 AI 算力需求與電網負載管理之間日益增長的協同效應。這種「算電協同」正成為 AI 基礎設施永續發展的關鍵因素。
Tag: #llm-infrastructure13 results

DeepSeek 引入了與電力成本掛鉤的動態定價機制,凸顯了 AI 算力需求與電網負載管理之間日益增長的協同效應。這種「算電協同」正成為 AI 基礎設施永續發展的關鍵因素。

美團開源了 LongCat-2.0,這是一款擁有 1.6 兆參數的混合專家模型(MoE),專為自主軟體工程設計。該模型具備 100 萬 token 的上下文視窗,且完全使用中國晶片進行訓練。

前 OpenAI 研究科學家姚順雨(Vinces Yao)加入騰訊,負責領導 AI Infra 部與大語言模型部。他將直接向騰訊總裁劉熾平匯報,致力於 AI 的長期發展。
據報導,Amazon 正在進行代號為「Moonraker」的全新項目,旨在將 Alexa 語音助理轉型為 AI 智能體。內部文件顯示,該項目的研發與營運成本極高,引發了公司內部的擔憂。

騰訊正式發布 Hy3 模型,標誌著其 AI 戰略的重大進展。該模型正被整合至 WorkBuddy 和元寶等內部產品中,以提高任務成功率並減少幻覺。

PyTorch Monarch 現已支援 AMD GPU,實現了基於 ROCm 的單控制器分散式訓練。此更新旨在簡化在大型 GPU 叢集上進行大型語言模型訓練的擴展流程。

北京正式啟動了一項全新的AI工廠基礎設施計畫。該設施目標實現10萬P的算力,並達到每日產出10萬億Token的規模。
quicktok 是一款基於 C++ 的全新 BPE 分詞器,在保持與 tiktoken 位元組完全相同的前提下,效能提升了 4 至 11 倍。它支援包括 Llama-3、Qwen2.5/3 以及多種 GPT 編碼在內的主流模型。
小米 MiMo 團隊揭露了 V2.5 模型背後的技術優化,包括 KVCache 管理與多模態推理改進。這些更新使模型在實現 API 永久降價的同時,仍能維持獲利能力。
DeepSeek 正式宣布其旗艦模型 V4-Pro 的 75% 折扣將改為永久性優惠。此舉使開發者使用該模型的成本維持在原始定價的四分之一。