大語言模型最新動態
新旗艦模型、上下文窗口、推理突破與跑分風波——每日追蹤這個時代的核心技術。
91 篇文章
阿里千問 Qwen3.8 預覽版發布,具備 2.4T 參數
阿里千問宣布推出 Qwen3.8 預覽版模型,參數規模達 2.4T。目前已在 Token Plan 等平台開放測試,官方宣稱其性能極為強大。
Moonshot AI 發布 2.8 兆參數 Kimi K3 模型
Moonshot AI 發布了擁有 2.8 兆參數的 Kimi K3 模型。此舉旨在於競爭激烈的 AI 市場中爭取開發者忠誠度。
OpenAI 與 StepFun 同時進軍 AI 硬體市場
OpenAI 與 StepFun 正積極進軍 AI 硬體領域,預示著新一波競爭的到來。此舉挑戰了現有參與者,並突顯了大模型與實體設備整合的趨勢。
智譜獲南向資金淨買入 47.37 億港元
智譜今日獲南向資金淨買入 47.37 億港元,位列當日淨買入榜首。這顯示了香港資本市場對該 AI 公司的強烈投資興趣。
騰訊混元Hy3正式發布
騰訊正式發布混元Hy3模型,相較於預覽版展現出更強的智慧水準。目前已接入多項業務,並可透過騰訊雲TokenHub API使用。
大廠搶灘 AI 高考志願填報市場
阿里巴巴、騰訊與百度等大型科技公司正部署 AI Agent,以填補高考志願填報的市場空白,旨在透過數據驅動的演算法取代人類專家。
Github Copilot 接入開源模型 Kimi K2.7
月之暗面宣布 Github Copilot 已接入開源模型 Kimi K2.7。這是 Copilot 生態系統首次接入開源模型。
華為開源 920 億參數 openPangu-2.0-Flash 模型
華為正式開源了擁有 920 億參數的 openPangu-2.0-Flash 模型。此舉是華為強化其 AI 生態系統並為開發者提供高效能開源選項的策略性佈局。
華為正式開源 openPangu-2.0-Flash 模型
華為正式宣布開源 openPangu-2.0-Flash 模型。盤古模型系列的其他相關組件將於6月30日起陸續開放。
華為開源 920 億參數 openPangu-2.0-Flash 模型
華為正式開源了擁有 920 億參數的 openPangu-2.0-Flash 模型。此次發布是華為支援昇騰 AI 生態系統廣泛策略的一部分。
阿里巴巴發布 Qwen-Robot 具身智能模型系列
阿里巴巴推出了 Qwen-Robot 系列,這是其首個專為具身智能設計的大型模型。該模型使機器人能夠在物理環境中進行感知、推理和導航。
Zhipu AI 開源 GLM-5.2,支援 100 萬 Token 上下文
Zhipu AI 以 MIT 授權發布了 GLM-5.2,具備 100 萬 token 的超長上下文視窗。此舉被視為針對美國出口限制影響 Anthropic 模型取得管道的策略性回應。
Claude Mythos 5 發布:一天內完成 5000 萬行程式碼
Anthropic 發布了 Claude Mythos 5,這是一款能處理大規模程式碼編寫任務的新模型。據稱該模型可在一天內處理 5000 萬行程式碼。
Apple 將揭曉 Siri 的重大 AI 改版
Apple 預計將在 WWDC 上宣佈 Siri 的重大改版。此次更新將包含聊天機器人介面,並在 Apple 裝置間進行更深度的整合。
DeepSeek 接近完成 74 億美元融資以實現 AI 野心
DeepSeek 即將完成 74 億美元的融資,其中包括來自 Tencent 的支持。這筆資金旨在擴展其 AI 能力,以與美國的主要模型競爭。
Anthropic 即將發布 Mythos 等級模型 Opus 4.8
Anthropic 宣布即將發布全新的「Mythos 等級」模型 Opus 4.8。在實施更強大的安全措施後,該模型將於未來幾週內向所有客戶開放。
xAI 的 Grok V9-Medium 模型訓練完成
Elon Musk 宣布 Grok V9-Medium (1.5T) 基礎模型已完成訓練。該模型納入了大量的 Cursor 數據,預計在強化學習完成後於 2 至 3 週內正式發布。
Cohere 發布採用 Apache 2.0 授權的開源權重模型 Command A+
Cohere 推出了 Command A+,這是一款擁有 2180 億參數的稀疏混合專家模型(MoE),並採用 Apache 2.0 授權發布。該模型針對複雜推理與代理工作流進行了優化,並透過先進的量化技術保持了極高的執行效率。
螞蟻百靈 Ring-2.6-1T 開源模型強化智能體執行能力
螞蟻集團發布了開源模型 Bailing Ring-2.6-1T,其智能體執行能力獲得顯著增強。該模型在 AIME 26 基準測試中取得了 95.83 分的成績。
Amazon 將 Alexa Plus AI 整合至購物體驗中
Amazon 正以由 Alexa Plus 大型語言模型驅動的「Alexa for Shopping」取代原有的 Rufus AI 助理。該助理現已直接整合至 Amazon.com 的搜尋列,能針對用戶查詢提供對話式的回答。
PrismML 推出可行 1-bit LLM
PrismML 宣布 1-bit Bonsai,被稱為首個商業可行的 1-bit 大型語言模型。此突破承諾極端量化以實現高效推論。細節見連結公告。
中國AI產業的資本遷徙路線
深入探討WAIC參展企業的融資趨勢,重點分析資本向大模型和具身智能領域大規模集中的轉變。
Linus Torvalds 釐清 Linux 對 AI 整合的立場
Linus Torvalds 發布聲明釐清 Linux 核心專案並非「反 AI」。他反駁了部分反對在核心開發流程中使用 AI 與 LLM 的開發者。
AI陪伴機器人的結構性困境
AI陪伴機器人市場正面臨「護城河」危機,隨著大模型技術普及,技術門檻消失導致產品同質化嚴重。高昂的推理成本與缺乏真正的共情能力,使初創企業陷入結構性困境。
Tencent 發布整合 WeChat 的 AI 代理 WorkBuddy
Tencent 發布了基於 Hunyuan Hy3 模型的本地 AI 程式設計代理 WorkBuddy。它直接整合於 WeChat,旨在為中國用戶簡化檔案管理、任務自動化與執行流程。
第二代豆包手機即將問世
第二代豆包手機即將進入市場,這引發了關於主流手機製造商將如何應對此類 AI 原生硬體競爭的討論。
MiniMax 與 Zhipu AI 估值差距顯著擴大
AI 獨角獸 MiniMax 與 Zhipu AI 之間的估值差距在半年內已達 6000 億港元。這反映了投資者在競爭激烈的中國 LLM 市場中焦點的轉移。
SpaceXAI 發布專注於編碼的 Grok 4.5 模型
SpaceXAI 推出了 Grok 4.5,這是一款針對編碼任務進行優化的全新旗艦模型。目前已可透過 Grok Build、Cursor 以及官方 API 控制台進行存取。
智譜AI市值震盪,AI泡沫下的市場真相
智譜AI因 IPO 傳聞與限售股解禁經歷了極端的市場震盪。文章分析了中國 AI 公司與 OpenAI 等全球領先者之間的估值差距。
美團正式開源 LongCat-2.0 模型
美團正式開源 LongCat-2.0 模型,包含模型權重、推理引擎與核心技術文件。多家國產晶片廠商已完成該模型的推理適配工作。