大語言模型最新動態

新旗艦模型、上下文窗口、推理突破與跑分風波——每日追蹤這個時代的核心技術。

91 篇文章

🏠
IT之家16d ago

阿里千問 Qwen3.8 預覽版發布,具備 2.4T 參數

阿里千問宣布推出 Qwen3.8 預覽版模型,參數規模達 2.4T。目前已在 Token Plan 等平台開放測試,官方宣稱其性能極為強大。

💰
钛媒体18d ago

Moonshot AI 發布 2.8 兆參數 Kimi K3 模型

Moonshot AI 發布了擁有 2.8 兆參數的 Kimi K3 模型。此舉旨在於競爭激烈的 AI 市場中爭取開發者忠誠度。

💰
钛媒体20d ago

OpenAI 與 StepFun 同時進軍 AI 硬體市場

OpenAI 與 StepFun 正積極進軍 AI 硬體領域,預示著新一波競爭的到來。此舉挑戰了現有參與者,並突顯了大模型與實體設備整合的趨勢。

🔥
36氪22d ago

智譜獲南向資金淨買入 47.37 億港元

智譜今日獲南向資金淨買入 47.37 億港元,位列當日淨買入榜首。這顯示了香港資本市場對該 AI 公司的強烈投資興趣。

🔥
36氪29d ago

騰訊混元Hy3正式發布

騰訊正式發布混元Hy3模型,相較於預覽版展現出更強的智慧水準。目前已接入多項業務,並可透過騰訊雲TokenHub API使用。

🐯
虎嗅31d ago

大廠搶灘 AI 高考志願填報市場

阿里巴巴、騰訊與百度等大型科技公司正部署 AI Agent,以填補高考志願填報的市場空白,旨在透過數據驅動的演算法取代人類專家。

🔥
36氪32d ago

Github Copilot 接入開源模型 Kimi K2.7

月之暗面宣布 Github Copilot 已接入開源模型 Kimi K2.7。這是 Copilot 生態系統首次接入開源模型。

🐼
Pandaily35d ago

華為開源 920 億參數 openPangu-2.0-Flash 模型

華為正式開源了擁有 920 億參數的 openPangu-2.0-Flash 模型。此舉是華為強化其 AI 生態系統並為開發者提供高效能開源選項的策略性佈局。

🔥
36氪35d ago

華為正式開源 openPangu-2.0-Flash 模型

華為正式宣布開源 openPangu-2.0-Flash 模型。盤古模型系列的其他相關組件將於6月30日起陸續開放。

🏠
IT之家35d ago

華為開源 920 億參數 openPangu-2.0-Flash 模型

華為正式開源了擁有 920 億參數的 openPangu-2.0-Flash 模型。此次發布是華為支援昇騰 AI 生態系統廣泛策略的一部分。

⚛️
量子位49d ago

阿里巴巴發布 Qwen-Robot 具身智能模型系列

阿里巴巴推出了 Qwen-Robot 系列,這是其首個專為具身智能設計的大型模型。該模型使機器人能夠在物理環境中進行感知、推理和導航。

🐼
Pandaily51d ago

Zhipu AI 開源 GLM-5.2,支援 100 萬 Token 上下文

Zhipu AI 以 MIT 授權發布了 GLM-5.2,具備 100 萬 token 的超長上下文視窗。此舉被視為針對美國出口限制影響 Anthropic 模型取得管道的策略性回應。

⚛️
量子位55d ago

Claude Mythos 5 發布:一天內完成 5000 萬行程式碼

Anthropic 發布了 Claude Mythos 5,這是一款能處理大規模程式碼編寫任務的新模型。據稱該模型可在一天內處理 5000 萬行程式碼。

📊
Bloomberg Technology57d ago

Apple 將揭曉 Siri 的重大 AI 改版

Apple 預計將在 WWDC 上宣佈 Siri 的重大改版。此次更新將包含聊天機器人介面,並在 Apple 裝置間進行更深度的整合。

📊
Bloomberg Technology62d ago

DeepSeek 接近完成 74 億美元融資以實現 AI 野心

DeepSeek 即將完成 74 億美元的融資,其中包括來自 Tencent 的支持。這筆資金旨在擴展其 AI 能力,以與美國的主要模型競爭。

🗾
ITmedia AI+ (日本)67d ago

Anthropic 即將發布 Mythos 等級模型 Opus 4.8

Anthropic 宣布即將發布全新的「Mythos 等級」模型 Opus 4.8。在實施更強大的安全措施後,該模型將於未來幾週內向所有客戶開放。

🔥
36氪71d ago

xAI 的 Grok V9-Medium 模型訓練完成

Elon Musk 宣布 Grok V9-Medium (1.5T) 基礎模型已完成訓練。該模型納入了大量的 Cursor 數據,預計在強化學習完成後於 2 至 3 週內正式發布。

💼
VentureBeat75d ago

Cohere 發布採用 Apache 2.0 授權的開源權重模型 Command A+

Cohere 推出了 Command A+,這是一款擁有 2180 億參數的稀疏混合專家模型(MoE),並採用 Apache 2.0 授權發布。該模型針對複雜推理與代理工作流進行了優化,並透過先進的量化技術保持了極高的執行效率。

⚛️
量子位81d ago

螞蟻百靈 Ring-2.6-1T 開源模型強化智能體執行能力

螞蟻集團發布了開源模型 Bailing Ring-2.6-1T,其智能體執行能力獲得顯著增強。該模型在 AIME 26 基準測試中取得了 95.83 分的成績。

📰
The Verge83d ago

Amazon 將 Alexa Plus AI 整合至購物體驗中

Amazon 正以由 Alexa Plus 大型語言模型驅動的「Alexa for Shopping」取代原有的 Rufus AI 助理。該助理現已直接整合至 Amazon.com 的搜尋列,能針對用戶查詢提供對話式的回答。

🦙
Reddit r/LocalLLaMA125d ago

PrismML 推出可行 1-bit LLM

PrismML 宣布 1-bit Bonsai,被稱為首個商業可行的 1-bit 大型語言模型。此突破承諾極端量化以實現高效推論。細節見連結公告。

🐯
虎嗅18d ago

中國AI產業的資本遷徙路線

深入探討WAIC參展企業的融資趨勢,重點分析資本向大模型和具身智能領域大規模集中的轉變。

🇨🇳
cnBeta (Full RSS)20d ago

Linus Torvalds 釐清 Linux 對 AI 整合的立場

Linus Torvalds 發布聲明釐清 Linux 核心專案並非「反 AI」。他反駁了部分反對在核心開發流程中使用 AI 與 LLM 的開發者。

🐯
虎嗅22d ago

AI陪伴機器人的結構性困境

AI陪伴機器人市場正面臨「護城河」危機,隨著大模型技術普及,技術門檻消失導致產品同質化嚴重。高昂的推理成本與缺乏真正的共情能力,使初創企業陷入結構性困境。

🐼
Pandaily22d ago

Tencent 發布整合 WeChat 的 AI 代理 WorkBuddy

Tencent 發布了基於 Hunyuan Hy3 模型的本地 AI 程式設計代理 WorkBuddy。它直接整合於 WeChat,旨在為中國用戶簡化檔案管理、任務自動化與執行流程。

💰
钛媒体23d ago

第二代豆包手機即將問世

第二代豆包手機即將進入市場,這引發了關於主流手機製造商將如何應對此類 AI 原生硬體競爭的討論。

💰
钛媒体26d ago

MiniMax 與 Zhipu AI 估值差距顯著擴大

AI 獨角獸 MiniMax 與 Zhipu AI 之間的估值差距在半年內已達 6000 億港元。這反映了投資者在競爭激烈的中國 LLM 市場中焦點的轉移。

📋
TestingCatalog26d ago

SpaceXAI 發布專注於編碼的 Grok 4.5 模型

SpaceXAI 推出了 Grok 4.5,這是一款針對編碼任務進行優化的全新旗艦模型。目前已可透過 Grok Build、Cursor 以及官方 API 控制台進行存取。

🐯
虎嗅27d ago

智譜AI市值震盪,AI泡沫下的市場真相

智譜AI因 IPO 傳聞與限售股解禁經歷了極端的市場震盪。文章分析了中國 AI 公司與 OpenAI 等全球領先者之間的估值差距。

🔥
36氪29d ago

美團正式開源 LongCat-2.0 模型

美團正式開源 LongCat-2.0 模型,包含模型權重、推理引擎與核心技術文件。多家國產晶片廠商已完成該模型的推理適配工作。