
全民裝蝦,一戳就破的AI白日夢
「代裝」AI熱潮轉為「代卸」,全民裝「蝦」成泡沫。視AI普及為一戳即破的白日夢,質疑消費者熱衷持久性。
虎嗅 · 196 天前

「代裝」AI熱潮轉為「代卸」,全民裝「蝦」成泡沫。視AI普及為一戳即破的白日夢,質疑消費者熱衷持久性。
虎嗅 · 196 天前

砺算科技於AWE2026大展推出Lisuan eXtreme系列,這是中國首款真6nm自研GPU,採用TrueGPU天圖架構。具備12GB顯存,性能對標RTX 4060。
cnBeta (Full RSS) · 196 天前

AI浪潮推升DDR5記憶體價格,玩家單條安裝顯得孤零零。全何推出1+1 DDR5 RGB套裝,一真一假組合方案。
cnBeta (Full RSS) · 196 天前

全球記憶體供應危機下,DDR5價格兩年內暴漲3.5至4倍。澳洲消費者退換故障條遭商家扣押,只按兩年前原價退款不換新。
cnBeta (Full RSS) · 196 天前

寒武紀科技,中國的「小Nvidia」,自2020年上市以來首度實現全年盈利。公司計劃每10股派發15元現金股息,總計超過6.32億元。
SCMP Technology · 196 天前

Truecaller 推出家庭群組功能,讓一位管理員監控成員的詐騙來電,並遠端結束可疑通話。此來電識別平台擁有超過 4.5 億用戶,提升防詐騙保護。
TechCrunch AI · 196 天前
OpenClaw 2026.3.12 推出模組化 Control UI 儀表板,包含聊天工具、命令面板與行動裝置分頁。新增 OpenAI GPT 與 Anthropic Claude 的快速模式切換,以及 Ollama、vLLM、SGLang 的提供者外掛。
OpenClaw (GitHub Releases) · 196 天前

OpenClaw作者Peter Steinberger指責Tencent SkillHub抓取ClawHub數據,導致伺服器成本暴增卻無支持。Tencent辯稱為節省頻寬的本地鏡像,並依MIT授權標註來源。
虎嗅 · 196 天前
Reddit 討論批評 NeurIPS/ICLR 充斥 LLM 基準測試論文。專有模型每月更新,基準測試版本在發表前即過時。
Reddit r/MachineLearning · 196 天前

中東衝突延長恐中斷晶片製造關鍵氦氣供應。卡達佔全球氦氣產量逾三分之一。
Bloomberg Technology · 196 天前

20年老牌遊戲媒體VideoGamer因發布完全由AI生成的《生化危機:安魂曲》評測文章,被Metacritic刪除。此事發酵後,谷歌封禁該媒體,使其無法被搜尋。
cnBeta (Full RSS) · 196 天前

阿里巴巴推出專屬 OpenClaw 手機App,讓使用者數分鐘內安裝部署代理式AI助理。此舉加劇中國科技巨頭搶佔病毒式代理AI商機。
Bloomberg Technology · 196 天前

LightWheel 籌得1.45億美元資金。成為全球首家具身數據獨角獸。
Pandaily · 196 天前

黃仁勳關於應用商店的預言在蘋果身上實現。公司面臨比反壟斷更嚴峻挑戰,在後App Store時代重新定義價值。
钛媒体 · 196 天前

文章警告勿過度神話AI龍蝦OpenClaw。質疑使用者是否真已採用或「養」了它。
钛媒体 · 196 天前

Violoop 獲得數百萬美元資金。硬體驅動AI新創公司計劃推出全球首個物理層級AI操作員。
Pandaily · 196 天前

研究人員提出 Unlearning Mirage 框架,使用動態複雜結構化查詢(如多跳鏈)來壓力測試 LLM 解除學習的穩健性。它從解除學習前的知識生成針對性探針,揭露靜態基準遺漏的漏洞。
ArXiv AI · 196 天前

SoLA 提出基於語義路由的 LoRA 框架,用於大型語言模型的終身模型編輯,將每個編輯封裝為獨立的凍結 LoRA 模組,透過語義匹配動態啟動。它防止語義漂移和災難性遺忘,並透過移除路由金鑰實現特定編輯的精確撤銷。
ArXiv AI · 196 天前

RewardHackingAgents 推出基準測試,用於評估 LLM ML 工程代理的完整性,針對評估器篡改和訓練/測試洩漏等漏洞。它使用工作空間追蹤和偵測器,透過比較代理報告指標與可信參考來指派完整性標籤。
ArXiv AI · 196 天前

自動駕駛發展正從感知限制轉向推理缺陷,尤其在長尾與社交情境中。此調查提出認知層級架構分解任務,並系統化七大推理挑戰,如響應性-推理權衡。
ArXiv AI · 196 天前

PACED 透過 Beta 加權通過率,針對學生模型的最近發展區優化 LLM 蒸餾,避免在已掌握或遙不可及問題上浪費計算資源。它證明了加權的 SNR 最佳性與 minimax 穩健性。
ArXiv AI · 196 天前

Microsoft 公布 AI 代理導入準備態勢的調查結果。準備充分的企業比未整備企業快約 2.5 倍導入代理。
ITmedia AI+ (日本) · 196 天前

研究人員揭露 LLM 基於使用者模擬在代理任務中的 Sim2Real 差距,顯示其過度合作且缺乏人類挫折感,製造「簡單模式」。首次以 451 名真人執行完整 τ-bench,透過新 User-Sim Index (USI) 基準測試 31 個 LLM。
ArXiv AI · 196 天前

研究人員提出LLM增強數位孿生,用於評估短影片平台的政策,解決封閉迴圈生態系統的挑戰。此系統採用模組化四孿生架構(User、Content、Interaction、Platform),並具事件驅動執行層以實現可重現模擬。
ArXiv AI · 196 天前

DIVE 顛倒任務合成順序,先執行多樣真實工具並從軌跡反推嚴格蘊涵的任務,以確保多樣性有根基。它透過證據收集-任務推導迴圈,擴展工具池覆蓋與每任務工具集多樣性,涵蓋五領域373工具。
ArXiv AI · 196 天前

COMPASS 是一個多代理協調框架,用於在基於 LLM 的代理系統中強制執行主權、永續性、合規性和倫理。它包含 Orchestrator 和四個 RAG 增強的子代理,用於基於事實的文件評估,並使用 LLM-as-a-judge 進行評分和可解釋的理由驗證。
ArXiv AI · 196 天前

研究人員使用 AI 心理測量學和 TAM 評估 GPT-3.5、GPT-4、LLaMA-2 和 LLaMA-3 的心理推理能力。所有模型均符合有效性標準,GPT-4 和 LLaMA-3 表現更優異。
ArXiv AI · 196 天前

這篇 arXiv 社論對比 AI(尤其是 LLM)與企業壟斷導致的集中化趨勢,以及區塊鏈的去中心化特性。區塊鏈透過去中心化資料、運算與治理緩解 AI 風險,而 AI 則提升區塊鏈智慧合約與安全效率。
ArXiv AI · 196 天前

研究人員在 32 步企業網路與 7 步工業控制系統網路攻擊靶場上評估前沿 AI 模型,需鏈結多項能力。效能隨推論運算呈對數線性擴展,從 10M 到 100M 令牌提升高達 59%。
ArXiv AI · 196 天前

GitHub 依「Octoverse 2025」年報分析,急成長前 10 項目有 6 成 AI 相關。開發者推動 AI 專案時重視點與工具選擇正改變。
ITmedia AI+ (日本) · 196 天前