
可解釋性無法修正語言模型錯誤
語言模型在任務內部表示中擁有近乎完美的知識,但輸出表現差勁。四種機械解釋性方法無法可靠修正臨床分類錯誤,儘管內部準確率高。此知識-行動差距對AI安全有重大影響。
直接匹配不多,已補上最新動態。
Tag: #language-models4 results

語言模型在任務內部表示中擁有近乎完美的知識,但輸出表現差勁。四種機械解釋性方法無法可靠修正臨床分類錯誤,儘管內部準確率高。此知識-行動差距對AI安全有重大影響。
資訊理論論證證明無損標記化不會限制語言模型的表達力,也不會引入不可避免的冗餘。標準標記分佈可精確匹配字串熵。在實務中,BPE-Dropout 引入噪音有助於泛化,儘管理論上最佳為集中標準標記。

AI 聊天透過大型語言模型 (LLM) 實現開放式、動態對話,與傳統腳本式聊天機器人不同。它處理提示以產生具脈絡意識的回應,並有效處理後續問題。主要益處包括適應不斷變化的使用者需求。
Inference-time scaling in language models leads to adaptive resource rationality without explicit cost rewards. Models shift from brute-force to analytic strategies as task complexity rises. LRMs show robustness on challenging functions like XOR/XNOR unlike IT models.

Truffle Security 發現 768 組外洩的 AWS 金鑰,可對企業帳戶提供廣泛控制權,其中包括 526 組根金鑰。在受測憑證中,仍有 88% 處於啟用狀態;而 AWS 的隔離政策仍允許許多具破壞性的操作。

GDS Holdings 顯示,AI 相關資料中心訂單的增長速度快於已確認收入。這項趨勢反映需求強勁,但基礎設施擴建週期也使獲利延後。

TikTok 與 ByteDance 同意支付 4 億美元,和解美國司法部提起的案件;該案指控數百萬名未滿 13 歲兒童使用平台,且其資料在未獲家長同意下遭到蒐集。愛爾蘭監管機構也曾在 2023 年因兒童帳戶問題對 TikTok 罰款 3.45 億歐元。

隨著 AI 工作負載提高對系統資源的需求,Microsoft 正重新最佳化 8GB 以上裝置的 Windows 記憶體使用。文章認為,舊版相容性、整合服務、WebView2 與分散的資源管理,正壓縮本地模型和 AI Agent 可用的記憶體空間。

文章探討具身智能如何進入一場長期尋找產品市場契合度(PMF)的過程。文章認為,商業成功不會立即到來,因為技術路線仍未定型,而場景與規模之爭才剛開始。

一份最新報告警告,生成式AI正助長大學無人監考線上考試中的大規模作弊。相關機構敦促高校重新檢視這類評量,因為考試很容易被繞過,可能已無法可靠衡量學生的知識。