Anthropic 發現「J-space」,實現 AI 內在思考視覺化
Anthropic 在大型語言模型中發現了類似人類意識研究中「全域工作空間」的結構「J-space」,並發布了名為「Jacobian lens」的新工具。該方法能觀測 AI 未經語言化的隱藏思考,有助於安全性監控並偵測惡意程式碼意圖。
Tag: #llm-research10 results
Anthropic 在大型語言模型中發現了類似人類意識研究中「全域工作空間」的結構「J-space」,並發布了名為「Jacobian lens」的新工具。該方法能觀測 AI 未經語言化的隱藏思考,有助於安全性監控並偵測惡意程式碼意圖。

Transformer 架構核心貢獻者、前 Google Gemini 技術聯席負責人 Noam Shazeer 宣布離職並加入 OpenAI。Sam Altman 對此表示熱烈歡迎,並強調了 Shazeer 在 AI 領域的深遠影響。
一位88歲圖靈獎得主使用 Claude 在一小時內破解30年數學懸案。此案例展現 LLM 在處理複雜未解問題的潛力。強調 AI 輔助發現的快速性。

由前 OpenAI 技術長 Mira Murati 創立的 Thinking Machines Lab 發布了其首款模型 Inkling。該模型採用開源權重形式,開發者與企業可直接下載並進行實驗。

Google DeepMind 已敲定協議,將從 Contextual AI 引進超過 20 名研究人員並授權其技術。此交易包含 1 億美元的支付,且 Contextual AI 執行長 Douwe Kiela 將加入 DeepMind 團隊。

AI 先驅 Andrej Karpathy 已加入 Anthropic,將領導一個專注於利用 Claude 加速預訓練研究的團隊。此舉旨在推動大型語言模型在遞迴自我改進方面的技術邊界。
一位擁有豐富發表紀錄的資深 CS 畢業生,正尋求 A100/H100 等級的 GPU 運算資源以推進 LLM 與 VLM 研究。作者提供共同作者身份與透明的研究協作,以換取運算基礎設施支援。

Persona Atlas 是 Hugging Face 的一項新研究計畫,旨在探索歷史與著名人物的認知映射與角色建模。該計畫提供了一種結構化的方法,用於理解大型語言模型如何模擬特定的人類思維模式。
社群正質疑來自巴西團隊的「Rio」模型的起源及其聲稱的創新。人們持續擔心它究竟是真正的創新,還是僅僅是 Qwen 的重新包裝。

用戶更新 homelab 運行 Qwen3.5 和 GLM 系列的 LLM 神經解剖實驗。GH100 模組設備總成本 9000 美元,低於雲端隨需 10k 美元(每小時 3.50 美元)。慕尼黑高電費透過 Tasmota 和 Grafana 記錄。