
AI達成98%智商測驗成功率
研究人員提出自動關係推理框架,將物件關係推理自動化整合至神經網路中。此系統無需先驗知識即可零樣本解決智商題目,準確率達98.03%,相當於132-144智商分數。透過更多資料與先驗知識,可推廣至更廣泛問題。
直接匹配不多,已補上最新動態。
Tag: #reasoning-framework3 results

研究人員提出自動關係推理框架,將物件關係推理自動化整合至神經網路中。此系統無需先驗知識即可零樣本解決智商題目,準確率達98.03%,相當於132-144智商分數。透過更多資料與先驗知識,可推廣至更廣泛問題。

大型語言模型在無適當提示下無法解決洗車問題。對Claude 3.5 Sonnet的變數隔離研究顯示,單獨使用STAR框架即可將準確率從0%提升至85%。加入使用者檔案與RAG脈絡後,達成100%準確率。
FoT 推出通用框架,用於大型語言模型的動態推理方案,克服 Chain of Thought、Tree of Thoughts 和 Graph of Thoughts 的靜態結構限制。它具備超參數調整、提示優化、並行執行和快取功能,以提升效能。開源程式碼展示更快的執行速度、更低成本和更高的任務分數。

Eon 使用漏積分放電(LIF)模型,將果蠅大腦重建為數位系統。中國團隊據稱進一步採用精細神經元建模,以及支援跨身體遷移的平台,推進具身智慧研究。

據報導,UBTECH 已在 WRC 內以 1:1 比例重建客戶產線。此舉為具身智慧提供更實際的驗證與部署路徑,強調產線效能與系統整合,而非機器人出貨量。

Outer Biosciences 脫離隱身模式,開發出一套能讓手術切除的人類皮膚存活最長一個月的方法。該新創將組織產生的資料輸入 AI 模型,以預測可能有用的化合物,目前已籌得約 2,300 萬美元。

中國汽車製造商表示,受 AI 資料中心需求推動,印刷電路板與多層陶瓷電容器在全球短缺 20% 至 30%,價格已超過去年的三倍。汽車記憶體價格也在短短三個月內上漲約 180%。

Truffle Security 發現 768 組外洩的 AWS 金鑰,可對企業帳戶提供廣泛控制權,其中包括 526 組根金鑰。在受測憑證中,仍有 88% 處於啟用狀態;而 AWS 的隔離政策仍允許許多具破壞性的操作。

GDS Holdings 顯示,AI 相關資料中心訂單的增長速度快於已確認收入。這項趨勢反映需求強勁,但基礎設施擴建週期也使獲利延後。

TikTok 與 ByteDance 同意支付 4 億美元,和解美國司法部提起的案件;該案指控數百萬名未滿 13 歲兒童使用平台,且其資料在未獲家長同意下遭到蒐集。愛爾蘭監管機構也曾在 2023 年因兒童帳戶問題對 TikTok 罰款 3.45 億歐元。