Kimi連續融資超12億美元,估值翻倍突破100億美元
月之暗面Kimi在完成上一輪5億美元融資僅一個多月後,即將完成超7億美元新一輪融資,由阿里、騰訊、五源、九安等老股東聯合領投。最新估值100-120億美元,直接翻倍突破100億美元大關。
36氪 · 214 天前
月之暗面Kimi在完成上一輪5億美元融資僅一個多月後,即將完成超7億美元新一輪融資,由阿里、騰訊、五源、九安等老股東聯合領投。最新估值100-120億美元,直接翻倍突破100億美元大關。
36氪 · 214 天前

歐洲議會透過電子郵件通知所有議員及員工,禁用公務設備上的內建AI功能。擔憂源自雲端服務處理資料的安全漏洞。
cnBeta (Full RSS) · 214 天前

人形機器人在2026春晚舞台上講笑話、演小品、舞劍、跳街舞、雙截棍、高空翻、打醉拳,並與人類自然互動。相較一年前的顫巍亮相,動作更花哨。
cnBeta (Full RSS) · 214 天前

2026央視春晚充斥具身智能與機器人,從舞美到視效與表演皆有。繼2025產業爆發,此屆為史上最具科技含量。
cnBeta (Full RSS) · 214 天前

Unity plans to launch a Unity AI beta at GDC in March, enabling natural language prompts to create full casual games without coding. The tool leverages top LLMs and Unity's platform context for seamless prototyping to production.
IT之家 · 214 天前

Unity plans to launch a Unity AI beta at GDC in March, enabling natural language prompts to create complete casual games without coding. The tool integrates top LLMs and custom models to streamline prototyping to production.
IT之家 · 214 天前

SpaceX及其全資子公司xAI正參與五角大樓機密競賽,開發語音控制的自主無人機群技術。馬斯克近期宣布合併兩家公司,進軍AI賦能武器領域。
cnBeta (Full RSS) · 214 天前

美光科技計畫斥資2000億美元興建新廠,以因應40年來最嚴重的儲存晶片短缺。此舉針對AI記憶體瓶頸,為智慧手機、汽車電腦、筆電及資料中心提供資料儲存支援。
cnBeta (Full RSS) · 214 天前

宇樹科技的人形機器人在春晚舞台上表演。Unitree官方發布的相關視頻在不到10小時內播放量近10萬。
cnBeta (Full RSS) · 214 天前
截至2月17日13時04分,2026春節檔(2月15日-2月23日)總票房(含預售)突破10億。千問數據顯示,過去兩天用戶透過AI在大麥買電影票訂單環比增長372倍。
36氪 · 214 天前

特斯拉 8 個月前於奧斯汀推出的 Robotaxi 無人出租車服務,目前可用率僅 19%。遠未達到馬斯克此前的承諾。
cnBeta (Full RSS) · 214 天前

A report dismisses tech industry claims that AI can fix climate issues as greenwashing. Most references are to traditional machine learning, not energy-intensive generative AI like chatbots and image tools.
The Guardian Technology · 214 天前
X-Blocks 提出一個階層式框架,分析自動駕駛車輛 (AVs) 自然語言解釋的脈絡、句法與詞彙層級。RACE 是一個多 LLM 集成框架,結合思考鏈與自一致性機制,在 Berkeley DeepDrive-X 資料集上達到 91.45% 準確率。
ArXiv AI · 214 天前
VeRA 將基準問題轉換為可執行規格,包括模板、產生器和驗證器,以近零成本生成無限驗證變體。VeRA-E 產生等價問題以偵測記憶化,VeRA-H 則強化任務創造新挑戰。
ArXiv AI · 214 天前
VeRA is a framework that transforms static benchmark problems into executable specifications for generating unlimited verified variants. It features VeRA-E for equivalent rewrites to detect memorization and VeRA-H for hardened tasks at intelligence frontiers.
ArXiv AI · 214 天前
VaryBalance 透過利用人類文本與其 LLM 重寫版本之間的更大變異(相較於 LLM 文本)來檢測 LLM 生成文本。它使用平均標準差來量化此差異,從而穩健區分人類與 AI 文本。
ArXiv AI · 214 天前
AI系統在長時程適應性上停滯不前,並非因資料或容量不足,而是軌跡層級的帕雷托陷阱所致。本文提出軌跡主導的帕雷托最佳化,將支配性定義為完整軌跡,並將帕雷托陷阱視為阻礙全球最佳路徑的局部最優。
ArXiv AI · 214 天前
SSLogic 是一個代理式元合成框架,透過迭代的生成-驗證-修復迴圈,在任務家族層級擴展邏輯推理任務,合成 Generator-Validator 程式對。採用多閘驗證協議,結合多策略一致性檢查與對抗性盲審,由獨立代理撰寫並執行程式碼以過濾問題任務。
ArXiv AI · 214 天前
SELFCEST 透過代理強化學習,讓基礎語言模型能在並行上下文中生成相同權重的克隆。訓練採用端到端方式,使用全域任務獎勵與共享參數 rollout 來分配分支預算。
ArXiv AI · 214 天前
PlotChain 推出一個確定性基準,用於評估多模態 LLM 從工程圖表(如 Bode 和 FFT)中提取定量值。它包含 15 個家族的 450 個圖表,配備地面真相和檢查點診斷以分析失敗。
ArXiv AI · 214 天前
NL2LOGIC 是一種新框架,使用抽象語法樹(AST)透過大型語言模型將自然語言轉譯為一階邏輯。它結合遞迴 LLM 語義解析器與 AST 引導生成器,實現高語法準確度和語義忠實度。
ArXiv AI · 214 天前
MAPLE 將 LLM 代理的限制分解為記憶、學習與個人化三個專屬子代理。記憶負責儲存與擷取,學習非同步從互動中提取洞見,個人化則即時應用於有限脈絡預算中。
ArXiv AI · 214 天前
Lang2Act 透過自湧現語言工具鏈提升視覺語言模型 (VLM) 在 VRAG 中的精細視覺感知,避免僵硬外部工具及影像操作造成的資訊損失。它採用兩階段 RL 框架:第一階段建構可重用動作工具箱,第二階段用於推理。
ArXiv AI · 214 天前
研究人員提出LLM幻覺的幾何分類法,將其分為三類:不忠實(忽略上下文)、捏造(發明語義外內容)和事實錯誤(正確框架內錯誤)。基準測試幻覺具領域本地檢測力(AUROC 0.76-0.99),跨領域僅隨機水平;人類捏造則可用單一全球方向達0.96 AUROC。
ArXiv AI · 214 天前
一種無需訓練的雙循環對抗自演化框架解決了LLM角色扮演代理的越獄漏洞問題。它耦合了針對角色的攻擊者循環以產生更強越獄提示,以及角色扮演防禦者循環將失敗提煉成階層式安全知識庫。
ArXiv AI · 214 天前
DPBench 推出一個基準測試,用哲學家用餐問題評估 LLM 多代理協調,涵蓋八種變化決策時機、群組大小和通訊的條件。對 GPT-5.2、Claude Opus 4.5 和 Grok 4.1 的測試顯示順序設定表現良好,但同時設定死鎖率超過 95%,因代理收斂推理導致。
ArXiv AI · 214 天前
BotzoneBench 提供可擴展框架,利用固定技能校準遊戲 AI 階層評估 LLM 在遊戲中的策略推理能力。它避免 LLM 對戰賽的二次方成本與不穩定性,提供絕對線性時間測量。
ArXiv AI · 214 天前
BotzoneBench introduces a scalable framework for evaluating LLMs' strategic reasoning in interactive games using fixed hierarchies of skill-calibrated game AIs. It assesses five flagship models across eight diverse games via 177,047 state-action pairs, revealing performance gaps and behaviors comparable to mid-tier game AIs.
ArXiv AI · 214 天前
研究人員推出 AST-PAC,這是針對程式碼大型語言模型的會員推斷攻擊中 PAC 的語法感知適應版本。它使用基於 AST 的擾動產生有效的校準樣本,在較大檔案上優於基準,但在小型或富含字母數字的程式碼上有限制。
ArXiv AI · 214 天前
AMOR是一種受雙過程認知理論啟發的混合模型,僅在SSM預測顯示高熵不確定性時動態啟用稀疏注意力。它從SSM狀態投影Ghost KV以實現O(n)效率,在檢索任務上超越純SSM和Transformer基準,以僅22%注意力位置達到完美準確率。
ArXiv AI · 214 天前