
R2 上路,司機替滴滴買車的日子進入倒數?
滴滴自動駕駛已在北京與廣州部分示範區域,啟動新一代 Robotaxi R2 的無人載客測試。這款 L4 車輛可能改變滴滴長期依賴司機提供車輛、並承擔車輛閒置風險的模式,迫使平台自行承擔更多資本成本。
虎嗅 · 16 天前

滴滴自動駕駛已在北京與廣州部分示範區域,啟動新一代 Robotaxi R2 的無人載客測試。這款 L4 車輛可能改變滴滴長期依賴司機提供車輛、並承擔車輛閒置風險的模式,迫使平台自行承擔更多資本成本。
虎嗅 · 16 天前
韓國銀行預期,韓國在記憶體晶片產量方面對中國的領先優勢將進一步擴大。Samsung Electronics 與 SK Hynix 積極擴充國內廠房,是推動差距拉大的主要因素。
Bloomberg Technology · 16 天前

本文分析 Apple 為何能在 CEO 交接期間維持穩定,而 Intel、Microsoft 與 Google 卻曾因領導層更替陷入動盪。文章認為,差異不只在 CEO 個人,更取決於接班規劃、組織文化與治理機制。
虎嗅 · 16 天前

文章指出,AI 基礎設施的競爭正從單純爭奪算力,轉向爭奪與管理 Token。Token 調度層正成為串聯 AI 產業鏈、協調分散算力資源的核心樞紐。
钛媒体 · 16 天前
據報 Anthropic 正在 IPO 申請前敲定將循環信貸額度擴大至 150 億美元的計畫。Morgan Stanley 負責主導流程,而該公司可能在公開募股中尋求相當於 SpaceX 甚至更高的融資規模。
Bloomberg Technology · 16 天前
Qwen Office 上線首月用戶數突破 3,000 萬。企業用戶佔整體用戶超過一半,顯示其在商業場景中取得強勁的早期採用成果。
量子位 · 16 天前

文章探討 Horizon Robotics 如何在汽車產業激烈價格競爭中尋找新的商業機會。文章暗示,汽車產業可能正迎來類似「Android 時刻」的轉變,標準化且廣泛採用的技術平台將變得更加重要。
钛媒体 · 16 天前

文章分析兑吧從 SaaS 轉向 AI 生成短劇的策略,以及其價值重估背後的邏輯。文章將公司定位為港股 AI 短劇代表企業,並認為該產業正經歷工業化轉型。
钛媒体 · 16 天前

根據 Counterpoint Research,ChangXin Memory Technologies(CXMT)第二季已取得全球 DRAM 營收 10% 的市佔率。其市佔率高於去年同期的 4% 及前一季的 8%,成為市場成長最快的供應商。
TechNode · 16 天前

Tencent 推出 WorkBuddy 金融版,面向銀行、券商與保險公司提供超過 80 個金融專家及專家團。此舉緊隨 Baidu 的庫庫 AI 與 ByteDance 扣子進入金融研究場景,顯示通用 Agent 與深度垂直化企業產品之間的競爭正在升溫。
虎嗅 · 16 天前

文章聚焦一場持續 72 小時的 AI 巔峰競賽,指出程式設計仍是 AI 的核心能力。文章認為,AI 程式設計的競爭焦點正從交付程式碼,轉向完成端到端任務。
钛媒体 · 16 天前

AI 模型本身不會直接創造生產價值,企業還需要管理上下文、工具、狀態、權限與人工接管的 Harness 系統。當企業決定是否讓 AI 進入實際流程時,低成本驗收與清晰的責任設計往往比表面上的準確率更重要。
虎嗅 · 16 天前
鎂伽科技高階副總裁何源認為,AI for Science 應透過範圍明確且可驗證的實驗室流程擴張,而不是依賴完全自主工廠的宏大願景。真正困難的是整合異質儀器、讓機器人穩定運作、通過驗收測試,以及將客製化專案轉化為可重用模組。
虎嗅 · 16 天前
NVIDIA 推出 Personal AI Router(PAIR)測試版,這是一款免費開源、專為本地 AI 推理設計的虛擬路由器。它能在同一區域網路中發現相容電腦,整合閒置運算資源,支援 AI 代理與本地模型工作負載。
cnBeta (Full RSS) · 16 天前
CONFLICTGUI 基準測試揭示,多模態 GUI Agent 在指令彼此衝突或與介面情境不符時,容易出現偏向執行的過度服從。CONFLICTGUARD 加入可行性驗證與條件式行動調節,在維持一般任務表現的同時,提升衝突任務的成功率。
ArXiv AI · 16 天前
Speculative Macro Commit (SMC) 是一套執行時期系統,讓快速草稿模型預先執行多步驟工具操作鏈,同時由大型 Actor 模型保留最終決策權。在 τ²-Bench Telecom 子集上,相較於序列執行可降低 18.59% 延遲;在 AppWorld 上則降低 44.9%。
ArXiv AI · 16 天前
本研究提出一套提示工程框架,為 Jill Watson 等通用型 LLM/RAG 教學助理提供個人化能力。該框架結合六項學習者特徵與 Bloom’s Taxonomy,建立 96 種學習者輪廓,且不需重新訓練模型即可調整回應。
ArXiv AI · 16 天前
PlanFence 協定會根據建立計畫時所使用的確切共享紀錄,驗證代理即將執行的動作。在 30 個包含計畫後修訂的受控工作流程中,PlanFence 阻止了所有無效動作,而僅依賴資料新鮮度的驗證方式每次都失敗。
ArXiv AI · 16 天前
研究人員推出 NTEP-R,這是一套獎勵框架,用於監督代理式視覺語言模型的每次工具呼叫是否取得並利用必要證據。其 80 億參數實作 NTEP-8B 在七個圖像問答基準上提升了搜尋準確率與工具使用效率。
ArXiv AI · 16 天前
研究人員提出「敘事囚禁」這種失效模式:在多輪諮詢中,LLM 將未受質疑、為自己辯護的單方面說法視為完整資訊,並與敘述者的立場一致。在涵蓋 17 個 LLM 與 5,078 個人際衝突情境的測試中,模型判斷相較於配對的單輪基準平均偏移 25 個百分點。
ArXiv AI · 16 天前
Dude 是一套雙重偵測多代理系統,用於識別研究論文與程式碼實作之間的差異。其粒度對齊協商與兩階段顯著性過濾機制提升了召回率與精確率,相較基準方法最高可使 F1 分數提升 18.7%。
ArXiv AI · 16 天前
這篇 arXiv 研究提出一種受治理的企業分析方法:由 LLM 解讀問題,再由確定性政策選擇並執行預先核准的分析程式。在研究測試中,政策執行的分析器於 110 次測試中全部完成答案與證據契約;執行期規劃系統則沒有任何一次在所有資料集上完整達成要求。
ArXiv AI · 16 天前
這項研究提出 Provenance Density,透過介面視覺化文本中有多少主張受到驗證證據支持。在 81 名參與者的研究中,該介面顯著提升了辨識真實與捏造內容的能力;對 200 個樣本的技術稽核則發現,面對動態查詢時,一致性檢查比檢索密度更為關鍵。
ArXiv AI · 16 天前
DuplexSpeechBench-IFEval 提出包含 1,038 個測試案例的基準,用於衡量全雙工語音代理在八種助理角色中推斷並遵循隱性對話指令的能力。對六個系統的評估顯示,僅使用角色設定可能大幅降低對話輪次管理的遵循度,而安全衝突仍難以處理。
ArXiv AI · 16 天前
AutoGraphForge 是一套端到端流程,能生成、反駁、形式化並嘗試證明圖論猜想。最新執行產生了 6,522 個通過大量資料集與自動化檢查的猜想,並將 Lean 4 驗證與神經定理證明器整合至工作流程中。
ArXiv AI · 16 天前
一套全新的 AI 實用英語教科書透過自適應學習診斷學習者、生成任務、協調回饋,並支援教師管理。對 186 名大學生進行為期八週的原型測試後,相較於靜態電子教科書,系統提升了單元完成準確率與口說成績,也改善了教師工作效率。
ArXiv AI · 16 天前
RIZAP 表示,一名員工誤將客戶資訊上傳至其個人使用的外部生成式 AI 服務。公司已針對此事件致歉。
ITmedia AI+ (日本) · 16 天前

經濟學家 Lan Xiaohuan 討論中國的國家主導經濟模式、公共數據基礎設施、機器人與 AI,如何影響其經濟發展及與美國的競爭。訪談也涵蓋中國創紀錄的貿易順差,以及建立更強社會安全網的必要性。
SCMP Technology · 16 天前

Astro 推出由 Rust 驅動的 Markdown 與 MDX 處理器 Sätteri。據稱這項新工具可將建置速度提升最高 60%。
InfoQ中国 · 16 天前

機器人能夠成功移動只是第一步,更大的挑戰是將可靠的辨識結果整合進實際作業流程。在變電站、輸煤栈橋與大型書庫等場景中,工業 AI 必須多年持續提供準確且穩定的結果。
钛媒体 · 16 天前