OpenAI 支持俄亥俄州 PORTS-Pike 計畫
OpenAI 已加入 PORTS-Pike 計畫,擴大其社區投資。該計畫也支持南俄亥俄州數千個工作機會。
OpenAI News · 37 天前
OpenAI 已加入 PORTS-Pike 計畫,擴大其社區投資。該計畫也支持南俄亥俄州數千個工作機會。
OpenAI News · 37 天前
Harvard Business School 教授 Linda Hill 表示,隨著 AI 重塑企業營運,下一代 CEO 必須優先打造更具彈性的組織架構。領導者需要調整團隊協作、創新以及在企業內部署 AI 的方式。
Bloomberg Technology · 37 天前

中國 GPU 廠商營收快速成長、虧損收窄,但庫存與現金流壓力上升,顯示業界正激烈爭奪晶圓產能。產業正從政府主導的信創市場,轉向要求更高、且具持續採購需求的網路大廠市場。
虎嗅 · 37 天前

味之素冷凍食品透過 NEC 的 BestMove 導入 AI Persona,改善行銷團隊缺乏資料、技能與創意延伸能力的問題。這項案例展示了 AI Persona 如何支援行銷洞察與企劃發想。
ITmedia AI+ (日本) · 37 天前

AI 影片生成平台 Higgsfield 已從 DST Global、Goldman Sachs、Intel 等投資者籌得 4 億美元,估值達 54 億美元。公司計畫利用這筆資金拓展企業訂閱業務、提前鎖定算力資源,並強化企業級產品與安全能力。
IT之家 · 37 天前

中國機器人企業在 CES 2026 展示了多款先進原型,包括可爬樓梯與飛行的掃地機器人,以及外觀高度逼真的 Xpeng Iron 人形機器人。然而,出口限制與地緣政治緊張局勢,可能使美國消費者與企業無法取得這些產品。
SCMP Technology · 37 天前

文章提出一套更嚴格的電商 AI 模型評測理念。方法是從真實使用者需求定義任務,並透過仿真環境中的狀態驗證結果,而不是接受「差不多」的表現。
Ifanr (爱范儿) · 37 天前

文章指出,顯卡價格上漲的主因是顯存成本與供應受限,而不是 GPU 本身漲價。IDC 預估,2026 年 AI 資料中心將消耗全球 70% 的記憶體產能,而三大記憶體原廠已將 70% 至 90% 的先進產能優先配置給 HBM。
钛媒体 · 37 天前

《衛報》調查發現,Microsoft 宣稱的 AI 運算能力與其據報實際運作中的先進 AI 晶片數量之間,似乎存在落差。這項發現引發外界質疑,晶片供應是否可能限制 Microsoft 的 AI 開發與部署計畫。
The Guardian Technology · 37 天前

本研究探討「穩定失準」現象:大型語言模型產生自信但錯誤的答案,且在提示詞輕微變動下仍維持穩定。在多個領域與開放權重模型中,自我批判提示降低了隱藏狀態敏感度,但未能可靠區分自信錯誤與正確答案。
ArXiv AI · 37 天前

RubricForge 從少量具備真實結果標註的代理軌跡中,自動生成可讀的人類評分規範,之後可在不存取環境的情況下套用固定規範。在 tau-bench 與 WebShop 上,它大幅降低失敗軌跡被誤判為通過的比例,並改善分級結果排序;但整體一致性並未顯著優於 G-Eval。
ArXiv AI · 37 天前

這項研究提出一套主動感知框架,讓機器人透過改變觀察視角、蒐集缺失的視覺證據來解決目標歧義。Vision-language model 會判斷應繼續觀察、向使用者請求澄清,或完成目標選擇,且方法已在真實機器人上驗證。
ArXiv AI · 37 天前

這篇 arXiv 立場論文指出,聚焦於自主超人表現的 AI 評估,實際上默默將取代人類視為目標。論文主張改以人機團隊的整體表現進行評估,以建立能補足人類能力並帶來更佳社會成果的系統。
ArXiv AI · 37 天前

本研究發現,沒有任何推論時訊號能普遍預測更新後的 LLM 何時會比前一版本產生更差的答案。信心度在選擇題與較簡單數學任務上表現最佳,而 likelihood 與 KL 類訊號在困難數學及程式碼任務中更有用,也能支援選擇性回退至舊模型。
ArXiv AI · 37 天前

MobileMem 是一套評估個人 AI 助理裝置端長期記憶的基準測試與框架,使用長達一年的行動體驗資料。它透過文字與多模態設定,測試代理在時間推理、知識更新、多跳回憶及隱含偏好推論方面的能力。
ArXiv AI · 37 天前

一項涵蓋 46 項任務的電路分析發現,大型語言模型在語言、形式推理、社會推理與物理推理之間,發展出模組化的神經元組織。與人類大腦相同網路相關的任務會啟用重疊的 LLM 神經元,而不同領域則會招募較為獨立的神經元群。
ArXiv AI · 37 天前

Agentao 是一個以本機優先為核心的執行環境,將 LLM 產生的行動提案與主機授權的工具執行分離。它透過明確的權限、狀態管理、協定邊界與執行追蹤,讓使用工具的 Agent 更容易被檢查與控管。
ArXiv AI · 37 天前

一項新研究分析 Chutes 長達一年的生產環境 LLM 服務流量,涵蓋模型、使用者、時間變化與互動模式。研究團隊將公開完整追蹤資料,協助研究者進行更貼近真實情境的基準測試與服務系統研究。
ArXiv AI · 37 天前

這篇 arXiv 論文提出一套跨學科框架,用於理解 AI 中介互動中溝通偏差如何產生、擴大、被偵測及修復。研究辨識出分布於八個分析層次的 11 種失敗模式,並將分析從訊號傳輸形式化延伸至意義重建。
ArXiv AI · 37 天前

研究人員提出 Behavioral Consistency Metric(BCM),用於衡量語言模型 Agent 跨任務的行為一致性,而不只是評估是否成功。在約 9,000 條軟體工程執行軌跡上的測試顯示,跨任務一致性與重複嘗試時的一致性是兩種不同特性。
ArXiv AI · 37 天前
味之素為「味之素公園」官方 X 於 8 月 14 日發布的圖片致歉。該圖片經生成式 AI 加工後,造成「ほんだし」產品標籤與部分文字變形或錯亂。
ITmedia AI+ (日本) · 37 天前

Maniformer 完成新一輪數億元人民幣融資,由中國電信領投,張江集團及既有投資人跟投。資金將用於擴大 MEgo 硬體量產,並提升物理 AI 資料採集、治理、評測與全球供給能力。
雷峰网 · 37 天前

AI 劇日益被指控未經授權複製配音演員、遊戲角色、藝人及普通使用者的聲音與形象。權利人面臨訓練資料不透明、產業鏈責任分散、證據難以取得,以及賠償往往無法覆蓋維權成本等問題。
虎嗅 · 37 天前

Lagrange 正在汽車物流產線測試 Agentic OS,整合輪式雙臂機器人、機器狗與 AGV。其方法透過以任務為中心的工序重構與分層智慧架構,讓機器人監控結果、從故障中恢復,並完成端到端流程,而不只是執行單一指令。
雷峰网 · 37 天前

北京大學教授盧宗青創立的 BeingBeyond,正開發在 embedding space 中預測機器人動作與未來世界狀態的隱空間世界動作模型,而非生成像素畫面。其 Being-H0.8 將觸覺與視覺、動作及未來狀態預測結合,用於強化物理互動推理。
雷峰网 · 37 天前

文章宣告世界模型時代已經到來,顯示這一 AI 研究方向正受到越來越多關注。不過,提供的節錄未提及具體模型、公司、基準測試或技術證據。
钛媒体 · 37 天前
地瓜機器人的閉門 DemoDay 展示了十個早期專案,涵蓋具身 AI、智慧硬體、輔助機器人與 AI 陪伴產品。活動中的部分產品已可實際測試或開始出貨,包括 AI 高爾夫教練、跳躍機器人、膝關節外骨骼、跟隨式迷你皮卡與家用機器人。
极客公园 · 37 天前
OpenAI 正資助 14 項獨立研究計畫,探索 Intelligence Age 的新 AI 政策構想。這項倡議旨在隨著 AI 普及,擴大經濟機會並強化社會韌性。
OpenAI News · 37 天前

Intel Arc Pro B70 專業 GPU 在美國、德國與韓國的零售通路上漲幅介乎26%至48%。這款面向 AI 工作站的 GPU 配備32GB 記憶體,INT8 算力達367 TOPS,正因供應與需求受到關注。
cnBeta (Full RSS) · 37 天前