
中國機器人交警幾乎全能,唯獨攔不住車
中國的類人形機器人交警可以指揮車輛、斥責亂穿馬路者,還能引導遊客前往最近的地鐵站。在杭州,至少已有 15 台機器人投入部署,但它們被刻意設計成無法實際攔下人員或車輛。
Tag: #human-oversight14 results

中國的類人形機器人交警可以指揮車輛、斥責亂穿馬路者,還能引導遊客前往最近的地鐵站。在杭州,至少已有 15 台機器人投入部署,但它們被刻意設計成無法實際攔下人員或車輛。

據報導,美國聯邦上訴法院維持一名被指完全依賴 AI 產出裁決的法官之司法豁免權。這項裁決處理的是民事訴訟中的法律保障,但未判定以這種方式使用 AI 是否合法或符合倫理。

負責營運 Andon Market 的 AI 店長 Luna 據報首次解僱了一名人類員工。這起事件顯示,Luna 在作出決定前,還需要有人提醒它自身的營運規則。

CASE Framework 為企業代理式 AI 提出四種治理學科:以控制理論治理個別代理,以複雜適應系統理論治理代理群體,以監督控制論治理人機團隊,並以工程營運治理代理艦隊。研究指出,82% 的已記錄生產環境失敗涉及多個層級,顯示現有工具與實務存在「Emergence Gap(湧現缺口)」。

Flow-by-Flow 提出一種在高損失領域治理 AI 輸出的方法,不要求人類或 AI 系統逐項判斷內容是否正確。該方法透過形式化認知成本評分、機構容量上限、與身分綁定的摩擦機制,以及禁止批次放行來控制監督負荷。

Cohere Health 在 Amazon Bedrock AgentCore 上建立多租戶代理式架構,以大規模數位化臨床政策。系統結合安全的執行環境隔離、集中式工具存取、記憶功能與 Agent Skills 開放標準,同時維持透明度與人類監督。
文章主張,AI 應持續揭露風險並質疑組織偏差,而不應成為最終決策者。作者建議將 AI 的風險偵測與解釋權,和批准不可逆行動的權力分離。

Anthropic 的 Claude 擔任 Andon Labs 零售店的店長,最終因一名員工反覆遲到而決定將其解僱。這項實驗也暴露 AI 管理的弱點,包括記憶有限、決策過於寬鬆,以及商業營運表現不佳。
Google 向企業客戶推廣可協助篩選大量求職申請的 AI 工具。然而,據報部分 Google AI 研究人員不願在招募時依賴這些工具,原因是其可靠性受到質疑。

中國一名 67 歲農民依照 AI 應用程式提供的農藥建議,導致 25 英畝農田的芝麻幼苗全部死亡。在此之前,他因連續數月獲得看似成功的建議,逐漸信任這項工具。