
Apple 計畫在 App Store 上架 AI 代理
在 Siri 發展受挫後,據報導 Apple 正準備在 App Store 上架第三方 AI 代理。該公司目前正針對這些 AI 驅動的應用程式制定安全與審核流程。
Tag: #agentic-ai513 results

在 Siri 發展受挫後,據報導 Apple 正準備在 App Store 上架第三方 AI 代理。該公司目前正針對這些 AI 驅動的應用程式制定安全與審核流程。
Baidu Cloud 在 Create 2026 大會上宣布升級為以代理為中心的全端 AI 雲端平台。此次更新重點在於優化大規模代理部署的推理與訓練效率。

Anthropic 透過引入專用的「Agent SDK」額度系統,恢復了 Claude 訂閱用戶對 OpenClaw 等第三方 Agent 的支援。此舉將程式化 Agent 的使用與標準訂閱額度分開,以解決先前的容量負載問題。

根據 Ramp AI Index,Anthropic 的 Claude 在美國企業採用率上已超越 OpenAI 的 ChatGPT,達到 34.4% 的市佔率。此轉變主要歸功於 Claude Code 的快速成長,該工具已成為企業開發者首選的主流工具。

亞馬遜將全新的 AI 購物助手 Alexa for Shopping 整合至官網與 App 中。該助手具備智能推薦、價格追蹤與自動復購功能,並將取代原有的 Rufus 助手。

Hermes Agent 在開源社群中獲得顯著動能,三個月內在 GitHub 累積超過 14 萬顆星。該框架利用 NVIDIA RTX PC 與 DGX Spark,實現了自我優化的代理式 AI 工作流程。

新 arXiv 論文指出,現有 AI 基準測試無法衡量醫療保健真實工作流程中的可靠性、安全性及臨床相關性。先進模型在考試中表現出色,但在文件記錄(0.74-0.85)、臨床決策支援(0.61-0.76)及行政任務(0.53-0.63)上得分低落。呼籲建立原則性框架,以彌補效能與實用性差距。

微軟研究人員的 DELEGATE-52 基準測試 19 個 LLM 橫跨 52 個領域,揭示嚴重錯誤導致文件損壞。頂尖模型如 Gemini 3.1 Pro 在 20 次互動後丟失 25% 內容,所有模型平均劣化 50%。專家警告勿過度依賴 LLM 處理複雜工作流程,需加裝護欄。

Google 正在將主動式 Gemini Intelligence 自動化功能整合至 Android 裝置。此更新將於今年夏季開始推送,首波適用於 Galaxy 與 Pixel 手機使用者。