
DeepStream 9 使用編碼代理建構視覺 AI 管道
NVIDIA DeepStream 9 使用如 Claude Code 或 Cursor 等編碼代理,簡化即時視覺 AI 應用程式的建置。它消除了複雜資料管道與冗長程式碼開發。開發人員現可輕鬆建立可部署的優化視覺 AI 程式碼。
Tag: #vision-ai14 results

NVIDIA DeepStream 9 使用如 Claude Code 或 Cursor 等編碼代理,簡化即時視覺 AI 應用程式的建置。它消除了複雜資料管道與冗長程式碼開發。開發人員現可輕鬆建立可部署的優化視覺 AI 程式碼。

特斯拉受監管 FSD 版本獲荷蘭 RDW 批准,在駕駛員監督下使用,成為歐洲首例。系統可在高速公路與城市道路執行轉向、加速與煞車,經 18 個月測試後確認提升安全。將先在荷蘭部署,並待歐盟投票後擴及更多國家。

NVIDIA 推出批次模式 VC-6,以加速視覺 AI 管線,使解碼、前處理及 GPU 排程匹配模型吞吐量提升。它解決先前 CUDA 加速 VC-6 文章提到的資料到張量差距。NVIDIA Nsight 有助優化這些管線階段。

Google 以 Gemini 3 更新 Circle to Search,可同時偵測並搜尋影像中多物件。支援服裝購物匹配包含配件並整合虛擬試穿,也能推理物件關係如珊瑚礁魚類共存。先推至 Galaxy S26 和 Pixel 10。
AI 先驅 Fei-Fei Li 的新創公司 World Labs 籌得 10 億美元資金。此資金將用於推進一種新穎的 AI 開發方法。

量子位實測訊飛智文 Vision Agent,宣稱生成完美 PPT 無需返工。此工具利用 AI 視覺功能實現無縫簡報製作。適合消除手動編輯幻燈片。
伊隆·馬斯克承認特斯拉HW3硬體因記憶體頻寬不足,無法實現無監督全自動駕駛,推出將延遲數年。這影響400萬HW3車主,提供HW4升級或折扣換新車等有限補償。特斯拉純視覺路線面臨批評,Waymo的多感測器融合更成功。

京東 JoyInside 平臺驅動創新 AI 硬體,如讓孩子畫作活起來、放大鏡識萬物及靈魂檯燈。它定位為 AI 硬體時代的超級基礎設施,將科幻概念帶入現實。

華盛頓大學團隊推出VueBuds,這是內嵌微型攝像頭的真無線耳機,結合視覺語言模型(VLM),可即時語音描述佩戴者視野中的畫面。功能包括辨識物體、翻譯文字,並支援語音互動。研究人員稱其為「移動端、純語音版的反向圖片搜尋」原型。

深圳 LDRobot 在獲 CSRC 批准後重新申請香港 IPO。公司 2025 年上半年營收 5290 萬美元,同時縮窄虧損。該公司自稱為全球最大視覺感知導向機器人企業。