
Elbit Systems 的 Tzayad 系統在近期衝突中識別出 85 萬個目標
Elbit Systems 透露,其 Tzayad 數位軍隊計畫在 2023 年 10 月至 2025 年底期間,於 Gaza 和 Lebanon 識別出 85 萬個潛在目標。該系統利用人員、車輛與物體的即時地圖繪製,以支援軍事指揮與控制行動。
The Guardian Technology · 75 天前
檢測、分割、OCR 與視覺理解——支撐機器人、自動駕駛與內容工具的感知層。
403 篇文章

Elbit Systems 透露,其 Tzayad 數位軍隊計畫在 2023 年 10 月至 2025 年底期間,於 Gaza 和 Lebanon 識別出 85 萬個潛在目標。該系統利用人員、車輛與物體的即時地圖繪製,以支援軍事指揮與控制行動。
The Guardian Technology · 75 天前

Safra Techno 正在開發一款步行輔助裝置原型,利用 AI 影像辨識技術來偵測障礙物。該專案致力於在長效電池續航力與輕量化設計之間取得平衡。
ITmedia AI+ (日本) · 75 天前

Merlin Bird ID 應用程式正透過將 AI 驅動的鳥類識別數據匯入 Cornell 的 eBird 平台來擴展其效用。此合作旨在透過公民科學建立一個監測鳥類族群的全球資料庫。
Digital Trends · 76 天前

Google 正在測試 reCAPTCHA 的「手勢驗證」(HGV) 功能,旨在透過手部動作辨識真人。然而,該系統已被證實可輕易透過照片進行欺騙攻擊。
cnBeta (Full RSS) · 76 天前

來自 UCL、伯明罕大學與金斯頓大學的研究團隊開發出一種非侵入式雷射成像技術,能即時追蹤活體小鼠體內的微塑膠。此突破為微塑膠在深層組織的遷移與累積提供了全新視角。
cnBeta (Full RSS) · 77 天前
AI 影片開發的重心正從視覺保真度轉向功能性智慧。下一代虛擬人將優先考慮「看」與「聽」的能力,從而實現更具互動性與情境感知能力的體驗。
The Next Web (TNW) · 79 天前

Berkeley Artificial Intelligence Research (BAIR) Lab 慶祝 2026 屆博士畢業生,展示了機器人技術、LLM 推理、電腦視覺與 AI 安全等領域的突破。這些研究人員正轉向學術界、工業實驗室及新創公司擔任關鍵職位。
Berkeley AI Research · 80 天前
開發者針對使用 APTOS 2019 資料集訓練的 5 類糖尿病視網膜病變模型,尋求解決預測不一致與類別混淆問題的建議。該專案為基於 Flask 的醫療 AI 系統,目前面臨領域偏移與高信心度錯誤預測的挑戰。
Reddit r/MachineLearning · 81 天前
開源專案 CVIL 擴展了其電腦視覺面試準備清單。除了現有的課程外,新增了針對 Segmentation、OCR 以及視覺語言模型 (VLM) 的專業學習路徑。
Reddit r/MachineLearning · 81 天前
一位 HEMA 劍術練習者正在建立一個高幀率的開源數據集,旨在解決電腦視覺在追蹤快速移動、被遮擋物體(如劍)時的挑戰。該專案旨在提升針對複雜高速物理運動的姿勢估計與軌跡預測能力。
Reddit r/MachineLearning · 82 天前
Euclid 太空望遠鏡捕捉到了銀河系中心的高解析度影像,揭示了超過 6,000 萬顆恆星。這些數據為天文研究提供了前所未有的清晰度。
Wired · 83 天前

百度發布了一款新的開源 OCR 模型,能夠一次處理如整本書籍般的巨量文字。據傳該專案由前 DeepSeek 研究員主導開發。
量子位 · 83 天前

一架配備熱成像技術的 AI 無人機在 Kosciuszko National Park 成功於五小時內定位兩名失蹤登山客。這是 FRNSW 的 AI 偵測系統首次在真實搜救任務中取得成功。
The Guardian Technology · 84 天前
CageSight 是一個利用機器學習模型自動分析 MMA 格鬥賽事的新平台。它能偵測如摔技、擊倒等特定位置與事件,並將其標記在可搜尋的時間軸上。
Reddit r/MachineLearning · 84 天前

澳洲新南威爾斯州消防與救援局(FRNSW)利用 AI 無人機,在五小時內成功定位並救援了兩名在 Kosciuszko 國家公園失蹤的登山客。這是該機構首次將此類技術應用於緊急搜救任務。
The Guardian Technology · 84 天前
Third Eye 是一個視覺地理定位專案,僅透過行車記錄器影像即可判斷車輛位置。它透過將影片幀與街景影像索引進行比對來繪製路徑,並透過幾何驗證確保定位的準確性。
Reddit r/MachineLearning · 85 天前

本文展示了如何在 Amazon SageMaker AI 上使用 SeedVR2 模型實現影片放大。內容提供了完整的解決方案架構說明與效能基準測試。
AWS Machine Learning Blog · 86 天前

Tesla Cybertruck 在強化前底盤結構後,成為首款獲得 IIHS「頂級安全優選+」評級的全尺寸皮卡。該車在多項碰撞測試中表現優異,並展現出卓越的行人防碰撞能力。
IT之家 · 86 天前

研究人員利用人工智慧技術,成功地在不損壞脆弱古物的情況下,虛擬展開並閱讀了因維蘇威火山爆發而毀損的古莎草紙卷。AI 成功揭示了 20 欄關於斯多葛哲學的文字內容。
The Guardian Technology · 87 天前
一位 Reddit 用戶分享了一份精心整理的 7 天準備清單,旨在幫助求職者順利獲得電腦視覺實習機會。該路線圖涵蓋了數學基礎、機器學習核心概念以及面試中常見的電腦視覺專題。
Reddit r/MachineLearning · 88 天前

倫敦警察廳將在聖誕節前將即時臉部辨識 (LFR) 技術擴展至倫敦西區。明年將進一步推廣至六個區域,引發隱私擔憂。
The Guardian Technology · 89 天前

Daihatsu 在滋賀(龍王)工廠導入 AI 品質檢測系統,自動化檢測鋁製加工孔內部。該系統與 VRAIN Solution 共同開發,旨在推動製造現場的數位轉型(DX)。
ITmedia AI+ (日本) · 89 天前
Daihatsu 導入了基於 AI 的系統,用於檢測變速箱零件內部的瑕疵。此解決方案取代了傳統依賴人工視覺與主觀判斷的檢測流程。
ITmedia AI+ (日本) · 89 天前

小田急電鐵正式啟用一套 AI 驅動的系統,用於偵測受困於平交道的人員。該系統能自動發出訊號使列車停止,並通知乘務員採取煞車措施。
ITmedia AI+ (日本) · 89 天前
WeightsLab 是一款全新的開源 PyTorch 原生工具,旨在協助電腦視覺工程師即時除錯訓練過程。它允許使用者暫停訓練以檢查損失訊號,並識別標籤錯誤、類別不平衡及異常值等數據問題。
Reddit r/MachineLearning · 90 天前

這是一個由社群驅動的 DVD-JEPA 演示改進,加入了環境噪聲以更好地展示模型忽略無關細節的能力。此次更新還包含與像素空間基準(pixel-space baseline)的公平對比,確保參數數量與計算預算相當。
Reddit r/MachineLearning · 90 天前

GLARE 是一個基於 LLM 的互動式介面,允許使用者使用自然語言查詢黑盒影像分類器的全域解釋。該系統將使用者查詢轉換為 SQL 以聚合局部解釋數據,並提供統計增強的回答與視覺化圖表。
ArXiv AI · 91 天前

Waymo 在其機器人計程車 13 次撞擊或駛入施工區後,已暫停其在高速公路上的營運。該公司目前正在重新評估其在複雜道路環境下的導航安全協定。
Digital Trends · 93 天前

KAIST 研究人員開發了「Upsample Anything」,這是一種從壓縮影像數據中恢復高解析度視覺特徵的方法。此方法透過避免預先處理全解析度影像,降低了智慧型手機的記憶體負擔。
Digital Trends · 93 天前

DeepSeek 已正式在網頁與 App 端推出多模態識圖功能。目前網頁端已可使用,但 App 端仍顯示該功能處於內部測試階段。
cnBeta (Full RSS) · 93 天前