
Google Photos 新增 AI 驅動的數位衣櫥功能
Google Photos 正在推出一項 AI 功能,讓使用者能將照片整理成數位衣櫥。此工具能讓使用者利用現有的照片庫進行服裝搭配。
Digital Trends · 108 天前
檢測、分割、OCR 與視覺理解——支撐機器人、自動駕駛與內容工具的感知層。
403 篇文章

Google Photos 正在推出一項 AI 功能,讓使用者能將照片整理成數位衣櫥。此工具能讓使用者利用現有的照片庫進行服裝搭配。
Digital Trends · 108 天前

Google 為 Nest 攝影機推出了「Pet Memory」功能,允許系統透過名稱識別並追蹤寵物。此功能凸顯了電腦視覺在消費級智慧家庭裝置中日益增長的整合度。
Digital Trends · 108 天前

研究人員正利用先進的 AI 模型來解讀受損且難以辨識的歷史文件。這項技術正在揭開那些過去被認為人類無法解讀的檔案庫中的秘密。
Digital Trends · 110 天前

Google Drive 推出了一款新的文件掃描工具,允許使用者以連續動作捕捉多頁文件。該功能包含自動影像校正以修復模糊,並內建重複檔案偵測功能。
Digital Trends · 112 天前
Potensic 正式發布 ATOM 3,這是一款 249 克重的旗艦無人機,配備 1/1.3 英寸感光元件與 AI 追蹤功能。該機型支援 4K 60fps HDR 錄影、50 分鐘續航及 16 公里圖傳距離。
36氪 · 121 天前

Service Stream 正在導入電腦視覺技術,以監控並驗證其分包商所執行的現場工作。此舉旨在透過提供自動化的工作證明,簡化付款流程。
iTNews Australia · 123 天前

本分析根據真實居家環境評估各種掃拖機器人的配置,強調效能取決於地板佈局與維護,而非單純的規格表。文章指出目前 AI 污漬檢測功能的侷限性,以及拖把設計對不同地板類型的影響。
The Verge · 123 天前
新加坡光學鏡頭製造商 MetaOptics 計劃赴美進行 IPO,預計募資 3,300 萬美元。
36氪 · 123 天前

本文探討了智慧型手機相機向自主 AI 攝影演進的趨勢。文章質疑 AI 是否真的能具備「攝影眼」,在無需人工干預的情況下捕捉影像。
Ifanr (爱范儿) · 124 天前

Adrienne Murray 探討了尖端 3D 影像技術如何協助外科醫生進行複雜的心臟手術。此發展凸顯了先進視覺化工具在醫療診斷與手術中的整合應用。
BBC Technology · 127 天前

據報導,Oppo 與 Vivo 正開發手持雲台相機,旨在與 DJI Pocket 系列競爭。這些設備將利用兩家公司在影像演算法與 AI 功能上的優勢,搶攻輕量化影片創作市場。
TechNode · 127 天前
使用者分享 150k+ 糞便影像資料集,用於訓練電腦視覺模型,詳述 Bristol 類型、一致性及血跡等標註的手動驗證流程。他們迭代訓練經驗證資料,並尋求可擴展工作流程建議。
Reddit r/MachineLearning · 136 天前
一位 AI/電腦視覺博士生無法匹配論文 77% 準確率基準,重現僅達 73%,已詳查程式碼、前處理、超參數及種子。作者未回覆詢問。
Reddit r/MachineLearning · 137 天前

Internet Matters 報告顯示,32% 的英國 9 至 16 歲兒童承認繞過社交媒體及成人內容的年齡驗證。方法包括假鬍子、VPN 及家長帳戶。
cnBeta (Full RSS) · 138 天前

倍耐力與Univrses合作持股30%,強化Cyber Tyre內嵌感測器與AI電腦視覺。系統提供精準車輛定位、3D地圖與環境感知,用於駕駛輔助。
IT之家 · 138 天前

Google 相簿推出虛擬試衣功能。使用者可註冊照片中偵測到的衣物,並在 App 中直接混搭服裝。
ITmedia AI+ (日本) · 141 天前

倍耐力收購瑞典 AI 公司 Univrses 30% 股份,將 3D 電腦視覺整合至 Cyber Tyre 智慧輪胎。結合提升車輛安全、自動駕駛及即時道路監測。
IT之家 · 143 天前
Ace 是一款專為對戰真人玩家設計的乒乓球機器人。它即時讀取球的軌跡、精準調整球拍角度,並以維持連續對戰的擊球回應。
Wired AI · 147 天前

商湯首席科學家林達華獲頒中銀香港科創獎。其論文引用逾9萬次,肯定其AI研究貢獻。
量子位 · 150 天前

Google Photos 在其圖像編輯器中推出臉部微調工具,用於細微增強。使用者可移除瑕疵、美白牙齒、平滑肌膚,並調整虹膜、眼下區域、眉毛和嘴唇。
The Verge · 152 天前

Spotify 透過與 Bookshop.org 合作,在美國與英國推出實體書銷售,利用 app 中有聲書頁面的聯盟連結。Page Match 功能可掃描書頁與有聲書同步,現支援超過 30 種語言。
The Next Web (TNW) · 157 天前

Guidesly 使用 AWS Lambda、Step Functions、S3、RDS、SageMaker 與 Bedrock 開發 Jack AI。攝取行程媒體、增添脈絡、應用電腦視覺與生成式 AI,並大規模發布內容。
AWS Machine Learning Blog · 158 天前
Reddit 用戶正在打造眾包智慧手機照片平台,使用 YOLO/CLIP 自動標註並新增 40+ 元資料欄位,向機器學習社群徵詢目前最缺的影像/影片資料集。範例包括歐洲街景、超市貨架 OCR 價格、類比電錶、餐廳菜單、EV 充電站。
Reddit r/MachineLearning · 162 天前

英國18歲以下兒童去年透過Report Remove通報394宗性勒索案件,比2024年上升34%。倡議者要求手機安裝裸照偵測技術,以對抗分享性影像後遭勒索。
The Guardian Technology · 166 天前

Meta 為 Ray-Ban Display 智能眼鏡推出第二個重大更新,新增基於 AI 的食物照片營養追蹤、WhatsApp 訊息摘要及螢幕錄製功能。步行導航擴展至全美,並新增印地語等語言即時翻譯,今年夏季支援中文。
IT之家 · 166 天前

新一代小米 SU7 車外攝像頭內置 ALD 鍍膜,抑制逆光或遠光眩光,提升 ADAS 目標辨識與泊車準確度。鍍膜內置,外層硬質防水膜防磨損清潔。
IT之家 · 167 天前

Rubin 天文台團隊利用華盛頓大學軟體的高級演算法,發現了 11,000 顆新小行星。此軟體加速處理龐大影像資料中小型太陽系物體的偵測。
GeekWire · 169 天前

iOS 應用程式透過 CPU 上的決定性 CV 實現即時 1080p 30fps 去霧,零延遲。團隊探索選用量化 ML(U-Net/MobileNet 經 CoreML)以改善嚴重退化畫面的物件完整性。
Reddit r/MachineLearning · 170 天前
馬斯克在社交平台表示,特斯拉 FSD 14.3 目前已進入員工測試階段。該版本預計本週末正式發布。
36氪 · 171 天前
這篇 Reddit 貼文主張機器學習中的資料增強常被啟發式使用,建議將每個轉換視為不變性假設。它討論任務特定有效性、最佳強度及腐蝕訓練訊號風險等挑戰,以電腦視覺為例。
Reddit r/MachineLearning · 176 天前