
商湯轉向生成式 AI 後首次預計盈利
SenseTime 預計將實現上市以來首次合併盈利,預測 2026 年上半年利潤約為人民幣 5 億至 7 億元。這項轉變來自其從專案型電腦視覺服務,轉向生成式 AI 與模型驅動業務。
虎嗅 · 33 天前
檢測、分割、OCR 與視覺理解——支撐機器人、自動駕駛與內容工具的感知層。
403 篇文章

SenseTime 預計將實現上市以來首次合併盈利,預測 2026 年上半年利潤約為人民幣 5 億至 7 億元。這項轉變來自其從專案型電腦視覺服務,轉向生成式 AI 與模型驅動業務。
虎嗅 · 33 天前

隨著AI網球機器人從預設發球機進化為自適應訓練陪練,中國機器人新創正吸引大量融資。Pongbot、英漢思、Acemate等產品運用電腦視覺、感測器、運動控制與AI演算法追蹤球員、調整擊球,並嘗試自主接球回擊。
虎嗅 · 38 天前

分析師兼投資人 Gary Black 認為,Tesla 正在收縮自動駕駛發展抱負,削弱投資人對其實現技術突破的信心。他表示,無人監督 FSD 與 Robotaxi 部署進度放緩,可能反映更深層的根本問題。
cnBeta (Full RSS) · 38 天前

FCC 正提議追溯禁止銷售先前已獲批准、搭載 LiDAR 與其他被其歸類為軍用等級功能的外國製無人機。這項提案可能影響多款熱門 DJI 型號、熱成像無人機,以及用於燈光秀的協同無人機群。
Tom's Hardware · 41 天前

美國公司 Auterion 提供 AI 能力,讓烏克蘭的低成本自殺式無人機能夠自主追蹤目標。一項價值 1 億美元的交易將為 5 萬架烏克蘭無人機配備這項美國開發的技術。
Ars Technica AI · 47 天前
開發者正在尋求一種具成本效益且結合人機協作的流程,將靜態學術教科書圖表轉換為結構化、可編輯的數位資產。目標是偵測圖表、移除現有標籤並保留底層圖像,以供前端渲染使用。
Reddit r/MachineLearning · 48 天前

據報導,主要手機製造商計畫在 2025 年採用 1:1 方形前置鏡頭感測器,以提升數位變焦效果並改善橫豎屏切換時的畫質。此舉跟進了 Apple 在 iPhone 17 系列中的技術應用。
IT之家 · 48 天前

商湯 U1 Pro 模型展示了透過單次拍攝輸入生成全景賽況圖的能力,突顯了該模型在處理複雜體育賽事視覺數據方面的潛力。
Ifanr (爱范儿) · 61 天前

Google 在 Gboard 中整合了手語識別功能,標誌著鍵盤從單純的輸入工具轉型為多模態 AI 平台。此舉不僅提升了無障礙體驗,也展示了將複雜的電腦視覺任務整合至日常行動介面的能力。
钛媒体 · 61 天前

Google 支持的 FireSat 計畫已發射一組新型衛星,旨在以比現有系統更高的精度偵測野火。此計畫旨在提供即時數據,以協助減輕北美地區野火帶來的影響。
Ars Technica AI · 64 天前

Amazon 旗下的 Zoox 宣布召回 105 台自動駕駛計程車的軟體,原因是感知系統無法識別濃煙。此漏洞導致車輛會駛入危險的濃煙覆蓋區域,公司已向 NHTSA 提交報備。
cnBeta (Full RSS) · 64 天前

Apple 研究人員推出了 Visual Concept Inference from Sets (VICIS),這是一項旨在評估視覺語言模型從少量圖像集中推斷共享概念能力的新任務。研究顯示,目前的頂尖模型在將這些視覺概念應用於新的、未見過的輸入時表現不佳。
Apple Machine Learning · 64 天前

本文詳細介紹了 IMU 感測器、半自動越位系統 (SAOT) 及穿戴式攝影機在職業足球賽事中的應用,並探討了 AI 演算法如何處理海量空間數據以輔助裁判判決。
虎嗅 · 66 天前
開發者針對訓練 3,000 張藝術品影像的單類別分割模型,尋求最佳即時數據增強策略。目標是模擬真實的人手操作變異,以提升邊界分割準確度,同時不犧牲模型效能。
Reddit r/MachineLearning · 67 天前

Henry Schein One 使用 Amazon SageMaker 實作了一套 AI 驅動的品質驗證系統,用於即時評估牙科 X 光影像。該系統目前支援超過 10,000 個據點,並正擴展至全球 40,000 個據點。
AWS Machine Learning Blog · 71 天前

自 7 月 7 日起,歐盟要求所有新製造的乘用車與廂型車必須配備先進駕駛輔助系統。這些強制規定包含駕駛分心警示系統,以及能偵測行人與騎士的緊急煞車功能。
The Next Web (TNW) · 72 天前
開發者指出在細粒度汽車分類任務中,DINOv2 使用 k-NN 的表現顯著落後於 SigLIP2。討論探討了 DINOv2 的自監督特性是否需要額外的訓練層,而非僅依賴原始嵌入進行檢索。
Reddit r/MachineLearning · 73 天前

一套全新的AI步態識別系統使安全攝影機得以根據個人獨特的行走模式進行辨識。當臉部辨識因光線不足、距離過遠或遮擋而失效時,此技術提供了一種可靠的替代方案。
Digital Trends · 73 天前

Meta 在 AI 圖像生成排行榜上的排名有所提升,顯示其生成式模型能力取得顯著進展。此更新凸顯了 Meta 持續致力於與頂尖圖像合成模型競爭的決心。
The Neuron · 73 天前

Discord 承認其 AI 審核系統出現錯誤,自 5 月以來將試算表、棋盤等無害圖像誤判為違規內容,導致超過 8,000 個帳號被錯誤封禁。
TechCrunch AI · 74 天前

Discord 的自動化安全系統錯誤地封禁了超過 8,000 個帳號,原因僅是這些用戶上傳了包含網格的圖片(如棋盤或遊戲紋理)。Discord 已解封所有受影響用戶,並承認其內容審核流程存在技術故障。
The Verge · 74 天前

openJiuwen 推出了全新的多模態範式 Skill-Omni,讓 AI 代理能夠從視覺數據而非僅僅是文字說明書中學習。此轉變使代理能夠建立更直觀且全面的經驗庫。
量子位 · 74 天前

總部位於杭州的 Diagens 正式發布了 iMedLoop,這是一個全面的醫學影像數據平台。該計畫旨在構建全鏈條醫療 AI 生態系統,以提升診斷效率。
Pandaily · 74 天前

一名加拿大駕駛在時速 100 公里下使用特斯拉 FSD 時睡著,並透過佩戴墨鏡規避了駕駛監控系統。此事件凸顯了視覺監控系統在眼部被遮擋時的侷限性。
IT之家 · 74 天前

Elbit Systems 透露,其 Tzayad 數位軍隊計畫在 2023 年 10 月至 2025 年底期間,於 Gaza 和 Lebanon 識別出 85 萬個潛在目標。該系統利用人員、車輛與物體的即時地圖繪製,以支援軍事指揮與控制行動。
The Guardian Technology · 75 天前

Safra Techno 正在開發一款步行輔助裝置原型,利用 AI 影像辨識技術來偵測障礙物。該專案致力於在長效電池續航力與輕量化設計之間取得平衡。
ITmedia AI+ (日本) · 75 天前

Merlin Bird ID 應用程式正透過將 AI 驅動的鳥類識別數據匯入 Cornell 的 eBird 平台來擴展其效用。此合作旨在透過公民科學建立一個監測鳥類族群的全球資料庫。
Digital Trends · 76 天前

Google 正在測試 reCAPTCHA 的「手勢驗證」(HGV) 功能,旨在透過手部動作辨識真人。然而,該系統已被證實可輕易透過照片進行欺騙攻擊。
cnBeta (Full RSS) · 76 天前

來自 UCL、伯明罕大學與金斯頓大學的研究團隊開發出一種非侵入式雷射成像技術,能即時追蹤活體小鼠體內的微塑膠。此突破為微塑膠在深層組織的遷移與累積提供了全新視角。
cnBeta (Full RSS) · 77 天前
AI 影片開發的重心正從視覺保真度轉向功能性智慧。下一代虛擬人將優先考慮「看」與「聽」的能力,從而實現更具互動性與情境感知能力的體驗。
The Next Web (TNW) · 79 天前