
中國 AI 黑板將手繪草圖變成 3D 模型
中國 AI 黑板可即時辨識手寫方程式、生成動態曲線,並將草圖轉換成可操作的 3D 模型。據稱該系統已在超過 300 個地市、1,400 多個區縣及 10 萬個以上班級中使用。
Tag: #multimodal-ai55 results

中國 AI 黑板可即時辨識手寫方程式、生成動態曲線,並將草圖轉換成可操作的 3D 模型。據稱該系統已在超過 300 個地市、1,400 多個區縣及 10 萬個以上班級中使用。

研究人員評估了 Gemini 2.5 Pro 解讀親子互動的能力。雖然該模型在基礎觀察方面表現出色,但目前仍缺乏在兒童發展溝通領域進行專家級判斷所需的細微差別。

Julie Elie 博士因成功繪製出斑胸草雀的 11 種核心鳴叫聲,獲頒 2026 年 Coller-Dolittle 獎。她的研究推動了跨物種溝通領域的發展,為解碼動物發聲提供了框架。

小米已將 Miloco 2.0 開源,這是一個先進的智慧家庭 AI 系統。它具備多模態感知、主動智能和長期記憶功能,可作為個人家庭管家。
DoorDash 推出了名為 Ask DoorDash 的 AI 聊天機器人。此功能允許使用者透過自然語言指令和照片來搜尋食物並建立購物車,無需再手動瀏覽餐廳與商店。

Google 推出「搜尋服務紀錄」設定,將收集來自 Google Lens、Search Live 和 Translate 的圖像、音訊與影片,用於訓練 AI 模型。使用者可透過帳戶設定關閉此功能以停止數據收集。

Amazon 為其行動應用程式更新了八項視覺搜尋功能,包括 Lens Live 與 Circle to Search。這些功能利用即時 AI 技術,旨在提升 iOS 與 Android 平台上的產品探索體驗。
前 Google Deepmind 研究員 Andrew Dai 創立了名為 Elorian 的 AI 新創公司。該公司目前專注於開發視覺推理能力,並正積極進行人才招募與融資計畫。

研究人員提出了一種使用 sticky factorial HDP-HMM 的輕量級框架,用於追蹤對話中的情緒弧線。透過分析多模態效價-喚醒度數據,該模型能比基於 LLM 的對話追蹤方法更有效率地識別持續性的情緒狀態。

Google Gemini 現在能掃描實體手寫筆記,並轉換成結構化的學習指南或閃卡。此功能可在數秒內將雜亂手寫轉為有組織的學習材料。它利用多模態 AI 快速提升生產力。