📲較早收集於 2m

Google 推出免費的 Mac 端側語音聽寫應用

Google 推出免費的 Mac 端側語音聽寫應用
PostLinkedIn
📲閱讀原文: Digital Trends

💡一個免費且以本地為主的雲端轉錄替代方案,挑戰了當前基於訂閱制的 AI 市場。

⚡ 30-Second TL;DR

有什麼變化

完全在裝置端運行,不依賴雲端服務

為什麼重要

此發布標誌著 AI 應用轉向「本地優先」的趨勢,挑戰了現有轉錄服務依賴訂閱制的商業模式。它展示了在消費級硬體上運行複雜語音轉錄模型的可行性。

下一步行動

下載並測試該應用,評估其裝置端轉錄的延遲與準確度,並與 OpenAI Whisper 等雲端 API 進行比較。

誰應關注:Developers & AI Engineers

關鍵要點

  • 完全在裝置端運行,不依賴雲端服務
  • 免除轉錄服務的每月訂閱費用
  • 專注於 macOS 用戶的隱私優先語音處理
  • 提供即時轉錄與文字潤飾功能

🧠 深度解析

Web-grounded analysis with 32 cited sources.

🔑 增強重點摘要

  • Google AI Edge Eloquent 最初於 2026 年 4 月在 iOS 平台推出,隨後於 2026 年 6 月擴展至 macOS,顯示其更廣泛的跨平台部署策略。
  • 該應用程式利用 Google 的 Gemma AI 模型(特別是 macOS 上的 Gemma 4 12B)進行裝置端處理,這些模型經過優化,可在本地設備上高效運行。
  • 除了基本的語音轉錄和文字潤飾,Eloquent 還提供多種文字轉換模式,例如將口語內容轉換為重點摘要、正式語氣、簡短訊息或長篇散文。
  • 它具備自訂詞典功能,用戶可選擇從其 Google 帳戶(如 Gmail)導入常用詞彙,以提高轉錄準確性,且此過程完全在裝置端進行,確保數據隱私。
  • 儘管核心功能完全離線運行,但用戶可選擇啟用雲端模式,以利用 Gemini 模型進行更進階的文字潤飾和增強功能。
📊 競品分析▸ Show
產品/服務平台處理方式定價即時聽寫文字潤飾/AI清理系統級整合自訂詞典檔案轉錄基準測試 (準確度/速度)
Google AI Edge EloquentiOS, macOS裝置端 (可選雲端)免費是 (移除贅詞、語法潤飾、多種風格轉換)否 (應用程式內)是 (可從Gmail導入)未提供具體數據
Apple 內建聽寫macOS, iOS裝置端 (Apple Silicon)免費否 (原始轉錄)是 (系統級)否 (無自訂詞彙)裝置端模型錯誤率低於2% (一般基準)
Whisper.cpp (開源)macOS (CLI)裝置端免費 (開源)是 (需技術操作)否 (原始轉錄)否 (CLI)高準確度 (基於 Whisper 模型)
SuperwhispermacOS裝置端 (可選雲端API)訂閱/一次性 ($249.99 終身)是 (核心功能)是 (AI清理)是 (系統級)是 (自訂模式)支援99%+ 準確度 (基於 Whisper 模型)
MacWhispermacOS裝置端一次性 ($29-$59)否 (基本)否 (原始轉錄)否 (應用程式內)是 (強項,含說話者分離)高準確度 (基於 Whisper 模型)
Otter.ai雲端雲端免費層 (有限制), 訂閱是 (會議摘要)是 (會議轉錄強項)未提供具體數據
Wispr Flow雲端雲端訂閱 ($15/月)是 (AI清理)是 (跨平台)是 (上下文感知)97.2% 準確度
Google 文件語音輸入雲端 (Google Docs)雲端免費否 (基本語音指令)否 (僅限Google Docs)良好準確度 (日常使用)

🛠️ 技術深入

  • Google AI Edge Eloquent 由 Google 的 Gemma AI 模型提供支援,特別是 macOS 上的 Gemma 4 12B 模型。
  • 該應用程式利用 Google AI Edge 平台,該平台包含 LiteRT(前身為 TensorFlow Lite),用於裝置端執行和硬體加速,支援 NPU、GPU 和 CPU。
  • Gemma 4 12B 模型被描述為具有 120 億個參數,專為代理式、多模態智慧而設計,能夠在配備 16GB RAM 的消費級筆記型電腦上運行。
  • 模型經過壓縮和優化,以適應行動裝置和邊緣處理環境,實現低延遲和即時轉錄。
  • 該應用程式提供即時語音轉錄,並帶有波形可視化功能,顯示音訊電平。
  • Google AI Edge 平台支援跨平台部署(Android、iOS、Web 和嵌入式設備),並與 JAX、Keras、PyTorch 和 TensorFlow 等多種框架兼容。

🔮 前景展望AI analysis grounded in cited sources

加速裝置端 AI 成為預設功能而非奢侈品
透過提供免費、高品質且注重隱私的裝置端解決方案,Google 對付費雲端服務和功能較弱的裝置端競爭對手施加壓力,使本地 AI 更普及和受期待。
顯著提升敏感聽寫任務的用戶隱私和數據安全
完全在裝置端處理確保了機密音訊和個人數據不會離開用戶設備,解決了雲端 AI 的主要隱私疑慮。
推動裝置端 AI 模型優化和硬體利用的進一步創新
Gemma 4 12B 等複雜模型在消費級硬體上的成功部署,證明了高效邊緣 AI 的可行性和需求,鼓勵了該領域的進一步發展。

時間線

2014-07
Google 推出「音訊記錄」功能,將語音搜尋錄音儲存於雲端伺服器,引發隱私疑慮。
2025-05
LiteRT(前身為 TensorFlow Lite)在 AI Edge 中被強調為實現最大性能和簡化的關鍵技術。
2025-09
Google AI Edge Gallery 推出,展示裝置端生成式 AI 模型,並支援音訊功能,可在 Google Play 上使用。
2026-02
Google AI Edge 被定位為一套全面的工具套件,旨在將高效能 AI 部署到行動、網路和嵌入式設備,包含 LiteRT、MediaPipe 和 Gemini Nano。
2026-03
Google AI Edge Portal(私人預覽版)支援 LiteRT 模型的 NPU、GPU 和 CPU 加速,協助裝置端機器學習基準測試。
2026-04
Google AI Edge Eloquent 悄然在 iOS App Store 上線。
2026-06
Google AI Edge Eloquent 於 macOS 平台推出,同時發布 Gemma 4 12B 模型和 macOS 版 AI Edge Gallery。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Digital Trends