🦙Reddit r/LocalLLaMA•最新收集於 6h
開源 Gemma 語音聊天可在 Jetson 上運行

#voice-agents#edge-inference#cuda#embedded-aicortexist-little-gemmacortexist little gemmagemma4jetson orinllama.cpprespeaker flex
💡了解開源 Gemma 語音代理如何在 Jetson 上結合本地推理、口型同步與手勢。
⚡ 30-Second TL;DR
有什麼變化
Gemma4 12B 運行於 RTX PRO 4500 Blackwell,Gemma4 E2B 則運行於 Jetson Orin NX 16GB。
為什麼重要
這顯示具備表情與互動能力的本地語音 AI,既能運行於桌面 GPU,也能運行於嵌入式 Jetson 硬體。開發者可在不依賴雲端推理的情況下,打造重視隱私的語音代理。
下一步行動
複製 Cortexist Little Gemma 儲存庫,並在 Jetson Orin 上將 Gemma4 E2B 與目前的 llama.cpp 語音管線進行效能基準測試。
誰應關注:Developers & AI Engineers
關鍵要點
- •Gemma4 12B 運行於 RTX PRO 4500 Blackwell,Gemma4 E2B 則運行於 Jetson Orin NX 16GB。
- •Cortexist Little Gemma 是以 C 撰寫的 CUDA 推理引擎,據稱在 Jetson Orin 上比 llama.cpp 更快。
- •整套管線包含 reSpeaker Flex 4 麥克風陣列、3W 喇叭、口型同步、表情與手勢。
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Reddit r/LocalLLaMA ↗
每週 AI 簡報
每週一封,可隨時退訂。

