
Gemma 4 本地登陸 Android 手機
Gemma 4 現透過 Google AI Edge Gallery 應用程式在本機 Android 手機運行。連結推文示範確認裝置端推理能力。
Tag: #edge-inference33 results

Gemma 4 現透過 Google AI Edge Gallery 應用程式在本機 Android 手機運行。連結推文示範確認裝置端推理能力。

Strix Halo(Ryzen AI Max+ 395)基準測試 Minimax M2.5、Step 3.5 Flash、Qwen3-Coder-Next、GLM 4.6V/4.7 Flash 的量化版本,於 30k 上下文下運行。使用 llama.cpp 於 ROCm 7.2,配備 128GB RAM。可依需求測試更多模型。

硬體爆料人 Jaykihn 稱,Intel 可能正在為掌機開發低成本 Panther Lake 晶片。據傳該設計包含 4 個效能核心、沒有 E 核心、4 個低功耗效率核心,以及僅 4 個 Xe GPU 核心,而記憶體價格仍是主要變數。

Insta360 全新 X6 全景相機加入 AI Director,可在本地端於夜間分析素材並自動完成剪輯,隔天將 vlog 成片推送到手機。相機也支援頭追注意力輸入,以及利用 3D 高斯泼濺技術重建場景並自由探索。
Google 的 Pixel 11 採用更快的 Tensor G6 晶片、兩倍的基本儲存空間,以及更輕的設計。除了這些變化之外,這款入門旗艦與前代產品大致維持相同。
一項實驗展示了用於 MNIST 的一次性原型網路,僅使用984個可學習參數與10張支援影像。模型驗證準確率達62.46%,並在單一行動處理器 CPU 核心上約90秒完成訓練。

據報導,CXMT 的 LPDDR6 開發已接近最終階段。隨著記憶體價格持續上漲,新供應商可能為智慧型手機製造商提供更多選擇。

第二位分析師聲稱,Apple iPhone 18e 的 RAM 將從 8GB 增加至 9GB。這項不尋常的升級可能為裝置端 Apple Intelligence 功能提供更多記憶體空間。

小米 12 Pro(Snapdragon 8 Gen 1)改裝為 24/7 無頭 AI 伺服器,透過 Ollama 運行 Gemma4。設定包含 LineageOS 最大化 RAM、自訂熱管理和電池腳本,以及 LAN API 存取。腳本可供類似行動硬體轉用。

一位建造者為四肢癱瘓丈夫打造離線伴侶機器人,使用 8GB ThinkPad 運行 Mistral-7B-Instruct。整合 Jetson Nano 語音辨識與 Piper TTS。尋求 llama.cpp 優化建議,如量化與 zram。