mlx-lm 即將支援 Qwen 3.5 的 MTP
mlx-lm PR 為 Qwen 3.5 系列新增多令牌預測 (MTP) 支援,吞吐量增 1.5 倍 (15.3 至 23.3 tok/s),接受率 80.6%。在 M4 Pro 上基準測試 Qwen3.5-27B 4-bit。早期實作對 Apple Silicon 使用者有顯著提升。
Tag: #apple-silicon187 results
mlx-lm PR 為 Qwen 3.5 系列新增多令牌預測 (MTP) 支援,吞吐量增 1.5 倍 (15.3 至 23.3 tok/s),接受率 80.6%。在 M4 Pro 上基準測試 Qwen3.5-27B 4-bit。早期實作對 Apple Silicon 使用者有顯著提升。
Mac Studio M3 Ultra 上,MLX Qwen3.5 在大上下文與代理任務提示處理極慢。最新 llama.cpp GGUF 提供遠優 PP 與穩定 TG,並有有效提示快取。用戶從 OpenCode MLX 切換至 llama.cpp,35B/122B 工作流順暢。

TinyCorp 開發適用 Apple 晶片 Mac 的 eGPU 擴展板,透過 Thunderbolt 轉 PCIe 連接 RTX 5060 GPU,用於 AI 大模型推理。提供約 40Gbps 頻寬與自訂 Python 驅動程式支援 ARM macOS。Q2 2025 上市,整合電源管理,專注純計算任務。

使用者開源了 Clarvis-AI,這是 OpenClaw 的發行版與技能,可透過語音進行 3D 模型搜尋、編輯、控制、切片與列印,而無需觸碰印表機。它在 MacBook Pro M1 的容器中運行,使用部分 API,並計畫在 Mac Studio 上實現完全本地化版本。

llama.cpp 第 8294 版在具 Apple A18 Pro 晶片與 8GB RAM 的 500 美元 MacBook Neo 上運行 Qwen3.5-9B Q3_K_M,提示速度達 7.8 個令牌/秒,生成功率 3.9 個令牌/秒。基準測試顯示 9B 模型可達 5 t/s,4B 模型達 10 t/s 配置。使用 Metal GPU 加速與特定超參數。

洩漏基準測試顯示蘋果 M5 Max MacBook Pro 單核(4,268)與多核(29,233)分數創紀錄,超越所有消費級 PC,適合 AI 與專業任務。預算版 MacBook Neo 分數 3,461/8,668,優於 M1 Air。所有型號支援 Apple Intelligence。
Apple 發布 M5 系列晶片,連同更新版 Studio Display 及新 MacBook 系列產品。Unihertz 亦推出全鍵盤 Titan 2 Elite 智能手機。此公告突顯 Apple 最新硬體進展。

蘋果發布兩款新 MacBook,AI 性能創紀錄。最強顯示器售價兩萬五。這凸顯蘋果進軍高端 AI 運算硬體的努力。

Apple 發表用於 MacBook Pro 的 M5 Pro 與 M5 Max 晶片,具 18 核心 CPU 採用 Fusion Architecture 雙 3nm 晶片整合。相較 M1 Pro/Max 提供最高 2.5 倍多執行緒效能。搭配最高 20 核心 GPU 與強化著色器。

Apple 意外推出 MacBook Air M5,搭載更強大的 M5 晶片,並將基礎儲存從 256GB 翻倍至 512GB。起價為 1,099 美元,比 M4 機型的 999 美元基礎價上漲 100 美元。最高儲存可達 4TB。