Qwen 3.5-35B-A3B 在開發任務超越更大模型
用戶讚揚 Qwen 3.5-35B-A3B 取代 120B 模型為日常主力,體積僅 1/3。在 N8N 彙總、系統生成、視覺與程式碼分析等開發任務表現出色。以 unsloth Q4-K-XL 運行,支援 100k 上下文。
Tag: #local-llm172 results
用戶讚揚 Qwen 3.5-35B-A3B 取代 120B 模型為日常主力,體積僅 1/3。在 N8N 彙總、系統生成、視覺與程式碼分析等開發任務表現出色。以 unsloth Q4-K-XL 運行,支援 100k 上下文。
使用者報告 Qwen 3.5 在一般硬體上實現無監督代理編碼循環,超越先前本地模型。儘管基準未顯示重大躍進,但達成 4-6 小時無監督工作。這是本地 LLM 生產力的個人轉捩點。

Vellium v0.4 推出全新簡易模式,提供乾淨聊天介面、更新寫作工具如生成下一章,以及強化多角色模式用於角色扮演。支援 Ollama、KoboldCpp 等,提供滑桿視覺故事控制。開源桌面應用,使用 Electron、React、TypeScript 建置。
Apple 確認將於三月發布多款新品。Google 推出 Nano Banana 2。LM Studio 推出 LM Link 遠端連接方案,用於本地 LLM。
Reddit 用戶質疑 OpenClaw 的突然流行,稱其僅為內建大量預程式化函數呼叫的基本包裝器。他們認為新手一天內就能自製更輕量的工具。此貼文尋求社群對其熱度的解釋。

一則 Reddit 貼文引導讀者查看 ModelScope 上的 Qwen3.8-27B 頁面,以釐清模型的確切發布日期與時間。提供的內容未列出實際時間戳,因此仍應在連結頁面上確認細節。

一則 Reddit 貼文指出,Alibaba 上疑似出現 Nvidia RTX 5090 96GB 版本。該商品頁尚未獲得獨立驗證,因此產品真實性、規格與供貨情況仍不確定。

一名 LocalLLaMA 使用者分享了在 32GB Tesla V100 PCIe GPU 上,透過 llama.cpp 執行 Qwen3.6 27B 的設定,支援 128K 上下文與推測解碼。這篇文章主要是設定與效能交流請求,文字中提供了詳細參數,但沒有列出數值化的基準測試結果。
一名 LocalLLaMA 使用者正在尋找從 LM Studio 遷移至 llama.cpp 的經驗,包括設定需求、替代介面,以及大家偏好的 GUI 或 harness。這場討論突顯 LM Studio 的易用性與 llama.cpp 在本地模型服務彈性之間的取捨。
一名 Reddit 使用者提議建立網站,讓實作者分享詳細硬體配置,以及對應可行的 llama.cpp 參數。這類資料庫可能讓本機模型部署與效能調校更具可重現性。