🦙Reddit r/LocalLLaMA•最新收集於 8h
DeepSeek-V4 Flash Vision 在程式設計上超越 Qwen
#local-inference#quantization#model-comparison#coding-assistantsdeepseek-v4-flash-vision-q8deepseek-v4-flash-visionqwen3.8-flash-nextllamastrixhalo
💡原始速度不是全部:這項本地測試發現 DeepSeek 完成程式設計任務的速度快兩倍。
⚡ 30-Second TL;DR
有什麼變化
在相同量化等級下,DeepSeek-V4-Flash-Vision 的原始 token 生成速度約慢 40%。
為什麼重要
這份報告顯示,對本地程式設計助理而言,端到端任務完成速度與可靠性可能比原始 tokens/秒更重要。由於結果屬於個人觀察且受硬體影響,實務使用者仍應以自身工作負載驗證。
下一步行動
使用 DeepSeek-V4-Flash-Vision 與 Qwen3.8-Flash-Next 的 Q8_K_XL 版本執行相同程式設計任務,並同時測量完成時間、重試次數與正確性,而不只比較 tok/s。
誰應關注:Developers & AI Engineers
關鍵要點
- •在相同量化等級下,DeepSeek-V4-Flash-Vision 的原始 token 生成速度約慢 40%。
- •在 medium 模式下,它用 12 分鐘完成某項任務,而 Qwen3.8-Flash-Next 花了 25 分鐘。
- •據報 Qwen3.8-Flash-Next 在 xhigh 模式執行近三小時後仍未完成任務。
- •比較使用 Q8_K_XL 量化,硬體為兩張 StrixHalo 128GB。
- •作者觀察到 Qwen 傾向過度解讀描述不完整的指令。
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Reddit r/LocalLLaMA ↗
每週 AI 簡報
每週一封,可隨時退訂。

