🦙最新收集於 8h

DeepSeek-V4 Flash Vision 在程式設計上超越 Qwen

PostLinkedIn
🦙閱讀原文: Reddit r/LocalLLaMA
#local-inference#quantization#model-comparison#coding-assistantsdeepseek-v4-flash-vision-q8deepseek-v4-flash-visionqwen3.8-flash-nextllamastrixhalo

💡原始速度不是全部:這項本地測試發現 DeepSeek 完成程式設計任務的速度快兩倍。

⚡ 30-Second TL;DR

有什麼變化

在相同量化等級下,DeepSeek-V4-Flash-Vision 的原始 token 生成速度約慢 40%。

為什麼重要

這份報告顯示,對本地程式設計助理而言,端到端任務完成速度與可靠性可能比原始 tokens/秒更重要。由於結果屬於個人觀察且受硬體影響,實務使用者仍應以自身工作負載驗證。

下一步行動

使用 DeepSeek-V4-Flash-Vision 與 Qwen3.8-Flash-Next 的 Q8_K_XL 版本執行相同程式設計任務,並同時測量完成時間、重試次數與正確性,而不只比較 tok/s。

誰應關注:Developers & AI Engineers

關鍵要點

  • 在相同量化等級下,DeepSeek-V4-Flash-Vision 的原始 token 生成速度約慢 40%。
  • 在 medium 模式下,它用 12 分鐘完成某項任務,而 Qwen3.8-Flash-Next 花了 25 分鐘。
  • 據報 Qwen3.8-Flash-Next 在 xhigh 模式執行近三小時後仍未完成任務。
  • 比較使用 Q8_K_XL 量化,硬體為兩張 StrixHalo 128GB。
  • 作者觀察到 Qwen 傾向過度解讀描述不完整的指令。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Reddit r/LocalLLaMA

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週 AI 簡報

每週一封,可隨時退訂。