
Qwen3.5-397B 無審查 NVFP4 發布
Qwen3.5-397B 的新無審查 NVFP4 量化版本已分享。在 Reddit r/LocalLLaMA 發布,附連結。可能實現巨型模型高效本地推理。
Tag: #qwen24 results

Qwen3.5-397B 的新無審查 NVFP4 量化版本已分享。在 Reddit r/LocalLLaMA 發布,附連結。可能實現巨型模型高效本地推理。

PhyDrawGen 是一個神經符號管道,透過結合基於 LLM 的場景理解與確定性幾何求解器,生成物理精確的圖表。它解決了生成式模型常見的力向量幻覺與幾何約束違規問題。

上海交通大學與 Qwen 團隊推出了 CodePercept,這是一種利用可執行代碼作為「第二語言」來提升 STEM 任務視覺感知的新範式。透過訓練模型生成能重現圖像的代碼,該系統克服了自然語言描述的模糊性。
Qwen3.6 35B A3B「異端」無審查版保留全部19個Native MTP,KLD 0.0015,僅10/100拒絕率。在HuggingFace提供Safetensors、GGUF、NVFP4、NVFP4 GGUF及GPTQ-Int4格式。基準測試確認各格式完整保留MTP。

ByteShape 發布 Qwen 3.5 9B 量化版本,並跨 5090/4080 等 GPU 及 CPU 基準測試。GPU 關鍵選擇:5.10 bpw 基準、4.43 bpw 平衡、3.60 bpw 快速。部落格提供互動圖表供硬體特定選擇;首波 Qwen 發布,後續更多。
ik_llama.cpp 分支在 RTX PRO 4000 上讓 Qwen 3.5 27B Q4_K_M 的提示評估快 26 倍 (43 至 1,122 tok/s),生成速 3.5 倍。融合 GDN 核心將圖形分割從 34 減至 2,全 GPU 利用。有預建 Windows 二進位檔作為直接替換。
開發者發布具視覺的去安全化 Qwen3.5-9B,使用二階段正交投影 + LoRA 方法達 0% 拒絕率。優於 heretic 版的 46% 拒絕。Ollama 與 Hugging Face 模型卡可用。
Qwen3.5-4B 模型的新無審查版本以 GGUF 格式發布,在 465 次測試中零拒絕。保留完整能力,支持多模態輸入,提供從 2.6GB 到 7.9GB 的各種量化版本。更大 Qwen3.5 尺寸的無審查版本正在開發中。

Qwen 3.5 Plus 現已在 Vercel 的 AI Gateway 上線,具備 1M 上下文視窗與內建自適應工具使用功能。它在代理工作流程、程式碼撰寫、網頁開發及多模態任務中表現出色,超越 Qwen 3 VL 在科學問題解決與視覺推理的效能。開發者可透過 AI SDK 設定模型為 alibaba/qwen3.5-plus 來使用。

Horus Hiero 是一款基於 Qwen 3.5 的新型開源多模態模型,專為翻譯古埃及象形文字而設計。它支援 150 種語言,並具備 512K 的超大上下文視窗。