Search

Tag: #context-window28 results

⚙️

為 16GB VRAM 調校 Qwen3.8

一名 LocalLLaMA 使用者分享了在 Windows 上,於約 16GB VRAM 內執行 Qwen3.8 27B IQ4-XS-MTP GGUF 模型的配置。該設定透過將多模態元件與特定張量移至系統 RAM,以量化品質與速度換取 90K–100K 的上下文視窗。

Reddit r/LocalLLaMACommunity5h ago#16gb-vram#gguf#model-quantization
GLM 5.3 登陸 AI Gateway

GLM 5.3 登陸 AI Gateway

Z.ai 的 GLM 5.3 現已透過 Vercel AI Gateway 提供,相較 GLM 5.2,在複雜軟體工程、多步驟代理任務與漏洞探索方面有所提升。開發者可使用 `zai/glm-5.3` slug,並將其整合至 Claude Code、Codex、OpenCode、Cursor 與 Pi 等程式設計代理。

Qwen 3.5 397B 以低成本擊敗萬億參數模型

Qwen 3.5 397B 以低成本擊敗萬億參數模型

阿里巴巴推出 Qwen3.5-397B-A17B,這款開源權重 MoE 模型擁有 3970 億總參數,但每 token 僅激活 170 億,基準測試超越自家萬億參數 Qwen3-Max。它在 256K 上下文長度下解碼速度快 19 倍,運行成本降低 60%,並從頭訓練具備原生多模態能力,涵蓋文字、圖像與影片。託管版本支援高達 100 萬 token。

騰訊開源 295B Hy3 混合專家模型

騰訊開源 295B Hy3 混合專家模型

騰訊開源 Hy3 預覽版,這是一個擁有 295B 參數的混合專家模型,具備 256K 上下文窗口。此發布結束了一週的忙碌,包括 3D 世界模型以及 QClaw 消費代理的全球 Beta 版。這突顯騰訊專注於工具、記憶體和工作流程的「韁繩」層,以主宰代理時代。

Page 1 of 3