Search

Tag: #local-llm172 results

📰

本地 LLM 網路研究設定揭露

使用者分享使用 Qwen3.5:27B-Q3_K_M 在 RTX 4090 上進行高速本地網路刮取及研究,40 tk/s 及 200k 上下文。透過 llama.cpp Web UI 啟用 MCP 工具,包括 webmcp 並行擷取 URL、清理 HTML 及轉 Markdown。程式碼詳述 async Playwright 瀏覽器、DDGS 搜尋及 readability 提取。

Reddit r/LocalLLaMACommunityApr 10#local-llm#web-scraping#mcp-tools
Qwen3.5-27B 本地運行 OpenCode 代理

Qwen3.5-27B 本地運行 OpenCode 代理

使用者示範 Qwen3.5-27B 在 RTX 4090 上透過 llama.cpp 作為 OpenCode 程式碼代理的主要模型,實現良好工具呼叫及程式碼任務。設定使用 4-bit 量化、64K 上下文,生成約 40 tok/s。部落格詳述完整工作流程,包括代理技能及 Context7 整合。

Reddit r/LocalLLaMACommunityMar 30#local-llm#agentic-coding#rtx-4090
Page 12 of 18