Search

Tag: #quantization201 results

🤖

開源 20GB MedQA 84% LLM

Empirisch Tech 開源 Chaperone-Thinking-LQ-1.0,這是 4-bit GPTQ 量化與 QLoRA 微調的 DeepSeek-R1-32B 模型,在 MedQA 上達 84%。可在單一 L40 GPU 的 20GB VRAM 運行,比基底快 1.6 倍。設計用於本地醫療保健,尊重資料主權。

Reddit r/MachineLearningCommunityApr 21#open-source#quantization#fine-tuning
僅用 264KB RAM 執行的 Diffusion Model

僅用 264KB RAM 執行的 Diffusion Model

一名開發者訓練了可生成 32×32 像素影像的 diffusion model,並部署在僅有 264KB SRAM 的 Shrike Lite micro控制器上。雖然大量量化讓專案成為可能,但受記憶體限制的 I/O 使 FPGA 加速版本反而比僅使用 MCU 的實作更慢。

Reddit r/MachineLearningCommunity3d ago#tinyml#edge-inference#quantization
Page 2 of 21