Search

Tag: #benchmarks166 results

🤖

Qwen3.5-35B GGUF 量化基準測試

基準測試比較 Hugging Face 上 Qwen3.5-35B GGUF 量化版本(16-22 GiB)的 KLD 差異和速度。使用多語言 FLORES 200 和校準資料集。表格依 KLD 平均值和 99% 排名,在 RTX 3090 上 TG/s 最高達 143。

Reddit r/LocalLLaMACommunityMar 16#quantization#benchmarks#kld
AgentFuel:時序代理客製化評估

AgentFuel:時序代理客製化評估

研究人員評估 6 款資料分析代理,發現其在處理有狀態與事件特定時序查詢時存在缺口。他們推出 AgentFuel,協助領域專家快速建立客製化、具表現力的端到端評估基準。基準資料集已在 Hugging Face 上提供。

ArXiv AIResearchMar 16#timeseries#ai-agents#evals
M5 洩漏基準測試領先 AI PC

M5 洩漏基準測試領先 AI PC

洩漏基準測試顯示蘋果 M5 Max MacBook Pro 單核(4,268)與多核(29,233)分數創紀錄,超越所有消費級 PC,適合 AI 與專業任務。預算版 MacBook Neo 分數 3,461/8,668,優於 M1 Air。所有型號支援 Apple Intelligence。

ComputerworldMediaMar 6#apple-silicon#benchmarks#ai-pc
Page 13 of 17