
RTX 2080 Ti 只需 282 美元升級至 22GB
一家日本維修店在記憶體短缺期間,以每 GB 約 25 美元的價格提供 VRAM 升級服務。據報 RTX 2080 Ti 可花費約 282 美元改裝至 22GB GDDR6,可能成為低成本 AI 工作負載方案。
Tag: #local-inference187 results

一家日本維修店在記憶體短缺期間,以每 GB 約 25 美元的價格提供 VRAM 升級服務。據報 RTX 2080 Ti 可花費約 282 美元改裝至 22GB GDDR6,可能成為低成本 AI 工作負載方案。

Intel Arc Pro B70 專業 GPU 在美國、德國與韓國的零售通路上漲幅介乎26%至48%。這款面向 AI 工作站的 GPU 配備32GB 記憶體,INT8 算力達367 TOPS,正因供應與需求受到關注。

一名 Reddit 使用者表示,在本地執行的 Qwen3.8-27B 一次生成了 Super Mario 複製版遊戲。Q8 GGUF 版本在 Framework Desktop 上執行速度較慢,但被認為適合隔夜批次處理與背景程式設計工作。

Nvidia 已發布 Nemotron 3.5 Lightning,官方稱這是其首款開源 AI 模型。該模型主打輕量化,可在個人電腦的單張 GPU 上運行,可能降低本地端實驗的門檻。

Meta 推出 Muse Glimmer,這是一款針對在單一 PC 或 Mac GPU 上執行全天候本地代理工作流程而最佳化的 300 億參數模型。其最低 24GB VRAM 的需求可能降低企業對雲端的依賴,但也讓硬體供應、擴展能力與整體投資報酬率更難評估。
Meta 發布較小型的開放權重模型 Muse Glimmer,定位是在配備單張 GPU 的 Mac 或 PC 上執行智能體任務。Mark Zuckerberg 同時呼籲美國減少對訓練資料與蒸餾的政策限制,並宣布計畫公開 Muse Spark 1.2 的模型權重。

Meta 發布了 Muse Glimmer,並將其描述為開源模型。這款精簡版模型體積較小,可在單台電腦上執行。
Meta 發布了 Muse Glimmer,這是一款設計為可在單一電腦上運行的輕量級 AI 模型。使用者可以在本機下載並客製化這款模型。

Qwen3.8-2.4T-A95B(又稱 Qwen3.8-Max)據報計劃於下週三開放發布。ModelScope 上已出現對應模型頁面,但發布時間目前尚未獲官方確認。

Ling-3.0-flash 的 MXFP4 版本已發布,據報可在單台 NVIDIA DGX Spark 上本機運行。據稱解碼速度約為每秒 80 tokens,長輸入預填充速度為每秒 2,500–3,500 tokens,並可支援 3 至 4 名同時使用者。