Search

直接匹配不多,已補上最新動態。

Tag: #dms2 results

Nvidia's DMS Slashes LLM Costs 8x

Nvidia's DMS Slashes LLM Costs 8x

Nvidia's DMS compresses LLM KV cache up to 8x, reducing memory costs without accuracy loss. Enables longer chain-of-thought reasoning and more parallel paths. Outperforms heuristic eviction and paging methods.

VentureBeatMediaFeb 12#research#nvidia#dms
日本收緊 AI 硬體供應鏈

日本收緊 AI 硬體供應鏈

日本將阻焊劑、GaN 基板、永磁體、鈣鈦礦電池與閃爍體五類技術,納入技術轉移前的申報與審查框架。這項措施涵蓋海外子公司、合資企業、公司、大學與研究機構,可能影響半導體、機器人、AI 伺服器及感測器供應鏈。

ChatGPT 威脅通報促成逮捕

ChatGPT 威脅通報促成逮捕

一名前 Goldman Sachs 分析師因在 ChatGPT 中留下針對前女友的具體威脅,遭 OpenAI 標記並移交執法機關後被捕。這起案件凸顯 AI 聊天記錄可能成為司法證據,也引發對隱私、威脅偵測標準與平台通報義務的討論。

⚙️

為 16GB VRAM 調校 Qwen3.8

一名 LocalLLaMA 使用者分享了在 Windows 上,於約 16GB VRAM 內執行 Qwen3.8 27B IQ4-XS-MTP GGUF 模型的配置。該設定透過將多模態元件與特定張量移至系統 RAM,以量化品質與速度換取 90K–100K 的上下文視窗。

Reddit r/LocalLLaMACommunity6h ago#16gb-vram#gguf#model-quantization