
easyaligner 推出 GPU 強制對齊工具
開源庫使用 HF Hub 任一 wav2vec2 模型,提供快速 GPU 強制對齊。無需分塊處理長音頻,支援文字正規化並恢復原文格式,自動修剪無關語音。適用真實轉錄或 ASR 輸出。
Tag: #gpu-acceleration27 results

開源庫使用 HF Hub 任一 wav2vec2 模型,提供快速 GPU 強制對齊。無需分塊處理長音頻,支援文字正規化並恢復原文格式,自動修剪無關語音。適用真實轉錄或 ASR 輸出。

PyTorch 部落格宣布在 NVIDIA Blackwell GPU 上使用 MXFP8 和 NVFP4 格式,搭配 Diffusers 和 TorchAO 優化擴散模型。這些功能實現超逼真影像與影片生成,同時解決記憶體與運算限制。此更新促進擴散模型在 AI 工作流程中的採用。
fastrad 是 PyTorch 原生放射組學庫,在 GPU 上比 PyRadiomics 快 25 倍。全實作 8 類 IBSI 特徵,使用裝置無關的張量運算。經基準與真實資料集驗證準確性。
摩爾線程在 FP8 技術研發上取得系統性突破,成為國內少數掌握此技術的 GPU 廠商,全球與 Nvidia 保持同步。基於平湖架構的 MTT S5000 提供最高 1000 TFLOPS FP8 AI 算力,配備 80GB 顯存,並支援全精度計算。MUSA 平台實現與 PyTorch、vLLM 等主流 AI 生態的深度相容。

Import AI 448 聚焦 AI 研發進展,包括字節跳動的新代理能撰寫 CUDA 程式碼用於 GPU 任務。它也涵蓋衛星端 AI 的進展。本期探討首場重大 AI 戰爭何時來臨,類比烏克蘭無人機戰爭。

cayleyR R 套件引入了一種透過檢測 Cayley 圖中的循環交集來解決 TopSpin 等排列謎題的新方法。它採用迭代雙向搜尋演算法,並結合 C++ 效能優化與可選的 GPU 加速。

NVIDIA CUDA 13.3 引入了對 carryless multiplication 的原生支援,這是密碼學與零知識證明中的關鍵運算。此更新填補了 x86 CPU 與 NVIDIA GPU 之間長期存在的效能差距。

NVIDIA 推出了 GPU 加速的 Presto,旨在為大規模分析查詢工作負載提供極致效能。此整合利用 GB200 NVL72 架構,為使用者和 AI 代理提供低延遲的查詢結果。

Mozilla 已將 Vulkan Video 的初步支援合併至 Firefox,提供新的 GPU 硬體解碼路徑。此更新旨在提升跨平台效能,並減少對 VA-API 的依賴。

AMD 宣佈其最新的 AI 驅動超解析度技術 FSR 4.1 將擴展至舊款 GPU 架構。此更新包含對 RX 7000 與 RX 6000 系列顯卡,以及 Steam Machine 硬體的支援。