正規化器修復 STT 評估中 WER 格式差異
Gladia 開源了 gladia-normalization,這是一個用於正規化轉錄文本的函式庫,避免 STT 基準測試中格式差異導致 WER 懲罰。它具備 YAML 可配置管線,支持英語、法語、德語、義大利語、西班牙語和荷蘭語。此工具將輸出如「It's $50」標準化為「it is 50 dollars at 3 pm」。
Tag: #open-source-tool14 results
Gladia 開源了 gladia-normalization,這是一個用於正規化轉錄文本的函式庫,避免 STT 基準測試中格式差異導致 WER 懲罰。它具備 YAML 可配置管線,支持英語、法語、德語、義大利語、西班牙語和荷蘭語。此工具將輸出如「It's $50」標準化為「it is 50 dollars at 3 pm」。

Karpathy 提出 LLM Wiki,這是一款使用 AI 將備忘錄和文件整理成可用知識的工具,已在 GitHub 獲得超過 5,000 個星標。文章輕鬆解釋其概念、與 RAG 的差異,並介紹試用工具及社群動態。
Tahuna 是一個 CLI 優先的極簡工具,透過管理協調與運算資源簡化後訓練工作流程。使用者完全控制訓練迴圈、獎勵與資料管道。很快開源整個堆疊;尋求早期測試者與貢獻者。

蘋果中國 AI 凌晨短暫上線後撤下。智譜 GLM-5-Turbo 登頂 ClawBench 榜單。蘋果 Swift 正式支援 Android;小米 CEO 雷軍招募 AI 人才。

Speechos 是一款開源工具,用於並排基準測試本地 STT、TTS、情緒偵測及說話者分離模型。支援 25+ 引擎如 faster-whisper、Piper、Bark 和 Qwen3-TTS,並具備從 CPU 到 GPU 的硬體適應設定。MIT 授權的 GitHub 儲存庫含快速啟動開發腳本。

Meta 開源 RCCLX 的初始版本,這是針對 AMD 平台優化的 RCCL 增強版,已在內部工作負載上測試。RCCLX 完全整合 Torchcomms,以支援不斷演進的 AI 通訊模式。此舉賦予開發者和研究人員跨後端的創新能力。

Open WebUI Desktop 已發布,整合 llama.cpp。支援完全本地執行或連接到遠端伺服器。這為本地 LLM 管理提供桌面介面。

Kon 是一個輕量程式碼代理,受 pi、opencode 和 Claude 啟發,支持如 Gemma-4-26B-A4B 和 Qwen3.5-27B 的本地模型。功能包含附件、指令、技能、壓縮、移交和模型切換,無遙測。在 3090 GPU 上透過 llama-server 測試。
全新 Python 啟動器用於 llama.cpp,無依賴自動化本地推理設定。具備 VRAM 感知調校、GPU 偵測及模型特定預設。GitHub 儲存庫開放社群回饋。

研究團隊推出 Two-Bridge Map Suite,這是 StarCraft II 的獨立開源基準測試,填補完整遊戲與小遊戲之間的複雜度空白。它透過停用資源收集、基地建造與戰爭迷霧,聚焦長距離導航與微操戰鬥。作為輕量 Gym 相容 PySC2 包裝器發布,鼓勵廣泛採用為標準基準。