
Pinecone Nexus 終結代理式 AI 的 RAG 時代
Pinecone 推出 Nexus,一款知識引擎,用上下文編譯器取代 RAG,從企業資料預建任務特定知識文物。它包含 KnowQL,一種代理可指定輸出形狀、信心度及延遲預算的宣告式查詢語言。基準測試顯示財務分析等任務令牌減少 98%。
Tag: #vector-db9 results

Pinecone 推出 Nexus,一款知識引擎,用上下文編譯器取代 RAG,從企業資料預建任務特定知識文物。它包含 KnowQL,一種代理可指定輸出形狀、信心度及延遲預算的宣告式查詢語言。基準測試顯示財務分析等任務令牌減少 98%。
turboquant-pro 推出 autotune CLI,從 PostgreSQL/pgvector 取樣嵌入向量,測試 12 種壓縮配置,在約 10 秒內依最小召回率推薦最佳方案。在 194K 生產嵌入上達 20.9 倍壓縮、96% 召回率,將 758MB 縮至 36MB。僅需 CPU、無需訓練,使用 PCA-Matryoshka + TurboQuant。
開發者討論在構建生產級 LLM 應用時,關於上下文持久化、記憶體管理與模型路由的複雜性。討論串強調了自行開發基礎設施與使用第三方工具之間的權衡與困境。

Weaviate 發布了針對 C# 開發者的託管 .NET 用戶端。它透過程式碼即結構描述的方式實現語意搜尋與 RAG。主要功能包括屬性驅動結構描述、類型安全的查詢,以及以地道 .NET 方式的安全遷移。
TurboQuant 論文的 Python 實作實現了無需校準資料的線上向量量化。使用隨機旋轉使座標呈高斯分佈,然後逐維度進行 1D 量化。包含無偏點積修正,適合 KV 快取與向量資料庫。

Weaviate 推出 Agent Skills,這是一項用於建構生產就緒代理工作流程的新功能。使用者可直接在 Claude Code、Cursor 和 GitHub Copilot 等工具中使用單一提示來建立這些工作流程。這簡化了在 Weaviate 向量資料庫平台上的代理開發。
調查識別四類 AI 資料庫:向量資料庫、資料庫內 ML、LLM 增強及預測資料庫如 Aito。包含圖表、比較及遺漏如特徵儲存。作者披露 Aito 預測類別隸屬。
512 維 32 位 ArcFace 嵌入超過 Postgres TOAST 門檻,導致透過 TOAST 表額外 I/O。建議 16 位 HALFVEC 量化減半儲存/I/O 並內嵌儲存。預期現實世界精準度損失可忽略。

Project Golem 是 RAG 檢索的 3D 可視化工具,GitHub 星數達 260。Milvus 發布具進階功能的出色 fork,並在其部落格詳述。創作者感謝社群並徵求未來方向意見。