🐯最新收集於 20m

加密推理可跨模型重放,Kimi K3引發蒸餾疑雲

加密推理可跨模型重放,Kimi K3引發蒸餾疑雲
PostLinkedIn
🐯閱讀原文: 虎嗅
#chain-of-thought#model-security#prompt-injection#agent-safetykimi-k3kimi k3anthropicopenaigoogleclaude

💡一種簡單的重放攻擊,可能跨主流 LLM 家族暴露隱藏推理、機密與遭投毒的 Agent 行為。

⚡ 30-Second TL;DR

有什麼變化

據報導,這種重放技術已針對 Anthropic、OpenAI 與 Google 的模型家族進行測試。

為什麼重要

若能被獨立重現,這項問題可能破壞思維鏈隱私、暴露 Agent 日誌中的機密,並助長提示注入或訓練資料竊取。使用推理模型的開發者不應將加密軌跡視為可靠的安全邊界。

下一步行動

移除生產日誌中的原始推理軌跡與機密,並在儲存任何加密思維鏈資料前,使用合成憑證測試模型供應商的重放抵抗能力。

誰應關注:Researchers & Academics

關鍵要點

  • 據報導,這種重放技術已針對 Anthropic、OpenAI 與 Google 的模型家族進行測試。
  • 研究人員從公開 GitHub 與 Hugging Face Agent 軌跡中解碼出約31.5萬條隱藏推理。
  • 部分軌跡據報暴露 API 金鑰、電子郵件、內部 IP 位址及其他敏感資訊。
  • 在與 GLM、DeepSeek 和 Inkling 的比較中,只有 Kimi K3 出現明顯的雙 token 行為。
  • 建議的緩解措施包括不提供推理軌跡,或採用可阻止跨情境重放的鏈式加密。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: 虎嗅

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週 AI 簡報

每週一封,可隨時退訂。

Encrypted AI Reasoning Can Be Replayed Across Models | 虎嗅 | SetupAI | SetupAI