🔬
碰撞熵下限挑戰 AI 文字偵測器
一名 Reddit 研究者提出,相似度式 AI 文字偵測器存在由底層文字分布碰撞熵決定、且無法避免的誤判率下限。這套非正式框架適用於浮水印與檢索匹配,但目前僅經自行驗證,仍等待外部審查。
Tag: #watermarking26 results
一名 Reddit 研究者提出,相似度式 AI 文字偵測器存在由底層文字分布碰撞熵決定、且無法避免的誤判率下限。這套非正式框架適用於浮水印與檢索匹配,但目前僅經自行驗證,仍等待外部審查。

據報導,8 月 2 日或之後推出的 Claude 模型,會在所有生成文字中嵌入不可見標記。即使複製貼上,標記仍會保留;使用者無須同意,也無法關閉此功能。

文章探討文字浮水印如何利用密鑰,引導語言模型選擇特定詞元,讓生成內容能透過統計方式被辨識。文章認為,標籤規則可能造成不對稱結果:完全由 AI 撰寫的文章不需標示,僅稍微使用 AI 協助的人類通訊反而需要標示。

據報導,Anthropic 正在 Claude 的輸出中嵌入不可見簽名。這項更新可能有助於辨識由 Claude 生成的內容,但文章摘要未說明簽名的實作方式或偵測方法。

Suno 表示將為其平台生成的歌曲加入浮水印功能。此舉發生在這家 AI 音樂公司正面臨多起法律訴訟之際。

Anthropic 為 Claude 輸出內容推出新的水印系統。部分使用者批評這項功能,擔心它會揭露自己在工作或課堂上使用 Claude。