
AI 偵測器誤判 Berkeley 教授的評論文章
UC Berkeley 數學教授 Zvezdelina Stankova 撰寫評論文章,批評無法完成國中數學的學生。文章發布後,話題轉向 AI 偵測器據報將這篇人類撰寫的文章判定為 AI 生成,凸顯偵測工具可靠性的問題。
Tag: #false-positives8 results

UC Berkeley 數學教授 Zvezdelina Stankova 撰寫評論文章,批評無法完成國中數學的學生。文章發布後,話題轉向 AI 偵測器據報將這篇人類撰寫的文章判定為 AI 生成,凸顯偵測工具可靠性的問題。

GitLab 18.10 推出 AI 驅動的 SAST 假陽性偵測(正式版)、代理漏洞修復(測試版)及祕密假陽性偵測(測試版)。這些功能利用 LLM 代理推理減少噪音,並透過合併請求自動修復。Ultimate 客戶可透過 GitLab Duo Agent Platform 使用。
Anthropic 放寬 Claude Fable 5 在生物學相關查詢上的過度安全限制。此變更讓誤判及回退至較低階模型的情況減少約 85%,同時保留對專業雙重用途研究的限制。
Codex Security 不使用傳統 SAST 報告。它採用 AI 驅動的約束推理和驗證來識別真實漏洞。此方法相較傳統方式大幅減少假陽性。
一名 Reddit 研究者提出,相似度式 AI 文字偵測器存在由底層文字分布碰撞熵決定、且無法避免的誤判率下限。這套非正式框架適用於浮水印與檢索匹配,但目前僅經自行驗證,仍等待外部審查。
一篇 Reddit 貼文聲稱 Claude 現在會使用隱寫式訊號標記 AI 生成內容。貼文同時指出已出現誤判,引發對透明度、偵測可靠性及封閉模型使用方式的疑慮。

商店面部辨識系統誤判購物者,導致公開羞辱並被趕出店外,卻無援助上訴。監管機構警告AI監督遠落後於技術部署速度。Ian Clayton在Home Bargains遭誤判後被迅速帶離。

X平台因自動偵測錯誤,在海洋堂人偶照片上誤顯示「AI生成」標籤。海洋堂確認,所有商品照片均由專屬攝影師拍攝,未使用AI生成影像。