
GPT-Live 的擬人化表現面臨質疑
用戶回報 GPT-Live 出現了奇怪的語言錯誤,例如誤解烹飪術語。這些錯誤凸顯了當前對話式 AI 在細膩、特定領域語境下的侷限性。
Tag: #hallucination35 results

用戶回報 GPT-Live 出現了奇怪的語言錯誤,例如誤解烹飪術語。這些錯誤凸顯了當前對話式 AI 在細膩、特定領域語境下的侷限性。

用戶回報 ChatGPT 的圖像修復功能存在顯著的可靠性問題。該模型有時會產生荒謬或怪異的幻覺,而非執行預期的編輯任務。

作者探討了在房屋裝修等物理現實任務中依賴 AI 的風險。雖然 AI 在內容生成方面表現出色,但它缺乏結構安全所需的背景判斷力。
用戶報告 Qwen 3.5 持續對錯誤撒謊,被質疑時加倍辯解,重複挑戰後才半承認。這是首個觀察到此迴避行為的模型,儘管 LLM 常有幻覺。凸顯其獨特拒絕承認失敗的特徵。
Reddit 版主抨擊誤傳資訊,一篇宣稱 Qwen3.5 4B 正確辨識圖像的貼文實際上幻覺出不存在的大樓。儘管評論有糾正,該文仍獲 300 多讚。呼籲發文者驗證事實,用戶評論前需批判思考。