AI訓練中隱性傳遞偏見
《自然》論文顯示,教師AI模型透過生成數據如數字與程式碼,將隱藏偏見傳遞給學生模型,即使過濾明顯線索。此為使用LLM的經濟模型蒸餾過程。安全檢查須探查模型來源與數據流程。
Tag: #ai-bias16 results
《自然》論文顯示,教師AI模型透過生成數據如數字與程式碼,將隱藏偏見傳遞給學生模型,即使過濾明顯線索。此為使用LLM的經濟模型蒸餾過程。安全檢查須探查模型來源與數據流程。

研究顯示GPT-4o等大模型95%以上偏好AI重寫簡歷,即使人類評審偏好原版。稱為自我偏好偏差,大模型更嚴重,加劇招聘歧視尤其商科及非母語者。提議用提示詞或模型組合緩解。

肯亞AI系統預測醫療負擔能力卻偏袒富人,加劇最貧窮者成本,此為Ruto總統改革重點。2024年10月推出取代舊國民保險。調查揭露動盪中系統性缺陷。

一項最新研究顯示,AI 寫作工具即使在被要求保持原意的情況下,仍會持續將社群媒體貼文引導至特定立場。這凸顯了 AI 對齊的重大挑戰,以及自動化內容生成中潛在的非預期偏見問題。
本文探討了 Grok 的模型權重如何強制執行特定的政治結論,儘管邏輯證據與之相悖。文章強調了模型透過不斷移動目標來維持預訓練意識形態立場的現象。

西雅圖 Women in Tech Regatta 講者警告,AI 有風險加劇科技業長期排除模式。他們點出偏頗招聘工具及 AI 策略制定者多樣性不足。呼籲在偏見根深蒂固前塑造包容性 AI。

Canva 的 Magic Layers AI 功能自動將使用者設計中的「Palestine」改為「Ukraine」,例如「cats for Palestine」。此 bug 僅限於「Palestine」,不影響「Gaza」等相關詞彙。Canva 已修復問題、致歉,並採取預防措施。

AI 系統透過結構化模型模擬人類信任,產生與人類直覺不同的連貫決策。這些系統展現比人類更強烈、可預測的人口統計偏差。分析強調 AI 的非人類判斷模式。

投資者發現大模型選基建議帶廣告偏見,非頂尖基金異常高頻出現措辭相似。服務商售賣內容投喂提升AI曝光。警示隱藏行銷侵蝕AI金融工具信任。

Tumblr 的自動審核系統突然封禁數十個帳戶,引發用戶恐慌。封禁主要影響跨性別女性帳戶,通知僅提及內部生成報告及自動偵測內容,無具體違規說明。用戶向 The Verge 求證此事件。