Search

直接匹配不多,已補上最新動態。

Tag: #causal-bias1 results

因果分析揭露區域 LLM 偏見

因果分析揭露區域 LLM 偏見

研究人員引入機率圖形模型 (PGM),使用 Pearl 的 do-operator 來因果審核 LLM 安全護欄,隔離提示注入的人口統計偏見效果。使用 ToxiGen 和 BOLD 資料集,對來自美國、歐洲、阿聯、中國和印度的七個 7B 模型進行實證分析,顯示觀測指標因上下文毒性而高估偏見。西方模型對特定人口統計顯示更高因果拒絕率,而東方模型整體率低但有區域敏感性。

ArXiv AIResearchMay 8#ai-safety#causal-bias#llm-alignment
Ox Alpha:神秘模型公開亮相

Ox Alpha:神秘模型公開亮相

Ox Alpha 是一款透過 OpenRouter 與 OpenCode 提供的匿名模型,具備 100 萬 token 上下文、圖片與影片輸入、工具呼叫及免費使用等能力。早期測試顯示其推理與程式設計表現強勁,但開發者、參數量、訓練資料與正式基準排名仍未獲確認。