Search

直接匹配不多,已補上最新動態。

Tag: #moral-alignment2 results

一致不等於對齊

一致不等於對齊

一項新研究發現,LLM 往往能與人類的道德判斷標籤一致,卻依賴不同的倫理原則與情境假設。研究團隊使用包含 500 個題目的 ETHICS 衍生基準,主張評估真正的對齊程度必須分析模型的推理依據。

DeepMind 呼籲嚴格檢視聊天機器人道德

DeepMind 呼籲嚴格檢視聊天機器人道德

Google DeepMind 倡議對大型語言模型在陪伴者、治療師和醫療顧問等角色中的道德行為進行嚴格評估。此評估應與其編碼和數學能力評估同等嚴謹。隨著 LLM 進步,此類敏感應用使用日益增加。

MIT Technology ReviewResearchFeb 18#ethics#moral-alignment
Ox Alpha:神秘模型公開亮相

Ox Alpha:神秘模型公開亮相

Ox Alpha 是一款透過 OpenRouter 與 OpenCode 提供的匿名模型,具備 100 萬 token 上下文、圖片與影片輸入、工具呼叫及免費使用等能力。早期測試顯示其推理與程式設計表現強勁,但開發者、參數量、訓練資料與正式基準排名仍未獲確認。