Search

Tag: #research-integrity7 results

IntegrityBench 揭示 LLM 研究誠信缺口

IntegrityBench 揭示 LLM 研究誠信缺口

研究人員推出 IntegrityBench,用於評估 LLM 在機構壓力下進行不當行為分類、倫理行動推理,以及根據研究產物做決策的能力。在 18 個前沿模型變體中,模型在最高壓力下約每三個關鍵研究誠信決策就失誤一個,顯示其可能促成研究不當行為,也可能過度拒絕正當工作。