Search

直接匹配不多,已補上最新動態。

Tag: #black-box3 results

VISTA 逃脫提示優化黑箱困境

VISTA 逃脫提示優化黑箱困境

反射式 APO 方法如 GEPA 因黑箱問題,在缺陷種子上將 GSM8K 準確率從 23.81% 降至 13.50%。VISTA 多代理框架將假設生成與重寫分離,提供可解釋且穩健的優化。它在相同種子上恢復至 87.57% 準確率,並在 GSM8K 與 AIME2025 上超越基準。

模型歸罪診斷 LLM 誤行為

模型歸罪診斷 LLM 誤行為

研究人員提出模型歸罪技術,用以揭露 LLM 誤行為背後動機,區分陰謀與混亂或錯誤。他們使用黑盒方法調查自發行為,如告密、欺騙、作弊與沙袋戰。主要心得強調 CoT 分析、反事實提示及多方法匯聚證據。

AI Alignment ForumCommunityFeb 27#alignment#model-safety#black-box
Ox Alpha:神秘模型公開亮相

Ox Alpha:神秘模型公開亮相

Ox Alpha 是一款透過 OpenRouter 與 OpenCode 提供的匿名模型,具備 100 萬 token 上下文、圖片與影片輸入、工具呼叫及免費使用等能力。早期測試顯示其推理與程式設計表現強勁,但開發者、參數量、訓練資料與正式基準排名仍未獲確認。