Search

直接匹配不多,已補上最新動態。

Tag: #model-steering2 results

模型展現截然不同的操控回應模式

模型展現截然不同的操控回應模式

一項針對六個前沿模型的研究發現,操控提示不僅會改變回應頻率,也會改變各模型採用的行為模式。GPT-5 獨特地在保留答案的同時迴避公開推理內容,而在 Llama 中進行內部介入則能可靠誘發特定行為。

ArXiv AIResearchAug 10#model-steering#alignment
Ox Alpha:神秘模型公開亮相

Ox Alpha:神秘模型公開亮相

Ox Alpha 是一款透過 OpenRouter 與 OpenCode 提供的匿名模型,具備 100 萬 token 上下文、圖片與影片輸入、工具呼叫及免費使用等能力。早期測試顯示其推理與程式設計表現強勁,但開發者、參數量、訓練資料與正式基準排名仍未獲確認。