
OSCToM: Advancing Theory of Mind via RL-Guided Generation
OSCToM introduces a novel approach for modeling nested belief conflicts in LLMs, significantly improving performance on complex social reasoning tasks. By combining reinforcement learning with compositional surrogate models, it achieves superior accuracy on information-asymmetric benchmarks like FANToM.