
SAVOIR: Advancing Social Intelligence in AI via Shapley-Based Reward Attribution
Researchers introduce SAVOIR, a new method for training language agents in social intelligence using Shapley values. This approach improves reward attribution in multi-turn dialogues, addressing a key challenge in reinforcement learning.
