
Meta-Learning Framework Boosts Multilingual LLM Alignment with Limited Data
Researchers propose a meta-learning framework for RLHF and DPO that transfers preference data across languages, enabling effective alignment of large language models in low-resource languages with minimal data.

