Adaptive Mutual Distillation for Balanced Multi-Task Post-Training of Large Language Models
arXiv:2610.02856v1 Announce Type: new Abstract: Multi-task post-training of large language models (LLMs) aims to improve performance across tasks with unequal amounts of training data. Existing methods focus primarily on balancing task contributions during single-model training. Different task-bala…
Read the full story at arXiv cs.CL ↗
Timeline · 1 report
- 2026-10-05 04:00 · arXiv cs.CL
Adaptive Mutual Distillation for Balanced Multi-Task Post-Training of Large Language Models