Huan-ang Gao
c7w
AI & ML interests
None yet
Recent Activity
upvoted a paper about 9 hours ago
Rethinking On-Policy Distillation of Large Language Models II: One Training Example submitted a paper 9 days ago
Open-MOPD: Diagnosing and Fixing Capability Imbalance in Multi-Teacher On-Policy Distillation