Richard Pang
yzpang
AI & ML interests
NLP, ML
Recent Activity
authored a paper 2 days ago
OPD Before RL: Warm-Starting Rubric-Based RL with On-Policy Distillation upvoted a paper 2 days ago
OPD Before RL: Warm-Starting Rubric-Based RL with On-Policy Distillation liked a dataset 11 months ago
facebook/AdvancedIF