AI & ML interests
None defined yet.
Recent Activity
View all activity
Papers
From Pareto to Preference: Personalized Test-Time Scaling via Amortized Agentic Policy Discovery
PCSD: Persistent Consistency for Self-Distillation in Agentic Reinforcement Learning
BIT 's models
None public yet