arxiv:2601.01426
jianbo dai
jbd
ยท
AI & ML interests
None yet
Recent Activity
upvoted a paper about 22 hours ago
OSReward: Instituting Standardized Evaluation for Cross-Platform Computer-Use Reward Models upvoted a paper 2 months ago
Reinforcement Learning Elicits Contextual Learning of Unseen Language Translation upvoted a paper 3 months ago
EnvFactory: Scaling Tool-Use Agents via Executable Environments Synthesis and Robust RL