Shaobai Jiang
shaobaij
AI & ML interests
None yet
Recent Activity
upvoted a paper 7 minutes ago
Policy and World Modeling Co-Training for Language Agents upvoted a paper 9 minutes ago
ECHO: Terminal Agents Learn World Models for Free upvoted a paper 2 days ago
Noisy Data is Destructive to Reinforcement Learning with Verifiable RewardsOrganizations
None yet