Shaobai Jiang
shaobaij
AI & ML interests
None yet
Recent Activity
upvoted a paper about 2 hours ago
Co-Evolving Harnesses and Models: On-Policy Correction Helps Weaker Models Catch Up Where Imitation Fails upvoted a paper about 2 hours ago
WearableQA: A Benchmark for Health Reasoning over Real-World Wearable Data upvoted a paper 2 days ago
Long-Horizon Language Model Reinforcement Learning via Progressive Point MatchingOrganizations
None yet