ZhanpengShi
Recqvq
AI & ML interests
None yet
Recent Activity
upvoted a paper 7 days ago
Rethinking Critic Learning in PPO: Understanding and Mitigating Value Flattening upvoted a paper 4 months ago
DenoiseRL: Bootstrapping Reasoning Models to Recover from Noisy Prefixes upvoted a paper 4 months ago
LatentOmni: Rethinking Omni-Modal Understanding via Unified Audio-Visual Latent ReasoningOrganizations
None yet