arxiv:2609.22947
Eddie
EddieYang428
ยท
AI & ML interests
None yet
Recent Activity
submitted a paper 2 days ago
Adaptive Reward Routing: Dynamic Multi-Reward Optimization for Joint Audio-Video Diffusion via Forward-Process RL authored a paper 9 days ago
RewardVerse: Rubric-Guided Policy Optimization for Video Reward ModelingOrganizations
None yet