Pelly
Pellypp
ยท
AI & ML interests
None yet
Recent Activity
liked a model 14 days ago
baidu/Unlimited-OCR upvoted a paper about 2 months ago
Reproducing, Analyzing, and Detecting Reward Hacking in Rubric-Based Reinforcement Learning upvoted a paper about 2 months ago
STARE: Surprisal-Guided Token-Level Advantage Reweighting for Policy Entropy StabilityOrganizations
None yet