Kishan Panaganti
kishanpb
AI & ML interests
LLM Reasoning via RL and anything RL
Recent Activity
upvoted a paper about 4 hours ago
Stale but Stable: Staleness-Adaptive Trust Regions for Stabilizing Asynchronous Reinforcement Learning authored a paper 1 day ago
Harness Handbook: Making Evolving Agent Harnesses Readable,Navigable, and Editable upvoted a paper 6 days ago
Harness Handbook: Making Evolving Agent Harnesses Readable,Navigable, and EditableOrganizations
None yet