Kishan Panaganti
kishanpb
AI & ML interests
LLM Reasoning via RL and anything RL
Recent Activity
upvoted a paper about 11 hours ago
Stale but Stable: Staleness-Adaptive Trust Regions for Stabilizing Asynchronous Reinforcement Learning authored a paper 2 days ago
Harness Handbook: Making Evolving Agent Harnesses Readable,Navigable, and Editable upvoted a paper 7 days ago
Harness Handbook: Making Evolving Agent Harnesses Readable,Navigable, and EditableOrganizations
None yet