arxiv:2408.01415
Xiaolong J PRO
Bruce-Jin
AI & ML interests
AI security
Recent Activity
upvoted a paper about 3 hours ago
StateM: Reaching 95.3% Raw Accuracy, or a \$15 Frontier Run, on Terminal-Bench 2.1 via Harness Scaling updated a model about 2 months ago
Bruce-Jin/swe-rl-trajectory_entropy updated a model about 2 months ago
Bruce-Jin/swe-rl-token_entropy