Models used in CHARM: Calibrating Reward Models With Chatbot Arena Scores.
shawnxzhu
shawnxzhu
AI & ML interests
None yet
Recent Activity
upvoted a paper 9 days ago
SAS: Simple Attention Sparsification via End-to-End Optimization of Context Ranking upvoted a paper about 2 months ago
Training Diffusion Language Models for Black-Box Optimization