arxiv:2604.18574
Salman Rahman PRO
salmannyu
AI & ML interests
Natural Language Processing, Deep Learning, Scalable Oversight, and Language Model Evaluation
Recent Activity
upvoted a paper about 8 hours ago
Understanding Reasoning from Pretraining to Post-Training updated a model 20 days ago
salmannyu/first-mistake-rl-results published a model 20 days ago
salmannyu/first-mistake-rl-results