HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research Paper • 2607.25151 • Published 12 days ago • 1
UltraX: Refining Pre-Training Data at Scale with Adaptive Programmatic Editing Paper • 2607.08646 • Published about 1 month ago • 3
Beyond Reward Engineering: A Data Recipe for Long-Context Reinforcement Learning Paper • 2606.18831 • Published Jun 17 • 7