๐ In a Training Loop
fafa
kunkun0919
AI & ML interests
LLM
Recent Activity
upvoted a paper about 17 hours ago
GUI-HARVEST: Self-Improving GUI Agents through Evidence-Driven Harness Evolution upvoted a paper 24 days ago
COBRA-Skills: Contextual Bandit-Guided Evolution for Agent Skill Optimization upvoted a paper about 1 month ago
Rethinking On-Policy Distillation of Large Language Models II: One Training ExampleOrganizations
None yet