Fenzhif
FANCERTA
AI & ML interests
CV, NLP
Recent Activity
upvoted a paper about 2 hours ago
EarlyEval: Cheaper Agent Evaluation via Early Outcome Prediction upvoted a paper 2 days ago
Does On-Policy Distillation Really Distill? From Noisy Teacher to Self-Improvement upvoted a paper about 1 month ago
From RLVR to RLSVR: Task Transformation Induces Self-Verifiable Rewards for Open-Ended LLM Self-ImprovementOrganizations
None yet