Intern@veRL. PhD student in ML/NLP.
Repositories
yyDing1/uni-agent-images
Agent Runtime Images
yyDing1/verl-project.github.io
yyDing1/yyDing1.github.io
AcadHomepage: A Modern and Responsive Academic Personal Homepage
yyDing1/ScaleQuest
[ACL 2025] We introduce ScaleQuest, a scalable, novel and cost-effective data synthesis method to unleash the reasoning capability of LLMs.
yyDing1/FAPO
Code Implementation of Paper "FAPO: Flawed-Aware Policy Optimization for Efficient and Reliable Reasoning"
yyDing1/verl
verl: Volcano Engine Reinforcement Learning for LLMs
yyDing1/GNER
[ACL 2024 Findings] Code implementation of Paper "Rethinking Negative Instances for Generative Named Entity Recognition"
yyDing1/SCAN-PRM
[NeurIPS 2025] Code Implementation of Paper "SCAN: Self-Denoising Monte Carlo Annotation for Robust Process Reward Learning"
yyDing1/PRMTrain
Training Framework of PRM
yyDing1/DS-NER
[TKDE] Code implementation of Paper "Towards DS-NER: Unveiling and Addressing Latent Noise in Distant Annotations"
yyDing1/OpenBA
OpenBA: An Open-Sourced 15B Bilingual Asymmetric Seq2Seq Model Pre-trained from Scratch