Tasselszcx/verl-agent
verl-agent is an extension of veRL, designed for training LLM/VLM agents via RL. verl-agent is also the official code for paper "Group-in-Group Policy Optimization for LLM Agent Training"
MSc@Imperial College London, 2025 BEng@Tongji University, China, 2021 Agent Intern @ Momenta %%%%%% Agent Intern @ PKU OpenDCAI
verl-agent is an extension of veRL, designed for training LLM/VLM agents via RL. verl-agent is also the official code for paper "Group-in-Group Policy Optimization for LLM Agent Training"
DPCC Avoiding experiment with Flow Matching and three-scenario synthetic data
Student version of Assignment 1 for Stanford CS336 - Language Modeling From Scratch
Claude Code skills for academic papers: search, deep analysis, illustrated method explainers, and AI slide decks.
AKO-NPU project
🤖 Claude Code 实战入门系列 | 从环境配置到高级用法,面向中文开发者的完整指南
GenEnv (Agent x Environment LLM co-training) reproduction on 8xH800 with verl 0.4.1 + vllm 0.8.5
GRPO training quickstart on 4x H800 — veRL + Qwen3 + GSM8K
自我介绍
从零开始构建智能体
Exercises for "Neuroscience for machine learners" course
Unified Efficient Fine-Tuning of 100+ LLMs & VLMs (ACL 2024)
Neuroscience for machine learners course