wucong25

@wucong25 · User

GitHub profile ↗ · Compare

7 followers16 repositories

Repositories

wucong25/verl-recipe

A set of examples based on verl for end-to-end RL training recipes.

★ 0PythonForks 0

wucong25/verl

verl: Volcano Engine Reinforcement Learning for LLMs

★ 1PythonForks 0

wucong25/verl-omni

Multimodal RL training framework for diffusion & omni models

★ 0Forks 0

wucong25/Megatron-Bridge

Training library for Megatron-based models with bi-directional Hugging Face conversion capability

★ 0Forks 0

wucong25/mbridge

Bridge Megatron-Core to Hugging Face/Reinforcement Learning

★ 0Forks 0