Jiahui

@WWWjiahui · User

GitHub profile ↗ · Compare

Mountain View4 followers16 repositories

Repositories

WWWjiahui/astraflow

Dataflow-Oriented Reinforcement Learning for (Multi-)Agentic LLMs

★ 0Forks 0

WWWjiahui/AReaL

Lightning-Fast RL for LLM Reasoning and Agents. Made Simple & Flexible.

★ 0Forks 0

WWWjiahui/slime

slime is an LLM post-training framework for RL Scaling.

★ 0PythonForks 0