Repositories
YanSong97/opencode
The open source coding agent.
YanSong97/Stateful_Knowledge_Learning
YanSong97/verl-tmp
verl: Volcano Engine Reinforcement Learning for LLMs
YanSong97/Natural-language-RL
Natural Language Reinforcement Learning
YanSong97/open_spiel
OpenSpiel is a collection of environments and algorithms for research in general reinforcement learning and search/planning in games.
YanSong97/vllm_plm
YanSong97/vllm_router_logits
get router logits from it
YanSong97/MAgent-demo
YanSong97/Master-thesis
Policy gradient planning in MBRL using probabilistic models.
YanSong97/YanSong97
YanSong97/BeerGame_demo
YanSong97/llm-reasoners
A library for advanced large language model reasoning
YanSong97/LLM_Tree_Search
The official implementation of paper: Alphazero-like Tree-Search can guide large language model decoding and training
YanSong97/safe-rlhf
Safe-RLHF: Constrained Value Alignment via Safe Reinforcement Learning from Human Feedback
YanSong97/overcooked_ai
A benchmark environment for fully cooperative human-AI performance.
YanSong97/readthedocs
YanSong97/envpool
C++-based high-performance parallel environment execution engine (vectorized env) for general RL environments.
YanSong97/gym
A toolkit for developing and comparing reinforcement learning algorithms.
YanSong97/malib
A parallel framework for population-based multi-agent reinforcement learning.
YanSong97/MAAI-olympics
YanSong97/ma-gym
A collection of multi agent environments based on OpenAI gym.
YanSong97/ai_lib
YanSong97/olympics_engine
YanSong97/Competition_Olympics-Running
YanSong97/minigrid-rl
RL experiments using mini grid gym environment
YanSong97/Attentive-state-space-models
YanSong97/Gibbs-sampler
coursework
YanSong97/NLP-project
Abstractive Summarisation
YanSong97/Network-analysis
toy software