Kai-Jie Lin

@KJLdefeated · User

GitHub profile ↗ · Compare

CMU ECE | RL & MLsys

77 followers34 repositories

Repositories

KJLdefeated/RL-Kernel

Modern RL Post-training Infrastructure: Optimized for NVIDIA/AMD GPUs with a focus on vLLM integration, Triton kernels, and transparent hardware-aware scaling.

★ 0PythonForks 0

KJLdefeated/Sakura

一个通用桌宠 Agent 框架,能导入自定义角色包,并让角色感知屏幕内容与系统事件,根据用户当前场景主动做出自然反应。

★ 0Forks 0

KJLdefeated/RL

Scalable toolkit for efficient model reinforcement

★ 0Forks 0

KJLdefeated/MODDPO

2024 NYCU DLP Final Project: Training Diffusion Model with Multi-Objective Reinforcement Learning

★ 2PythonForks 0

KJLdefeated/LightZero

[NeurIPS 2023 Spotlight] LightZero: A Unified Benchmark for Monte Carlo Tree Search in General Sequential Decision Scenarios (awesome MCTS)

★ 0Forks 0