Julien Mancuso

@julienmancuso · User

GitHub profile ↗ · Compare

NvidiaDenver, CO7 followers5 repositories

Repositories

julienmancuso/vllm

A high-throughput and memory-efficient inference and serving engine for LLMs

★ 0Forks 0

julienmancuso/sglang

SGLang is a high-performance serving framework for large language models and multimodal models.

★ 0Forks 0

julienmancuso/ome

OME is a Kubernetes operator for enterprise-grade management and serving of Large Language Models (LLMs)

★ 0Forks 0

julienmancuso/grove

Kubernetes enhancements for Network Topology Aware Gang Scheduling & Autoscaling

★ 0GoForks 0