yohann-bearzi

@yohann-bearzi · User

GitHub profile ↗ · Compare

0 followers9 repositories

Repositories

yohann-bearzi/omlx

oMLX fork: GLM-5.2 JANGTQ loading + steel-tiled TurboQuant MoE kernel (3.8x prefill on 2-bit experts)

★ 0PythonForks 0

yohann-bearzi/jangq

jang-tools fork: GLM-5.2 fused sparse-MLA prefill + Hadamard/gather kernel fixes

★ 0Forks 0

yohann-bearzi/donkey

Donkey — ANE drafter: world model predicting latent-space sequences for speculative decode. Package: donkey-mlx.

★ 0PythonForks 0

yohann-bearzi/mlx-block-fp8

Standalone MLX extension: block_fp8 (DeepSeek-V3/MiMo-style E4M3) quantized matmul and MoE kernels. Builds against stock upstream MLX.

★ 0C++Forks 0

yohann-bearzi/mestra

Mestra — continual per-expert recompressor for FP8 MoE weights on Apple Silicon. Change the form, keep the soul.

★ 0Forks 0

yohann-bearzi/osaurus

Own your AI. The native macOS harness for AI agents -- any model, persistent memory, autonomous execution, cryptographic identity. Built in Swift. Fully offline. Open source.

★ 0Forks 0

yohann-bearzi/vmlx

vMLX - JANGTQ Uber Compressed MLX Models - L2 Disk Cache (survives restart) + L1 Paged (super fast ttft) + Hybrid SSM Scheduler + Cont Batching + etc!

★ 0Forks 0