Hi there 👋 🔭 Currently working on: CPU inference with vLLM 🌱 Interests: AI/ML infrastructure & LLM serving eBPF, kernel networking & systems programming GPU/accelerator enablement (CUDA, Triton, ROCm) Kubernetes & cloud-native AI