Do you have real GPU cluster orchestration (K8s + Slurm) cases?

TL;DR: Yes. 128-GPU hybrid platform (A800 + 4090), online inference K8s + offline training Slurm, GPU utilization 32% → 71%. AIOps root-cause on 400+ microservices, MTTR 45min → 12min. CI/CD LLM Review, Code Review P50 24h → 1h. Full portfolio.html · PDF.

3 Representative AI + DevOps Projects

1. AI Research Institute 128-GPU Hybrid Training/Inference Platform

2. AIOps Root-Cause Analysis (400+ microservices)

3. CI/CD LLM Code Review + Unit-Test Auto-Generation

Delivery Discipline for These Projects


Next: Download PDF · Full portfolio · 30-min cluster/architecture alignment