自我介绍
大家好,我是 tanjunchen(GitHub),一名专注在 AI Infra 一线的软件工程师。
近期核心精力聚焦于 大模型推理加速、训推工程化落地与全链路性能优化,围绕大模型高效部署与国产芯加速进行深入探索:
- 🚀 推理框架与引擎:深入
vLLM/SGLang等主流推理引擎源码。 - ⚡ 全链路性能调优:专注于 KV Cache 多级缓存管理、Prefill/Decode 分离调度等加速手段。
- 💻 算力与异构适配:在大规模 GPU 及国产化算力(含超节点)场景下,推动开源大模型的高效适配与工程落地。
此外,我也是 Kubernetes / Istio / Aeraki Mesh 等开源社区的贡献者与 Maintainer。这里记录了我的技术沉淀与踩坑心得,欢迎在 云原生 AI、推理加速、异构计算 等领域交流探讨 🚀
开源社区
| 项目 | 角色 | GitHub | 官方网站 |
|---|---|---|---|
| Kubernetes | Reviewer/Contributor | kubernetes | kubernetes.io |
| Istio | Contributor | istio | istio.io |
| Aeraki Mesh | Maintainer/Contributor | aeraki-mesh | aeraki.net |
| Kubernetes Website | Approver | website | kubernetes.io |
| Kubernetes Dashboard | Approver | dashboard | dashboard |
