漫步远方,心荡神往

自我介绍

大家好,我是 tanjunchen(GitHub),一名专注在 AI Infra 一线的软件工程师。

近期核心精力聚焦于 大模型推理加速、训推工程化落地与全链路性能优化,围绕大模型高效部署与国产芯加速进行深入探索:

  • 🚀 推理框架与引擎:深入 vLLM / SGLang 等主流推理引擎源码。
  • 全链路性能调优:专注于 KV Cache 多级缓存管理、Prefill/Decode 分离调度等加速手段。
  • 💻 算力与异构适配:在大规模 GPU 及国产化算力(含超节点)场景下,推动开源大模型的高效适配与工程落地。

此外,我也是 Kubernetes / Istio / Aeraki Mesh 等开源社区的贡献者与 Maintainer。这里记录了我的技术沉淀与踩坑心得,欢迎在 云原生 AI、推理加速、异构计算 等领域交流探讨 🚀

开源社区

项目角色GitHub官方网站
KubernetesReviewer/Contributorkuberneteskubernetes.io
IstioContributoristioistio.io
Aeraki MeshMaintainer/Contributoraeraki-meshaeraki.net
Kubernetes WebsiteApproverwebsitekubernetes.io
Kubernetes DashboardApproverdashboarddashboard

分享与演讲

  1. 演讲:Service Mesh 在百度大规模生产落地与实践