Maksim Khadkevich

Maksim Khadkevich 博士是 NVIDIA 的高级软件工程经理,专门从事分布式推理系统和大语言模型的研究。他的工作将前沿 AI 研究和可扩展工程联系起来,专注于为现实世界的应用开发高性能解决方案。

Posts by Maksim Khadkevich

精选

NVIDIA Dynamo Snapshot:面向 Kubernetes 上推理工作负载的快速启动

在生产环境中的推理部署里,需求会随时间波动,因此推理副本需要弹性扩缩容。然而,在 Kubernetes 上冷启动推理工作负载可能需要几分钟。 4 MIN READ
数据中心/云端

NVIDIA Dynamo 新增 GPU 自动缩放、Kubernetes 自动化和网络优化功能

在 NVIDIA GTC 2025 上,我们宣布推出 NVIDIA Dynamo ,这是一种高吞吐量、低延迟的开源推理服务框架, 2 MIN READ