Ritika Borkar

Ritika Borkar 是 NVIDIA 的首席架构师兼高级经理,致力于推动模型/ 硬件协同设计,以提高生成式 AI 的服务效率。在 NVIDIA 的长期工作期间,她在堆栈的多个层级开展工作,以优化深度学习性能和效率,同时也是 MLPerf 团队的一员,负责完成多次排名靠前的 MLPerf 基准测试提交。Ritika 还是 MLCommons 董事会成员,致力于为所有人提供更好、更易于使用的 AI。她拥有明尼苏达大学 Twin Cities 分校的电气工程硕士学位。

Posts by Ritika Borkar

数据中心/云端

AI 模型协同设计:硬件友好型 LLM 设计

AI 性能可归结为三个维度: 部署必须平衡这三者:如果响应速度缓慢,就会浪费高准确度;如果每个用户的体验滞后,则原始吞吐量就意味着微不足道。 5 MIN READ
AI 平台/部署

NVIDIA GB200 NVL72 和 NVIDIA Dynamo 如何提升 MoE 模型的推理性能

最新一批开源大语言模型 (LLMs) 采用了 Mixture of Experts (MoE) 架构,如 DeepSeek R1、 4 MIN READ