Teddy Do

Teddy Do 是 NVIDIA DLFW 组织中 Transformer 引擎团队的性能工程师。她专注于加速 Megatron-LM 等核心框架以及外部客户模型的大规模 Transformer 训练和推理。她在 Drexel 大学获得计算机工程理学学士学位/ 理学硕士学位后,于 2022 年加入 NVIDIA,此前她从事 NVIDIA 数据中心产品诊断工作,为单 GPU 和机架级硬件验证设计最大压力工作负载。

Posts by Teddy Do

智能体/生成式 AI

借助 NVIDIA Transformer 引擎在 JAX 中加速无模型 MoE 训练

多专家模型 (MoE) 已成为大规模 AI 模型训练中的关键架构趋势之一。DeepSeek、Qwen 和 Mixtral 是 MoE… 4 MIN READ