Posts by Seonghee Lee
智能体/生成式 AI
2026年 9月 14日
借助 NVIDIA Transformer 引擎在 JAX 中加速无模型 MoE 训练
多专家模型 (MoE) 已成为大规模 AI 模型训练中的关键架构趋势之一。DeepSeek、Qwen 和 Mixtral 是 MoE…
4 MIN READ
边缘计算
2026年 8月 17日
使用 NVIDIA Model Optimizer 开发基于 QAD 的 Nemotron 3.5 Lightning NVFP4
团队可以自定义模型,在延迟、速度、内存和计算方面达到目标。借助开放式 NVIDIA Nemotron 系列模型,
6 MIN READ
智能体/生成式 AI
2026年 6月 26日
使用 NVIDIA Model Optimizer 创建 NVIDIA Nemotron 3 Ultra NVFP4 Checkpoint
随着上下文窗口变长,高效移动大型模型权重对性能至关重要。解决此问题的常用方法是量化,这是一种将模型权重压缩为较小数据格式的优化技术。
6 MIN READ
智能体/生成式 AI
2026年 2月 25日
借助 NVIDIA Blackwell Ultra 提升 Softmax 的效率
LLM 上下文长度呈爆炸式增长,架构正朝着更复杂的注意力机制发展,例如多头潜在注意力(MLA)和分组查询注意力(GQA)。因此,
2 MIN READ