Posts by Chenhan Yu
边缘计算
2026年 8月 17日
使用 NVIDIA Model Optimizer 开发基于 QAD 的 Nemotron 3.5 Lightning NVFP4
团队可以自定义模型,在延迟、速度、内存和计算方面达到目标。借助开放式 NVIDIA Nemotron 系列模型,
6 MIN READ
对话式人工智能
2024年 9月 10日
使用 NVIDIA NeMo 和 NVIDIA TensorRT 模型优化器对 LLM 进行训练后量化
随着大语言模型(LLMs)的规模不断扩大,提供易于使用且高效的部署路径变得越来越重要,因为为此类 LLMs 提供服务的成本越来越高。
3 MIN READ