最佳实践
2026年 9月 8日
GR-Inference:面向生成式推荐的推理系统设计与性能评估
基于 Semantic ID(SID)的生成式推荐,将推荐过程转化为短序列自回归生成。这类负载不同于 Chat LLM 的常规生成:
2 MIN READ
2026年 9月 2日
使用预测解码共同设计 AI 模型,加快 LLM 推理速度
本文是关于 AI 模型协同设计的系列文章中的第三篇。它探讨了如何使用预测性解码在保持准确性的同时加速 LLM 推理,
4 MIN READ
2026年 8月 24日
利用 NVIDIA DSX MaxLPS 最大化 AI 工厂的单位功耗性能
AI 工厂是功率受限的工业系统。问题不再是一个数据中心可以容纳多少个 GPU,而是每个可用兆瓦级的 GPU 可以输出多少 AI 输出。
3 MIN READ
2026年 8月 21日
AI 智能体技术栈中的安全定位
随着 AI 智能体的能力不断增强并能在更长的时间跨度内运行,在其驱动的应用中建立安全性和信任变得越来越重要。
1 MIN READ
2026年 8月 19日
使用 NVIDIA FLARE 构建联邦多模态 AI 工作流
现代视觉语言模型 (VLM)可以支持视觉问答、字幕和图像文本推理等任务。然而,在实践中,
2 MIN READ
2026年 8月 13日
NVIDIA × 火山引擎:云端一站式具身智能研发协同方案
火山引擎 veOmniverse 深度整合 NVIDIA 在具身智能方向的核心能力,围绕“数据采集—数据扩增—VLA+RL 后训练—仿真评测”…
1 MIN READ
2026年 8月 12日
如何为 NVIDIA AI 工厂选择全栈可观察性
AI 基础架构跨越多个层,从计算和网络到存储、编排和应用。当性能下降时,识别来源可能很困难,因为在某一层观察到的症状可能源于堆栈中的其他地方。
3 MIN READ
2026年 7月 30日
NVIDIA 示例云:释放 AI 基础设施全部性能的经验教训
由相同的 NVIDIA H100、GB200 NVL72 或 GB300 NVL72 系统构建的两个 AI…
4 MIN READ
2026年 7月 27日
NVIDIA Ising 通过增强的情境学习实现全自动量子计算机校准
NVIDIA Ising Calibration 是一个开源视觉语言模型 (VLM) ,旨在解释量子处理器的诊断输出,
2 MIN READ
2026年 7月 27日
案例分享 | 基于 NVIDIA DGX Spark 的智能安防与工业智能方案开发应用
在智慧城市安防升级与工业智能制造转型背景下,传统安防监控与工业运维模式普遍面临诸多瓶颈。为了打破这些技术限制,
1 MIN READ
2026年 7月 26日
NVIDIA Nemotron 3 Ultra 在代理式 RTL 编码的准确性和效率方面引领开放模型
现代芯片设计日益受到工程时间的限制。寄存器传输级 (RTL) 开发和验证需要具备专门的硬件知识、
3 MIN READ
2026年 7月 23日
使用 NVIDIA OptiX 工具包调试光线追踪应用
NVIDIA OptiX 光线追踪引擎是一种应用框架,可在 GPU 上实现出色的光线追踪性能。
2 MIN READ
2026年 7月 14日
排行榜上的经验教训:5000+ Kagglers 教我们如何改进 AI 推理
NVIDIA Nemotron 模型推理挑战赛邀请了 Kaggle 社区探讨一个重点问题:当每个人都从相同的开放模型、基准测试、
2 MIN READ
2026年 7月 7日
使用 NVIDIA Nemotron 构建用于工业警报管理的分析 AI 智能体
工业机械产生的警报数量超过技术人员能够进行分类的数量。对于每个需要跟进的重要警报,技术人员都会提取历史背景,确定正确的程序,
2 MIN READ
2026年 7月 2日
基于硬件的 AI 安全性不会拖慢您的速度
AI 改变了组织的运营方式,推动了前所未有的生产力和创新水平。但是,数据隐私、主权以及如何保护使用中的数据,
2 MIN READ
2026年 6月 30日
使用 NVIDIA Nsight 开发者工具优化神经重建工作流
NVIDIA Omniverse NuRec 是一种神经重建工作流,
3 MIN READ