NVLink
2026年 10月 7日
在 NVIDIA cuOpt 中使用 mPDLP 将决策优化扩展到 1 亿个变量及更多变量
与以往相比,供应链问题正在扩展到更多的 SKU、通道和限制条件,而能源网络正在实时平衡更多的分布式来源。为了应对这些挑战,
4 MIN READ
2026年 9月 22日
借助 NVIDIA 机密计算实现私有高性能生产级 AI 推理
随着大语言模型 (LLM) 推理越来越多地在个人、企业和受监管环境中处理敏感信息和专有模型上下文,数据必须在可信环境中处理。
2 MIN READ
2026年 9月 15日
NVIDIA NVLink 6 如何为 AI 工厂提供多层弹性
对于大型 AI 工厂的运营商而言,最大化连续输出对于提高生产力至关重要。在大规模 AI 训练中,
2 MIN READ
2026年 9月 14日
借助 NVIDIA Transformer 引擎在 JAX 中加速无模型 MoE 训练
多专家模型 (MoE) 已成为大规模 AI 模型训练中的关键架构趋势之一。DeepSeek、Qwen 和 Mixtral 是 MoE…
4 MIN READ
2026年 8月 26日
NVIDIA NVLink Fusion 将 NVHBM 引入新一代 AI 基础设施
AI 工厂必须支持日益庞大的模型和更复杂的推理工作负载。为了满足 AI 工作负载永无止境的计算需求,
2 MIN READ
2026年 7月 21日
深入了解 NVIDIA Rubin GPU 架构:助力代理式 AI 时代
最初是离散 AI 模型训练和面向人类的聊天界面,后来演变为始终在线的 AI 工厂,致力于大规模生产智能。现在,
4 MIN READ
2026年 7月 21日
NVIDIA Vera CPU:专为实现代理式 AI 的最大单线程性能而打造的 Olympus Core
代理式 AI 将更多的关键执行路径转移到 CPU 上。智能体在沙盒中执行代码、调用工具、检索上下文、与数据库交互,以及分析结果,
3 MIN READ
2026年 7月 20日
NVIDIA NVLink:适用于 AI 工厂的纵向扩展网络
对 AI 的需求持续加速。工作负载变得越来越大,模型变得越来越复杂,并且以前所未有的速度部署 AI 计算基础设施的压力越来越大。
3 MIN READ
2026年 7月 8日
在 NVIDIA GB200 NVL72 上使用 GPU 加速的 Presto 运行低延迟分析工作负载
Presto 是一个开源分布式 SQL 引擎,可对超大型数据集快速运行交互式查询。在 NVIDIA GPU 上,
3 MIN READ
2026年 7月 2日
基于硬件的 AI 安全性不会拖慢您的速度
AI 改变了组织的运营方式,推动了前所未有的生产力和创新水平。但是,数据隐私、主权以及如何保护使用中的数据,
2 MIN READ
2026年 6月 16日
NVIDIA Blackwell 凭借业界领先的规模和性能超越 MLPerf 训练 6.0
NVIDIA 对 MLPerf Training v6.0 进行了彻底的测试,这是 MLCommons 联盟开发的最新版行业标准 AI…
3 MIN READ
2026年 6月 12日
NVIDIA 在首个代理式 AI 基准测试中实现了领先的代理式编码性能
AI 智能体从根本上改变了推理工作负载的复杂性。到目前为止,业界一直在努力定义用于衡量推理系统在这些条件下的性能的标准。
2 MIN READ
2026年 5月 21日
借助 Slurm 拓扑感知型作业调度功能,在 NVIDIA GB200 NVL72 上实现百万兆级性能
随着AI模型的规模和复杂性持续提升,要充分发挥现代加速基础设施的性能,关键在于如何合理分配工作负载以及硬件的部署方式。
3 MIN READ
2026年 5月 21日
在电信 AI 工厂构建词元+ Metered AI 服务
全球各地的电信公司正基于主权AI工厂基于NVIDIA云合作伙伴(NCP)参考架构,建设,使政府、企业和初创公司能够以适当的控制力、
3 MIN READ
2026年 2月 3日
在 JAX 和 XLA 中加速长上下文模型训练
大语言模型(LLM)的上下文窗口正在迅速扩展,近期的模型已支持128K、256K甚至更长的词元序列。然而,
3 MIN READ
2024年 6月 12日
NVIDIA 在 MLPerf Training v4.0 中创造了新的生成式 AI 性能和规模记录
生成式 AI 模型具有多种用途,例如帮助编写计算机代码、创作故事、作曲、生成图像、制作视频等。而且,随着这些模型的大小不断增加,
3 MIN READ