Home DEVELOPER
  • 首页
  • 博客
  • 论坛
  • 论坛 (英文)
  • 文档
  • 下载
  • 培训
  • 加入

最近

查看全部
2026年 9月 9日

何时使用“编码-预填充-解码”解耦技术来加速多模态模型服务

编码 – 预填充 – 解码 (EPD) 分解是一种适用于多模态模型的推理优化技术,可将视觉编码器阶段与预填充和解码阶段分离开来。
4 MIN READ
何时使用“编码-预填充-解码”解耦技术来加速多模态模型服务
2026年 9月 9日

CUDA 工具包 13.4 在 Arm 上添加了 Windows 支持,并增强了对共享 GPU 的控制

每个 NVIDIA CUDA 工具包版本都增加了功能和性能改进,帮助开发者从 NVIDIA GPU 和更广泛的 NVIDIA…
4 MIN READ
CUDA 工具包 13.4 在 Arm 上添加了 Windows 支持,并增强了对共享 GPU 的控制
2026年 9月 8日

介绍 CUDA Rust:用于编写 GPU 内核的两条轨道

2026 年 9 月,NVIDIA 宣布将在 Rust 中采用原生 GPU 编程。CUDA C++ 和 CUDA Python…
4 MIN READ
介绍 CUDA Rust:用于编写 GPU 内核的两条轨道
2026年 9月 8日

GR-Inference:面向生成式推荐的推理系统设计与性能评估

基于 Semantic ID(SID)的生成式推荐,将推荐过程转化为短序列自回归生成。这类负载不同于 Chat LLM 的常规生成:
2 MIN READ
GR-Inference:面向生成式推荐的推理系统设计与性能评估
2026年 9月 4日

使用 NVIDIA NemoClaw 构建内存驱动型智能体

企业工作涵盖随时间变化的AI 智能体必须先对其进行重建,然后再进行贡献。 为了向智能体提供这种必要的环境,
1 MIN READ
使用 NVIDIA NemoClaw 构建内存驱动型智能体
2026年 9月 4日

前沿推理触手可及:如何在 NVIDIA Jetson 上部署和优化模型

在边缘运行推理和代理式 AI 比以往更加困难。直到最近,能够进行多步骤推理的模型还过于庞大,无法在边缘硬件上本地运行。
3 MIN READ
前沿推理触手可及:如何在 NVIDIA Jetson 上部署和优化模型
2026年 9月 3日

如何在联邦 Kubernetes 和 AI 平台上携带用户身份

现代 AI 平台不再是单一登录屏幕背后的单一应用。用户可以从中央门户开始,打开受治理的数据集,启动数据所在的 Notebook,
2 MIN READ
如何在联邦 Kubernetes 和 AI 平台上携带用户身份
2026年 9月 3日

NVIDIA PAIR 虚拟推理路由器可扩展您本地网络中的可用算力

AI 智能体正在通过合作学习做更多事情。首席智能体可以将复杂的任务分解为较小的作业,并将这些作业分配给专门的子智能体。此外,
2 MIN READ
NVIDIA PAIR 虚拟推理路由器可扩展您本地网络中的可用算力

增强现实/虚拟现实

查看全部
2026年 6月 16日

使用 NVIDIA XR AI 为 AR 眼镜和 XR 设备构建 AI 智能体

为 AR 眼镜和可穿戴设备打造的开发者面临着基础设施缺口。硬件已准备就绪,但要打造 AI 体验,需要集成实时摄像头和麦克风流、
2 MIN READ
使用 NVIDIA XR AI 为 AR 眼镜和 XR 设备构建 AI 智能体
2026年 6月 2日

PICO 展示PICO 4 Ultra支持 NVIDIA Isaac Teleop,共同推进标准化的开源机器人遥操方案

在NVIDIA GTC 2026 大会上,
1 MIN READ
PICO 展示PICO 4 Ultra支持 NVIDIA Isaac Teleop,共同推进标准化的开源机器人遥操方案
2026年 3月 31日

借助 NVIDIA CloudXR 6.0 将高保真空间计算内容串流到任何设备

空间计算正在从可视化转向主动协作,这增加了对 XR 硬件的 GPU 需求,以实时渲染逼真、物理精准、高保真的空间内容。与此同时,
2 MIN READ
借助 NVIDIA CloudXR 6.0 将高保真空间计算内容串流到任何设备
2026年 3月 31日

使用 NVIDIA CloudXR.js 构建和流式传输基于浏览器的 XR 体验

为企业用户提供高保真 VR 和 AR 体验通常需要本地应用开发、自定义设备管理和复杂的部署流程。现在,
3 MIN READ
使用 NVIDIA CloudXR.js 构建和流式传输基于浏览器的 XR 体验
2025年 10月 22日

使用 NVIDIA Nemotron 构建您自己的 Bash 计算机使用代理,只需一小时

如果您能够通过自然语言与计算机通信,让计算机在 Bash 终端中执行任务,而无需手动编写任何命令,该怎么办?
5 MIN READ
使用 NVIDIA Nemotron 构建您自己的 Bash 计算机使用代理,只需一小时
2025年 5月 18日

聚焦:Perfect Corp. 利用 NVIDIA TensorRT 和 NVENC 实现个性化的数字化美妆体验

增强现实 (AR) 和 AI 通过提供从虚拟试用到 AI 驱动的造型推荐等超个性化体验,正在彻底改变美妆和时尚行业。
1 MIN READ
聚焦:Perfect Corp. 利用 NVIDIA TensorRT 和 NVENC 实现个性化的数字化美妆体验
2025年 5月 6日

借助 NVIDIA RTX PRO Blackwell 台式机 GPU 实现 Rivian 新一代XR 设计

对于不断突破 XR 界限的专业人士而言,打造身临其境的高保真体验始终充满挑战。在渲染大型数据集和驱动最新的超高分辨率高级 XR 头显设备时,
2 MIN READ
借助 NVIDIA RTX PRO Blackwell 台式机 GPU 实现 Rivian 新一代XR 设计
2025年 3月 5日

借助 NVIDIA Omniverse 将 AR 体验串流到 Apple iPad

最近在 MWC 巴塞罗那宣布 ,开发者现在可以将使用 NVIDIA Omniverse 构建的增强现实(AR)体验流式传输到 Apple…
1 MIN READ
借助 NVIDIA Omniverse 将 AR 体验串流到 Apple iPad

数据科学

查看全部
2026年 8月 25日

在 NVIDIA Dynamo 中借助阴影引擎恢复在数秒内恢复 LLM 推理能力

当 LLM 引擎进程失败时,标准恢复路径涉及冷重启。这需要从存储中将权重加载到 HBM 中,编译内核并捕获 NVIDIA CUDA 计算图。
3 MIN READ
在 NVIDIA Dynamo 中借助阴影引擎恢复在数秒内恢复 LLM 推理能力
2026年 8月 25日

CUDA Python 1.0:稳定的 API、一个基础、完整的平台访问

多年来,需要 GPU 的 Python 开发者有两种现实选择:一是充分学习 NVIDIA CUDA C++ 以编写扩展程序,
2 MIN READ
CUDA Python 1.0:稳定的 API、一个基础、完整的平台访问
2026年 8月 21日

适用于大规模金融工具的 GPU 加速集群

使用 AdaptGrow (一种 GPU 加速的矩阵分解算法) 将滚动相关性和尾依赖性矩阵转换为硬集群、
3 MIN READ
适用于大规模金融工具的 GPU 加速集群
2026年 8月 19日

使用 NVIDIA FLARE 构建联邦多模态 AI 工作流

现代视觉语言模型 (VLM)可以支持视觉问答、字幕和图像文本推理等任务。然而,在实践中,
2 MIN READ
使用 NVIDIA FLARE 构建联邦多模态 AI 工作流
2026年 8月 18日

使用多个 GPU 在几分钟内运行大规模 UMAP,且不会降低准确性

统一流形近似与投影 (UMAP) 是一种广泛用于可视化和特征提取的降维技术。其应用范围涵盖探索性数据分析、主题建模和单细胞分析。
4 MIN READ
使用多个 GPU 在几分钟内运行大规模 UMAP,且不会降低准确性
2026年 7月 30日

使用 NVIDIA nvmath-python 大规模运行高性能核心数学运算

NVIDIA nvmath-python 是一个库,旨在弥合 Python 科学社区与 NVIDIA CUDA-X 数学库之间的差距。
5 MIN READ
使用 NVIDIA nvmath-python 大规模运行高性能核心数学运算
2026年 7月 27日

NVIDIA Ising 通过增强的情境学习实现全自动量子计算机校准

NVIDIA Ising Calibration 是一个开源视觉语言模型 (VLM) ,旨在解释量子处理器的诊断输出,
2 MIN READ
NVIDIA Ising 通过增强的情境学习实现全自动量子计算机校准
2026年 7月 9日

借助 NVIDIA NeMo 生成用于金融 AI 研究的合成数据

金融自然语言处理 (NLP) 的微调 LLM 受到有限且不平衡的数据的限制。现实世界的金融新闻过度代表收益和股票动态,而信用评级变化、
5 MIN READ
借助 NVIDIA NeMo 生成用于金融 AI 研究的合成数据