NVIDIA 技术博客
-
智能体/生成式 AI告别 Token 焦虑:用 NVIDIA DGX Spark 打造游戏 UGC 多智能体“AI 圆桌”协作系统
-
网络/通讯NVIDIA Vera Storage 基准测试:加速 AI 原生存储的加密、压缩、完整性检查和恢复
-
数据中心/云端如何在共享 GPU 基础架构上运行隔离的租户 Kubernetes 集群
-
数据中心/云端共同设计 AI 模型注意力,实现快速的交互式长上下文推理
-
数据科学NVIDIA Ising 通过增强的情境学习实现全自动量子计算机校准
最近
2026年 8月 4日
告别 Token 焦虑:用 NVIDIA DGX Spark 打造游戏 UGC 多智能体“AI 圆桌”协作系统
我们是来自苏州大学的学生开发团队。在 挑战杯中国大学生创业计划竞赛,中,本文介绍的这套多智能体协作系统帮助我们获得了 江苏省一等奖。
2 MIN READ
2026年 8月 3日
NVIDIA Vera Storage 基准测试:加速 AI 原生存储的加密、压缩、完整性检查和恢复
存储是每个代理式 AI 工作流的积极组成部分。当智能体检索企业知识、访问持久内存、重复使用键值 (KV) 缓存数据、执行工具并生成新结果时,
3 MIN READ
2026年 8月 3日
如何在共享 GPU 基础架构上运行隔离的租户 Kubernetes 集群
每个团队运行专用的 Kubernetes 集群通常会导致隔离程度超出组织所需的程度。虽然一个集群可以在多个团队之间成功共享,
4 MIN READ
2026年 7月 31日
共同设计 AI 模型注意力,实现快速的交互式长上下文推理
随着代理式和长上下文工作负载变得常见,上下文长度增加,注意力消耗更大比例的推理时间 (图 1) 。由于注意力现在主宰了成本,
6 MIN READ
2026年 7月 27日
NVIDIA Ising 通过增强的情境学习实现全自动量子计算机校准
NVIDIA Ising Calibration 是一个开源视觉语言模型 (VLM) ,旨在解释量子处理器的诊断输出,
2 MIN READ
2026年 7月 27日
案例分享 | 基于 NVIDIA DGX Spark 的智能安防与工业智能方案开发应用
在智慧城市安防升级与工业智能制造转型背景下,传统安防监控与工业运维模式普遍面临诸多瓶颈。为了打破这些技术限制,
1 MIN READ
2026年 7月 27日
六种智能体 Harness 功能可实现更高的模型性能
构建出色的 AI 智能体不仅仅是选择合适的模型。Harness 是围绕模型的架构。渲染上下文、执行动作、管理状态以及决定任务何时完成,
2 MIN READ
2026年 7月 26日
推动半导体在材料工程和制造领域的创新
随着 AI 工作负载的增加,爆炸性的计算需求正在推动半导体行业达到前所未有的性能目标。在快速变化的 AI 硬件周期中,
2 MIN READ
增强现实/虚拟现实
2026年 6月 16日
使用 NVIDIA XR AI 为 AR 眼镜和 XR 设备构建 AI 智能体
为 AR 眼镜和可穿戴设备打造的开发者面临着基础设施缺口。硬件已准备就绪,但要打造 AI 体验,需要集成实时摄像头和麦克风流、
2 MIN READ
2026年 6月 2日
PICO 展示PICO 4 Ultra支持 NVIDIA Isaac Teleop,共同推进标准化的开源机器人遥操方案
在NVIDIA GTC 2026 大会上,
1 MIN READ
2026年 3月 31日
借助 NVIDIA CloudXR 6.0 将高保真空间计算内容串流到任何设备
空间计算正在从可视化转向主动协作,这增加了对 XR 硬件的 GPU 需求,以实时渲染逼真、物理精准、高保真的空间内容。与此同时,
2 MIN READ
2026年 3月 31日
使用 NVIDIA CloudXR.js 构建和流式传输基于浏览器的 XR 体验
为企业用户提供高保真 VR 和 AR 体验通常需要本地应用开发、自定义设备管理和复杂的部署流程。现在,
3 MIN READ
2025年 10月 22日
使用 NVIDIA Nemotron 构建您自己的 Bash 计算机使用代理,只需一小时
如果您能够通过自然语言与计算机通信,让计算机在 Bash 终端中执行任务,而无需手动编写任何命令,该怎么办?
5 MIN READ
2025年 5月 18日
聚焦:Perfect Corp. 利用 NVIDIA TensorRT 和 NVENC 实现个性化的数字化美妆体验
增强现实 (AR) 和 AI 通过提供从虚拟试用到 AI 驱动的造型推荐等超个性化体验,正在彻底改变美妆和时尚行业。
1 MIN READ
2025年 5月 6日
借助 NVIDIA RTX PRO Blackwell 台式机 GPU 实现 Rivian 新一代XR 设计
对于不断突破 XR 界限的专业人士而言,打造身临其境的高保真体验始终充满挑战。在渲染大型数据集和驱动最新的超高分辨率高级 XR 头显设备时,
2 MIN READ
2025年 3月 5日
借助 NVIDIA Omniverse 将 AR 体验串流到 Apple iPad
最近在 MWC 巴塞罗那宣布 ,开发者现在可以将使用 NVIDIA Omniverse 构建的增强现实(AR)体验流式传输到 Apple…
1 MIN READ
数据科学
2026年 7月 9日
借助 NVIDIA NeMo 生成用于金融 AI 研究的合成数据
金融自然语言处理 (NLP) 的微调 LLM 受到有限且不平衡的数据的限制。现实世界的金融新闻过度代表收益和股票动态,而信用评级变化、
5 MIN READ
2026年 7月 8日
在 NVIDIA GB200 NVL72 上使用 GPU 加速的 Presto 运行低延迟分析工作负载
Presto 是一个开源分布式 SQL 引擎,可对超大型数据集快速运行交互式查询。在 NVIDIA GPU 上,
3 MIN READ
2026年 6月 30日
使用 NVIDIA GQE 设计 GPU 加速的查询引擎
GPU 加速的查询引擎通常会受到内存和 I/ O 带宽的限制。NVIDIA 硬件的进步 (包括高带宽显存 (HBM) 、
4 MIN READ
2026年 6月 23日
使用 NVIDIA BioNeMo Agent Toolkit 打造适用于生命科学发现的 AI 科学家
AI 科学家正在成为科学计算的新界面。这些智能体可以阅读论文、编写代码、生成假设、调用 API、检查文件并对结果进行迭代。
2 MIN READ
2026年 6月 16日
构建您自己的金融智能交易基础模型
现代金融网络上的每一次刷卡、转账和付款都会对人类行为模式进行编码。事务数据是企业掌握的最丰富的信号之一。然而,
3 MIN READ
2026年 6月 16日
如何优化基于 Transformer 的模型以进行低精度训练
Transformer 架构是许多现代大型语言和生成式 AI 模型的支柱。随着这些模型规模的扩大,
3 MIN READ
2026年 6月 15日
使用 NVIDIA BioNeMo Recipes 使用 LoRA 微调生物基础模型
基础模型 正在重塑计算生物学。预训练在大量蛋白质或基因组序列的语料库上的模型,如 ESM2 (一种蛋白质语言模型)和 Evo 2 (一种…
4 MIN READ
2026年 6月 9日
借助 NVIDIA DGX Spark Enterprise 可管理性,大规模控制 AI 基础设施的生命周期
随着 AI 基础设施的扩展,企业对运营成熟度的期望与日俱增。组织期望这些系统具备可配置、可观察、安全且可大规模管理的特点,
1 MIN READ