基准测试
2026年 9月 21日
借助 NVIDIA Dynamo-Triton 中的 NVIDIA TensorRT 多设备集成,简化跨多个 GPU 的模型服务
生成式 AI 对计算和内存的需求日益超出单个 GPU 的能力。NVIDIA TensorRT 多设备推理是一项新功能,
3 MIN READ
2026年 9月 18日
借助 AIPerf 对 LLM 进行大规模基准测试推理
在系统上部署模型。启动后,提示得到响应。难题是:速度快吗? 直觉可能会引导您发送 curl 命令、手动滚动异步脚本或另一个一次性负载生成器。
3 MIN READ
2026年 9月 16日
TensorRT Edge-LLM 在 Jetson AGX Thor 上实现 MLPerf Edge Agentic Benchmark 6.4 倍加速
AI 智能体正从云数据中心转向车辆、机器人和其他边缘设备。与只回答单个提示的聊天机器人不同,智能体需要执行一系列步骤。它会选择工具、评估结果,
2 MIN READ
2026年 8月 25日
在 NVIDIA Dynamo 中借助阴影引擎恢复在数秒内恢复 LLM 推理能力
当 LLM 引擎进程失败时,标准恢复路径涉及冷重启。这需要从存储中将权重加载到 HBM 中,编译内核并捕获 NVIDIA CUDA 计算图。
3 MIN READ
2026年 8月 24日
NVIDIA Vera Rubin 和 Blackwell 为代理式 AI 每瓦性能设定新标准
AI 智能体已将推理从单轮交互扩展到多步骤工作流,这些工作流能够进行推理、调用工具、协调子智能体,
3 MIN READ
2026年 8月 24日
NVIDIA Groq 3 LPX 如何在 NVIDIA Vera Rubin 上实现长上下文的超快交互性
NVIDIA Groq 3 LPX 是适用于 NVIDIA Vera Rubin 平台 的交互式 AI 推理加速器。
4 MIN READ
2026年 8月 24日
利用 NVIDIA Vera CPU 应对智能体 AI 集群面临的挑战
AI 工厂是互联系统,其中集群经济性取决于整个堆栈将电力和资本转化为已完成智能体任务的效率。GPU 运行模型时,CPU 会处理编排、
2 MIN READ
2026年 8月 21日
NVIDIA AVO 在 ARC-AGI-3 上达到 100%,展示了适用于长距自动驾驶智能体的前沿通用架构
前沿语言模型只是 AI 智能体 的一个组成部分。周围的智能体系统——通常称为线束——决定了模型如何接收上下文、使用工具、维护状态、响应反馈、
2 MIN READ
2026年 7月 27日
NVIDIA Ising 通过增强的情境学习实现全自动量子计算机校准
NVIDIA Ising Calibration 是一个开源视觉语言模型 (VLM) ,旨在解释量子处理器的诊断输出,
2 MIN READ
2026年 7月 26日
NVIDIA Nemotron 3 Ultra 在代理式 RTL 编码的准确性和效率方面引领开放模型
现代芯片设计日益受到工程时间的限制。寄存器传输级 (RTL) 开发和验证需要具备专门的硬件知识、
3 MIN READ
2026年 6月 25日
使用 NVIDIA TensorRT 和多设备推理支持,跨多个 GPU 扩展 AI 推理
生成式 AI 工作负载的显存和计算预算正迅速超出单个 GPU。对于构建媒体生成工作流的推理开发者而言,
4 MIN READ
2026年 6月 16日
NVIDIA Blackwell 凭借业界领先的规模和性能超越 MLPerf 训练 6.0
NVIDIA 对 MLPerf Training v6.0 进行了彻底的测试,这是 MLCommons 联盟开发的最新版行业标准 AI…
3 MIN READ
2026年 6月 12日
NVIDIA 在首个代理式 AI 基准测试中实现了领先的代理式编码性能
AI 智能体从根本上改变了推理工作负载的复杂性。到目前为止,业界一直在努力定义用于衡量推理系统在这些条件下的性能的标准。
2 MIN READ