最近文章
2026年 8月 26日
NVIDIA NVLink Fusion 将 NVHBM 引入新一代 AI 基础设施
AI 工厂必须支持日益庞大的模型和更复杂的推理工作负载。为了满足 AI 工作负载永无止境的计算需求,
2 MIN READ
2026年 8月 26日
如何使用 AI 智能体训练跨具身机器人导航策略
导航使机器人能够将感知和运动转化为有目的的自主性。与产生稳定运动的运动不同,导航必须用于不断定位机器人、解读不断变化的环境、选择路线,
4 MIN READ
2026年 8月 26日
在 NVIDIA GB300 NVL72 上使用 Qwen3.8-Flash-Next 进行代理式编码实验
阿里巴巴发布了 Qwen3.8-Flash-Next 的模型权重,作为即将推出的 Qwen4 架构的预览,供开发者试验和评估。
2 MIN READ
2026年 8月 25日
在 NVIDIA Dynamo 中借助阴影引擎恢复在数秒内恢复 LLM 推理能力
当 LLM 引擎进程失败时,标准恢复路径涉及冷重启。这需要从存储中将权重加载到 HBM 中,编译内核并捕获 NVIDIA CUDA 计算图。
3 MIN READ
2026年 8月 25日
CUDA Python 1.0:稳定的 API、一个基础、完整的平台访问
多年来,需要 GPU 的 Python 开发者有两种现实选择:一是充分学习 NVIDIA CUDA C++ 以编写扩展程序,
2 MIN READ
2026年 8月 24日
十亿级 AI 和以太网演进:Spectrum-X 以太网如何重写规则
生成式 AI 的迅猛发展从根本上改变了数据中心的设计。随着分布式模型训练规模扩展到数十万个 GPU,
3 MIN READ
2026年 8月 24日
NVIDIA Vera Rubin 和 Blackwell 为代理式 AI 每瓦性能设定新标准
AI 智能体已将推理从单轮交互扩展到多步骤工作流,这些工作流能够进行推理、调用工具、协调子智能体,
3 MIN READ
2026年 8月 24日
NVIDIA Groq 3 LPX 如何在 NVIDIA Vera Rubin 上实现长上下文的超快交互性
NVIDIA Groq 3 LPX 是适用于 NVIDIA Vera Rubin 平台 的交互式 AI 推理加速器。
4 MIN READ
2026年 8月 24日
利用 NVIDIA Vera CPU 应对智能体 AI 集群面临的挑战
AI 工厂是互联系统,其中集群经济性取决于整个堆栈将电力和资本转化为已完成智能体任务的效率。GPU 运行模型时,CPU 会处理编排、
2 MIN READ
2026年 8月 24日
利用 NVIDIA DSX MaxLPS 最大化 AI 工厂的单位功耗性能
AI 工厂是功率受限的工业系统。问题不再是一个数据中心可以容纳多少个 GPU,而是每个可用兆瓦级的 GPU 可以输出多少 AI 输出。
3 MIN READ
2026年 8月 21日
适用于大规模金融工具的 GPU 加速集群
使用 AdaptGrow (一种 GPU 加速的矩阵分解算法) 将滚动相关性和尾依赖性矩阵转换为硬集群、
3 MIN READ
2026年 8月 21日
AI 智能体技术栈中的安全定位
随着 AI 智能体的能力不断增强并能在更长的时间跨度内运行,在其驱动的应用中建立安全性和信任变得越来越重要。
1 MIN READ
2026年 8月 21日
NVIDIA AVO 在 ARC-AGI-3 上达到 100%,展示了适用于长距自动驾驶智能体的前沿通用架构
前沿语言模型只是 AI 智能体 的一个组成部分。周围的智能体系统——通常称为线束——决定了模型如何接收上下文、使用工具、维护状态、响应反馈、
2 MIN READ
2026年 8月 20日
生成式推荐系统如何大规模重新定义 RecSys
推荐系统 (RecSys) 是消费互联网行业最常见的机器学习问题之一,但众所周知,很难进行大规模训练和服务。
3 MIN READ
2026年 8月 19日
使用 CLI、技能和 AI 编码智能体开发 NVIDIA Holoscan 应用
NVIDIA Holoscan 是一个用于在边缘构建实时 AI 应用 (从医学成像到机器人) 的平台。HoloHub 是其配套资源库:
3 MIN READ
2026年 8月 19日
使用 NVIDIA FLARE 构建联邦多模态 AI 工作流
现代视觉语言模型 (VLM)可以支持视觉问答、字幕和图像文本推理等任务。然而,在实践中,
2 MIN READ