NeMo
2026年 9月 21日
如何评估从工具调用到任务完成的 AI 智能体
当您发布 AI 智能体 时,关键问题是它能否在实时环境中跨数十次连续工具调用执行工作链,并在步骤失败时恢复。
2 MIN READ
2026年 9月 21日
借助 NVIDIA Earth-2,将您的最新观测结果转化为及时的天气决策
越来越多的天气敏感型行业可以获得观测结果,从而更早、更局部地了解不断变化的天气状况。能源公司收集风能和太阳能资产的测量数据,
4 MIN READ
2026年 9月 16日
如何使用 AI 智能体准备用于仿真的 3D 场景
代理式 AI 工作流可用于为数字孪生准备和验证物理 AI 系统。智能体可以检查 3D 场景、在OpenUSD 中生成仿真相关数据、
4 MIN READ
2026年 9月 15日
密集与 MoE 模型:活动参数、吞吐量以及选择每个模型的时间
一个包含 300 亿个参数的模型如何仅对每个 token 激活 300 亿个参数,同时仍然使用更大模型的容量?Nemotron 3.5…
2 MIN READ
2026年 9月 10日
全栈 NIM 优化如何在 Nemotron 3 Ultra 上为用户提供 2.5 倍的提升
部署大语言模型只是实现生产就绪型服务的第一步。制作团队还需要在可用的 GPU 基础架构上为尽可能多的并发用户提供服务,
2 MIN READ
2026年 9月 10日
使用 BioNeMo 推理运行时进行高吞吐量结构预测
生物分子结构预测现在通常以蛋白质组规模运行,其目标是高效地将整个工作列表移动到工作流中。
3 MIN READ
2026年 9月 10日
从晶圆到第一个 Token:使用 Nemotron 和 Palantir Foundry 编写供应链专业知识
NVIDIA 拥有世界上最大、最复杂的供应链之一,其性能从晶圆到第一个 token 来衡量。间隔分为两部分。从芯片到机架的运行时间 (…
2 MIN READ
2026年 9月 8日
介绍 CUDA Rust:用于编写 GPU 内核的两条轨道
2026 年 9 月,NVIDIA 宣布将在 Rust 中采用原生 GPU 编程。CUDA C++ 和 CUDA Python…
4 MIN READ
2026年 9月 4日
使用 NVIDIA NemoClaw 构建内存驱动型智能体
企业工作涵盖随时间变化的AI 智能体必须先对其进行重建,然后再进行贡献。 为了向智能体提供这种必要的环境,
1 MIN READ
2026年 9月 1日
使用 NVIDIA Nemotron 构建自适应代理式网络安全系统
AI 正在改变网络安全的步伐。代理式系统可以协调工作并长期追求复杂的目标。安全团队开始在安全运营中应用智能体,但许多实施仍然依赖于现有警报、
2 MIN READ
2026年 9月 1日
如何在不超支的情况下调整 GPU 大小以实现 AI 推理和 TCO
AI 采用率的激增正在改变从聊天机器人到内容生成的方方面面。尽管如此,一个常见的痛点仍然存在:
3 MIN READ
2026年 8月 31日
运行 NVIDIA BioNeMo NIM 微服务,在 Claude Science 中进行蛋白质结构预测
代理式 AI 正在改变研究方式。AI 科学家可以阅读论文、提出假设、调用模型,并确定下一步要优先进行的实验。
5 MIN READ
2026年 8月 26日
在 NVIDIA GB300 NVL72 上使用 Qwen3.8-Flash-Next 进行代理式编码实验
阿里巴巴发布了 Qwen3.8-Flash-Next 的模型权重,作为即将推出的 Qwen4 架构的预览,供开发者试验和评估。
2 MIN READ
2026年 8月 24日
NVIDIA Vera Rubin 和 Blackwell 为代理式 AI 每瓦性能设定新标准
AI 智能体已将推理从单轮交互扩展到多步骤工作流,这些工作流能够进行推理、调用工具、协调子智能体,
3 MIN READ
2026年 8月 21日
适用于大规模金融工具的 GPU 加速集群
使用 AdaptGrow (一种 GPU 加速的矩阵分解算法) 将滚动相关性和尾依赖性矩阵转换为硬集群、
3 MIN READ
2026年 8月 17日
使用 NVIDIA Model Optimizer 开发基于 QAD 的 Nemotron 3.5 Lightning NVFP4
团队可以自定义模型,在延迟、速度、内存和计算方面达到目标。借助开放式 NVIDIA Nemotron 系列模型,
6 MIN READ