智能体/生成式 AI
2026年 7月 20日
NVIDIA NVLink:适用于 AI 工厂的纵向扩展网络
对 AI 的需求持续加速。工作负载变得越来越大,模型变得越来越复杂,并且以前所未有的速度部署 AI 计算基础设施的压力越来越大。
3 MIN READ
2026年 7月 15日
借助 NVIDIA DeepStream 9.1 技能构建多摄像头 3D 追踪应用
在大型空间中构建视频分析应用程序的开发者必须在同一物体在摄像头视图之间移动时对其进行跟踪。单摄像头 2D 追踪缺乏可靠的深度信息,
4 MIN READ
2026年 7月 14日
排行榜上的经验教训:5000+ Kagglers 教我们如何改进 AI 推理
NVIDIA Nemotron 模型推理挑战赛邀请了 Kaggle 社区探讨一个重点问题:当每个人都从相同的开放模型、基准测试、
2 MIN READ
2026年 7月 14日
如何借助 RL 智能体技能和 NVIDIA NeMo 运行自动研究工作流
编码 AI 智能体 正成为长期运行的机器学习 (ML) 工作流程的实用运算符。他们可以检查资源库、设置运行时、解决构建问题、启动实验、
4 MIN READ
2026年 7月 14日
使用代理技能在一天内对 NVIDIA Cosmos 3 进行后训练
如果自主编码 AI 智能体 能够在几乎无需人工操作的情况下将您的视觉推理模型的准确率提高 90% 以上,那该多好?
4 MIN READ
2026年 7月 14日
NVIDIA DGX Spark:端到端智能人才招聘解决方案,赋能企业发展
人才招聘是企业扩张与团队搭建的根基。随着数字行业人才竞争日趋白热化,企业传统招聘模式长期深陷三大核心痛点:海量简历人工筛选效率低下、
1 MIN READ
2026年 7月 13日
NVIDIA 正在解码,将色彩代码逻辑错误率降低超过 300 倍
实用的量子计算机需要容错逻辑运算。研究人员正在积极探索许多不同的量子纠错 (QEC) 代码来实现这一点,从而提高量子处理单元 (QPU)…
2 MIN READ
2026年 7月 10日
借助主机卸载减少基于 JAX 的 LLM 训练中的高带宽内存瓶颈
在充分利用计算能力之前,大语言模型 (LLM) 训练工作负载越来越多地遇到 GPU 显存限制。模型权重、梯度、优化器状态、
3 MIN READ
2026年 7月 10日
AI 模型协同设计:硬件友好型 LLM 设计
AI 性能可归结为三个维度: 部署必须平衡这三者:如果响应速度缓慢,就会浪费高准确度;如果每个用户的体验滞后,则原始吞吐量就意味着微不足道。
5 MIN READ
2026年 7月 10日
借助 NVIDIA BioNeMo Agent Toolkit 加速端到端协同折叠性能
生物分子结构预测以及与 OpenFold3 等模型的联合折叠现已成为主流的大规模工作负载,为药物研发和蛋白质设计提供支持。
3 MIN READ
2026年 7月 9日
借助 NVIDIA NeMo 生成用于金融 AI 研究的合成数据
金融自然语言处理 (NLP) 的微调 LLM 受到有限且不平衡的数据的限制。现实世界的金融新闻过度代表收益和股票动态,而信用评级变化、
5 MIN READ
2026年 7月 8日
为 NVIDIA Nemotron 3 Ultra 创建 LangChain 深度智能体线束配置文件以提高性能
代理式系统通常需要在准确性和成本之间做出权衡。性能最高的专有前沿模型和线束可提供最高的准确性,但成本高昂。微调是解决这一问题的一种方法。
3 MIN READ
2026年 7月 7日
NVIDIA Vera CPU 提升 AI 工厂吞吐量,加速代理式工作负载
代理式系统通过结合推理、工具使用、代码执行、检索、编排和结果处理的多步骤工作流,将模型推理转化为行动。随着这些系统在整个 AI 工厂中的扩展,
2 MIN READ
2026年 7月 7日
使用 NVIDIA Nemotron 构建用于工业警报管理的分析 AI 智能体
工业机械产生的警报数量超过技术人员能够进行分类的数量。对于每个需要跟进的重要警报,技术人员都会提取历史背景,确定正确的程序,
2 MIN READ
2026年 7月 2日
基于硬件的 AI 安全性不会拖慢您的速度
AI 改变了组织的运营方式,推动了前所未有的生产力和创新水平。但是,数据隐私、主权以及如何保护使用中的数据,
2 MIN READ
2026年 7月 1日
掌握代理式技术:AI 智能体强化学习
强化学习 (RL) 是调整语言模型的核心,从 AI 助手中的人类反馈强化学习 (RLHF) 到用于推理和智能体任务的较新的具有可验证奖励…
3 MIN READ