商城首页欢迎来到中国正版软件门户

您的位置: 首页 > 文章列表 > 硬件相关 > 推理成本砍至十分之一,英伟达 Nemotron 3 Ultra 刷新开源 AI 智能体性能上限

推理成本砍至十分之一,英伟达 Nemotron 3 Ultra 刷新开源 AI 智能体性能上限

  发布于2026-08-15 阅读(0)

扫一扫,手机访问

英伟达最近在开源大模型领域又扔了一枚重磅冲击波——新一代Nemotron 3 Ultra正式发布。在LangChain最新的深度智能体基准测试里,它直接拿下了开源模型组的最高准确率。性能硬核,但成本却压得很低,这对于正在搭建企业级AI工作流的团队来说,无异于多了一个“性能与预算兼得”的开放选项。


这次评测用的Deep Agents基准,看的是智能体有没有真本事——不是简单的问答,而是多步逻辑推理、外部工具调用、长时记忆存取,甚至复杂任务的动态执行。说白了,就是考验AI能不能在权限范围内走完一整套业务操作。这类智能体在企业流程自动化、海量信息检索、多环节任务统筹、跨平台协同这些场景里,已经是核心AI工具了。

实测数据很说明问题:经过深度调优的Nemotron 3 Ultra,单次推理的运行成本只有行业头部闭源大模型的十分之一,任务处理吞吐量还同步提升了。换句话说,不仅在开源模型里拿下了最优准确率,综合业务处理能力已经可以对标最顶尖的闭源模型。英伟达这次通过全链路优化,把开源模型在复杂产业任务上的短板基本补齐了,算是让开放模型的能力实现了一次跨代跃升。

LangChain联合创始人兼CEO Harrison Chase认为,一个优秀的AI智能体,核心不在于模型本身,而在于配套体系的持续迭代——内存管理、工具调用逻辑、效果评估、模型行为调控这些模块协同优化,效果会形成叠加增益。这次与英伟达的联合验证也证明了一件事:企业完全可以用开源技术栈搭建高性能智能体应用,同时完整掌握自有系统的数据、架构和运维自主权。这才是关键所在。

本文转载于:https://www.163.com/dy/article/L1DHNI9N0514R9OJ.html 如有侵犯,请联系zhengruancom@outlook.com删除。
免责声明:正软商城发布此文仅为传递信息,不代表正软商城认同其观点或证实其描述。

热门关注