news 2026/1/10 9:41:50

小模型驱动大智能:NVIDIA 新研究实现 2.5 倍效率提升,成本直降 70%

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
小模型驱动大智能:NVIDIA 新研究实现 2.5 倍效率提升,成本直降 70%

小模型驱动大智能:NVIDIA 新研究实现 2.5 倍效率提升,成本直降 70%

论文标题:ToolOrchestra: Elevating Intelligence via Efficient Model and Tool Orchestration

作者团队:英伟达、香港大学

发布时间:2025 年 11 月 27 日

👉 一键直达论文

👉Lab4AI 大模型实验室论文阅读

⭐ 论文简介

大语言模型在解决深度复杂问题时面临计算成本高、推理能力不足的挑战;现有工具代理多依赖单一强大模型,缺乏对“工具编排”的系统性优化,导致效率与成本难以平衡。

这篇论文解决的是,训练一个小型语言模型(Orchestrator) 作为编排器,动态协调多种工具(基础工具、专业 LLMs、通用 LLMs),通过强化学习优化任务完成效果。

⭐ 核心创新

论文核心是训练一个小型语言模型作为“编排器”,通过强化学习让小模型学会 “何时调用、调用什么、如何组合” 工具,实现 “以小控大、降本增效”。

该方法将多工具任务建模为马尔可夫决策过程,编排器通过“多轮滚动”交替执行“推理”和“工具调用”,逐步完成任务。

奖励设计包含三重目标:结果正确性(任务是否解决)、效率(成本与延迟)、用户偏好(工具选择倾向),引导模型平衡性能与成本,适配用户需求。

为支持训练,论文还提出了 ToolScale 数据集,通过模拟工具环境与生成多样化任务,解决端到端 RL 训练的数据稀缺问题。

⭐ 论文的贡献

  • 提出“编排范式”,用小型模型协调工具实现“性能 - 成本”最优;
  • 发布 ToolScale 数据集,推动工具代理研究;
  • 证明小型编排模型在复杂任务上可超越大模型,为低成本、可扩展的 AI 系统提供新思路。
版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2025/12/25 13:53:19

24、云存储队列与表服务操作全解析

云存储队列与表服务操作全解析 在云存储的应用场景中,队列和表服务是非常重要的组成部分。下面将详细介绍队列消息的操作以及 Windows Azure 表服务的相关内容。 队列消息操作 消息入队 向队列中添加消息时,通过发送如下的 HTTP POST 请求: POST /testq1/messages?ti…

作者头像 李华
网站建设 2025/12/30 7:02:43

31、逐跳行为(PHB)及其实现示例

逐跳行为(PHB)及其实现示例 在网络通信中,为了实现不同类型流量的差异化服务,逐跳行为(Per-Hop Behavior,PHB)的概念应运而生。PHB 描述了差分服务(Diffserv)节点对特定差分服务行为聚合体的外部可观察转发行为。下面将详细介绍 PHB 的相关内容。 1. PHB 基础概念与…

作者头像 李华
网站建设 2025/12/25 13:51:51

互联网大厂求职:Java面试中的技术点和业务场景解析

互联网大厂求职:Java面试中的技术点和业务场景解析 场景描述: 在某互联网大厂的面试室内,面试官正襟危坐,而一旁坐着的程序员谢飞机则显得有些紧张。这是谢飞机的第N次面试,前几次的“辉煌战绩”让他今天不敢掉以轻心。…

作者头像 李华
网站建设 2025/12/25 13:48:31

智谱Open-AutoGLM究竟有多强?:3大核心技术解密国产AutoML新范式

第一章:智谱 Open-AutoGLM沉思在大模型与自动化机器学习交汇的前沿,智谱推出的 Open-AutoGLM 引发了广泛的技术关注。它并非传统意义上的 AutoML 工具,而是尝试将自然语言理解能力与自动化建模流程深度融合,实现以“对话”驱动机器…

作者头像 李华
网站建设 2025/12/30 4:08:33

(AutoGLM 2.0 vs 传统建模):性能对比实测,结果令人震惊

第一章:AutoGLM 2.0 vs 传统建模:性能对比实测,结果令人震惊在真实业务场景中对 AutoGLM 2.0 与传统机器学习建模流程进行端到端对比测试,结果显示其效率与精度均实现跨越式提升。本次测试基于金融风控数据集,涵盖特征…

作者头像 李华
网站建设 2025/12/25 13:41:15

29、Git Hooks与项目组合策略详解

Git Hooks与项目组合策略详解 1. 引言 在使用Git进行版本控制的过程中,我们经常会有各种特定的需求,比如在执行某些操作前后自动执行特定任务,或者处理项目中依赖的外部库。Git提供了钩子(Hooks)机制来满足前者的需求,同时对于项目组合,也有多种策略可供选择。 2. Gi…

作者头像 李华