Tool Use(工具调用)

Tool Use

AI 会用计算器/搜网页

亦作、亦称:工具调用

工具调用(Tool Use)是指大语言模型在推理过程中主动识别任务需求、选择并调用外部 API 或函数,再将返回结果纳入后续生成的能力。它是 LLM 从「纯语言系统」迈向「可操作 AI 智能体」的核心机制。

概述

工具调用让模型突破「只会生成文字」的限制,能与真实世界系统交互。

  • 核心思路:模型输出结构化的「调用指令」(函数名 + 参数),执行层将其转发给外部系统,再把结果回传给模型继续推理。
  • 典型工具类型:搜索引擎、代码执行沙箱、数据库查询、第三方 API(天气/日历/支付)、文件读写。
  • 价值所在:解决 LLM 知识截止、数学精度差、无实时数据等固有短板,使模型具备「感知-行动」能力。
  • 行业现状:主流模型(GPT-4o、Claude 3、Gemini 1.5 等)均已原生支持工具调用,成为智能体应用的标配基础设施。

工作原理

工具调用的完整流程分为四个环节,每个环节都有影响成败的关键细节。

  • Schema 注入:在系统提示或上下文中提供工具的 JSON Schema(名称、参数类型、描述),模型据此判断何时调用哪个工具;Schema 描述质量直接决定调用准确率。
  • 调用生成:模型输出符合 Schema 的结构化调用请求(通常为 JSON),而非自然语言;格式错误会直接导致调用失败。
  • 执行与回传:宿主程序或框架(如 LangChain、LlamaIndex)拦截调用、实际执行,并将结果(含错误信息)作为新消息追加到对话上下文。
  • 结果整合:模型读取工具返回值后继续生成,可能发起多轮调用(多步推理),最终汇总给用户。
  • 截断与错误回传:若返回结果过长被截断,或错误信息未正确回传,模型极易产生幻觉或错误推断。

类型与变体

不同框架和场景下,工具调用有几种常见实现形式。

  • Function Calling:OpenAI 2023 年 6 月提出的标准化接口,模型输出结构化调用字段,目前已成为行业事实标准参考格式。
  • ReAct 模式:将推理(Reasoning)与行动(Action)交替进行,模型先「想」再「做」,显式输出思考链后触发工具调用。
  • 并行工具调用:GPT-4 Turbo(2023 年 11 月)和 Claude 3.5 等支持一次输出多个工具调用指令,并行执行后汇总结果,减少往返延迟。
  • MCP(Model Context Protocol):Anthropic 2024 年 11 月提出的开放协议,将工具、资源、提示模板统一标准化,便于跨平台互操作。
  • 代码执行工具:将代码解释器(Python Sandbox)作为特殊工具,让模型通过写代码来完成数学、数据分析等任务(如 ChatGPT 的 Code Interpreter)。

应用场景

工具调用在实际产品中已有大量落地案例。

  • 实时信息检索:调用搜索 API 获取最新新闻、股价、天气,弥补模型知识截止问题。
  • 代码生成与执行:让模型写代码后立即在沙箱运行,验证结果再回答,准确率远超纯文字推理。
  • 企业系统集成:对接 CRM、ERP、数据库,实现「问一句话查销售数据」的自然语言接口。
  • 多步骤任务自动化:智能体依次调用「搜索→读取→写入→发送邮件」等工具链,完成复杂工作流。
  • 多模态扩展:调用图像生成 API 或语音合成,使纯文字模型具备多模态输出能力。

局限与误区

工具调用并非银弹,实际落地中有几个高频踩坑点。

  • Schema 质量决定调用质量:工具描述写得模糊或参数命名不直觉,模型极易调用错误工具或填错参数,这是线上失败的首要原因。
  • 错误处理被忽视:若工具返回异常或空结果时未正确回传错误信息,模型会「脑补」结果,制造幻觉。
  • 上下文窗口压力:多轮工具调用会将大量中间结果塞入上下文,消耗 token,可能触达窗口上限并增加推理成本。
  • 安全风险:提示注入攻击可诱导模型调用危险工具(如删除文件、发送邮件),需在执行层加访问控制与内容过滤。
  • 过度工具化误区:不是所有任务都需要工具;过度工具化会增加延迟和成本,简单问答直接回答更优。

发展脉络

工具调用能力的演进与 LLM 能力边界扩展高度同步。

  • 2023 年 2 月:Meta AI 发布 Toolformer 论文(Schick 等人),首次系统性论证 LLM 可通过自监督方式学会调用外部工具(计算器、搜索、日历等)。
  • 2023 年 6 月OpenAI 在 GPT-3.5 Turbo 和 GPT-4 API 正式引入 Function Calling,提供标准化 JSON Schema 描述与专用响应字段,迅速成为行业参考标准。
  • 2023 年 11 月:OpenAI 发布 GPT-4 Turbo,引入并行工具调用;LangChain、LlamaIndex 等框架将工具调用封装为一等公民,推动智能体应用爆发。
  • 2024 年 3 月:Anthropic 发布 Claude 3 系列并官方命名「Tool Use」功能,成为主流 API 标配。
  • 2024 年 11 月:Anthropic 发布 MCP(Model Context Protocol),尝试将工具连接标准化为独立开放协议层,推动跨平台生态建设。
  • 2025 年起:主流模型竞相优化工具调用准确率与速度,工具调用成为 AI 智能体产品的基础必选项,MCP 逐步获得多家厂商采纳。

常见误解

日常交流中容易听到的简化说法,未必准确,但能帮助理解误解从何而来。

  • 「AI 会用计算器/搜网页」
  • 「模型会调 API」
  • 「函数调用」

相关术语

和本术语关联紧密的其他词条,便于串联理解。

🎯 考点练习

含该术语的高频面试题,含标准答案与追问。

延伸阅读

从知识库精选 2 篇文章,帮助深入理解该术语。

  1. 1

    工具调用:Function Calling 实战

    让大模型调用外部工具,扩展 Agent 的能力边界

  2. 2

    AI Agent 入门:从概念到实现

    理解 AI Agent 的核心组件:感知、规划、记忆和工具调用,以及企业落地实践