Tool Use(工具调用)
Tool UseAI 会用计算器/搜网页
亦作、亦称:工具调用
工具调用(Tool Use)是指大语言模型在推理过程中主动识别任务需求、选择并调用外部 API 或函数,再将返回结果纳入后续生成的能力。它是 LLM 从「纯语言系统」迈向「可操作 AI 智能体」的核心机制。
概述
工具调用让模型突破「只会生成文字」的限制,能与真实世界系统交互。
- 核心思路:模型输出结构化的「调用指令」(函数名 + 参数),执行层将其转发给外部系统,再把结果回传给模型继续推理。
- 典型工具类型:搜索引擎、代码执行沙箱、数据库查询、第三方 API(天气/日历/支付)、文件读写。
- 价值所在:解决 LLM 知识截止、数学精度差、无实时数据等固有短板,使模型具备「感知-行动」能力。
- 行业现状:主流模型(GPT-4o、Claude 3、Gemini 1.5 等)均已原生支持工具调用,成为智能体应用的标配基础设施。
工作原理
工具调用的完整流程分为四个环节,每个环节都有影响成败的关键细节。
- Schema 注入:在系统提示或上下文中提供工具的 JSON Schema(名称、参数类型、描述),模型据此判断何时调用哪个工具;Schema 描述质量直接决定调用准确率。
- 调用生成:模型输出符合 Schema 的结构化调用请求(通常为 JSON),而非自然语言;格式错误会直接导致调用失败。
- 执行与回传:宿主程序或框架(如 LangChain、LlamaIndex)拦截调用、实际执行,并将结果(含错误信息)作为新消息追加到对话上下文。
- 结果整合:模型读取工具返回值后继续生成,可能发起多轮调用(多步推理),最终汇总给用户。
- 截断与错误回传:若返回结果过长被截断,或错误信息未正确回传,模型极易产生幻觉或错误推断。
类型与变体
不同框架和场景下,工具调用有几种常见实现形式。
- Function Calling:OpenAI 2023 年 6 月提出的标准化接口,模型输出结构化调用字段,目前已成为行业事实标准参考格式。
- ReAct 模式:将推理(Reasoning)与行动(Action)交替进行,模型先「想」再「做」,显式输出思考链后触发工具调用。
- 并行工具调用:GPT-4 Turbo(2023 年 11 月)和 Claude 3.5 等支持一次输出多个工具调用指令,并行执行后汇总结果,减少往返延迟。
- MCP(Model Context Protocol):Anthropic 2024 年 11 月提出的开放协议,将工具、资源、提示模板统一标准化,便于跨平台互操作。
- 代码执行工具:将代码解释器(Python Sandbox)作为特殊工具,让模型通过写代码来完成数学、数据分析等任务(如 ChatGPT 的 Code Interpreter)。
应用场景
工具调用在实际产品中已有大量落地案例。
- 实时信息检索:调用搜索 API 获取最新新闻、股价、天气,弥补模型知识截止问题。
- 代码生成与执行:让模型写代码后立即在沙箱运行,验证结果再回答,准确率远超纯文字推理。
- 企业系统集成:对接 CRM、ERP、数据库,实现「问一句话查销售数据」的自然语言接口。
- 多步骤任务自动化:智能体依次调用「搜索→读取→写入→发送邮件」等工具链,完成复杂工作流。
- 多模态扩展:调用图像生成 API 或语音合成,使纯文字模型具备多模态输出能力。
局限与误区
工具调用并非银弹,实际落地中有几个高频踩坑点。
- Schema 质量决定调用质量:工具描述写得模糊或参数命名不直觉,模型极易调用错误工具或填错参数,这是线上失败的首要原因。
- 错误处理被忽视:若工具返回异常或空结果时未正确回传错误信息,模型会「脑补」结果,制造幻觉。
- 上下文窗口压力:多轮工具调用会将大量中间结果塞入上下文,消耗 token,可能触达窗口上限并增加推理成本。
- 安全风险:提示注入攻击可诱导模型调用危险工具(如删除文件、发送邮件),需在执行层加访问控制与内容过滤。
- 过度工具化误区:不是所有任务都需要工具;过度工具化会增加延迟和成本,简单问答直接回答更优。
发展脉络
工具调用能力的演进与 LLM 能力边界扩展高度同步。
- 2023 年 2 月:Meta AI 发布 Toolformer 论文(Schick 等人),首次系统性论证 LLM 可通过自监督方式学会调用外部工具(计算器、搜索、日历等)。
- 2023 年 6 月:OpenAI 在 GPT-3.5 Turbo 和 GPT-4 API 正式引入 Function Calling,提供标准化 JSON Schema 描述与专用响应字段,迅速成为行业参考标准。
- 2023 年 11 月:OpenAI 发布 GPT-4 Turbo,引入并行工具调用;LangChain、LlamaIndex 等框架将工具调用封装为一等公民,推动智能体应用爆发。
- 2024 年 3 月:Anthropic 发布 Claude 3 系列并官方命名「Tool Use」功能,成为主流 API 标配。
- 2024 年 11 月:Anthropic 发布 MCP(Model Context Protocol),尝试将工具连接标准化为独立开放协议层,推动跨平台生态建设。
- 2025 年起:主流模型竞相优化工具调用准确率与速度,工具调用成为 AI 智能体产品的基础必选项,MCP 逐步获得多家厂商采纳。
常见误解
日常交流中容易听到的简化说法,未必准确,但能帮助理解误解从何而来。
- 「AI 会用计算器/搜网页」
- 「模型会调 API」
- 「函数调用」
相关术语
和本术语关联紧密的其他词条,便于串联理解。
🎯 考点练习
含该术语的高频面试题,含标准答案与追问。
- 中级场景查看详解 →
Agent 调用工具失败时应如何设计重试与回退?
区分错误类型:瞬时错误带退避重试,参数错误回灌让模型修复,持久失败走回退并把错误反馈给模型决策。
- 中级场景查看详解 →
Function Calling 在实际产品里怎么用?举个例子
给模型一组工具 schema,它按需返回要调的函数和参数,你执行后回灌结果,让模型能行动、拿实时数据。
- 中级概念高频查看详解 →
什么是 MCP(Model Context Protocol)?解决什么问题?
Anthropic 提出的开放协议,标准化 LLM 与外部工具/数据源连接,类似 AI 应用的 USB 接口。
- 中级概念高频查看详解 →
什么是 ReAct 模式?它如何解决 Agent 的推理与行动问题?
ReAct 交替生成推理(Thought)和行动(Action),观察结果(Observation)后继续,把链式推理与工具使用融为一体。
延伸阅读
从知识库精选 2 篇文章,帮助深入理解该术语。
