让 AI 第一次拥有行动能力
因此对于模型来说整个世界只有两件事情输入文本↓生成文本如果只是聊天、翻译、总结、写代码这已经足够了。但是当我们开始尝试让 AI 帮助完成真实工作时很快就会遇到一个问题当我们问模型:帮我查询今天武汉天气。模型知道武汉吗知道。模型知道天气是什么吗知道。但是它知道今天武汉到底有没有下雨吗不知道。因为今天的天气属于实时信息训练模型的时候还没有发生。再比如帮我计算下面 Excel 的销售总额。模型会计算吗当然会。但是它能够直接打开你的 Excel 文件吗不能。又比如帮我查询数据库中库存不足的商品。模型懂 SQL 吗懂。但是它能够直接连接你的 MySQL 数据库吗仍然不能。于是一个越来越明显的问题出现了LLM 很聪明但它无法直接与现实世界交互。10.1 LLM 为什么不会使用工具这一点其实很好理解。回忆一下第二章介绍过的内容。模型看到的输入其实并不是今天天气怎么样而是经过 Tokenizer 处理之后的一串 Token ID。例如示意[4512,10345,821,…]模型最后输出的也不是今天武汉小雨。而是另一串 Token ID。整个推理过程中Transformer 从头到尾处理的都是数字向量。模型既不会访问互联网也不会打开浏览器更不会执行操作系统命令。换句话说对于 LLM 来说世界上不存在API“数据库”浏览器这些概念它只认识 Token。因此下面这些动作查询天气调用地图执行 Python打开浏览器查询数据库发送邮件对于模型来说本质上都是模型之外发生的事情。10.2 如果让模型自己完成会发生什么来看一个简单的例子。假设用户输入今天武汉天气怎么样模型开始推理。根据训练数据它可能知道武汉夏天比较热七月份经常下雨天气回答通常包含温度、湿度等内容。于是它可能生成今天武汉多云最高气温33℃……问题是,这是真的吗模型根本不知道。它只是根据历史统计规律生成了一段最像天气预报的文字。这就是我们第八章提到的幻觉Hallucination。如果模型能够真正访问天气 API它就不需要猜了。因此,工具调用Tool Calling的本质就是让模型停止猜测转而获取真实数据。10.3 Tool Calling 到底是什么很多人第一次接触 Tool Calling会觉得非常好用。例如你在 ChatGPT 中输入北京今天会下雨吗几秒钟后它真的告诉你今天北京有小雨……甚至还能给出未来几天的天气。很多人以为ChatGPT 学会了查询天气。实际上并不是它学会了某项技能。真正调用的流程其实是用户输入│▼LLM 判断需要查询天气│▼调用天气 API│▼获得真实天气数据│▼再次交给 LLM│▼生成最终回答这里,请注意真正查询天气的不是 LLM而是外部程序。LLM 做的事情只有两件判断是否需要调用工具根据工具返回的结果重新组织语言。这就是 Tool Calling 的本质。10.4 Tool Calling 是谁调用谁很多初学者容易产生一个误区是不是模型自己调用 API答案是否定的。真正调用工具的是 Agent Runtime或者聊天应用。模型只是生成了一段特殊的信息例如{“tool”:“weather”,“city”:“北京”}程序看到这段内容之后会根据返回的值做下面的事情调用天气接口获得返回结果再把结果放回上下文继续让模型推理。因此一个完整流程其实是用户 │ ▼ LLM │ 是否需要工具 │ ┌──────┴──────┐ │ │ 否 是 │ │ ▼ ▼直接回答 Agent Runtime│▼调用真实工具│▼返回执行结果│▼再次调用 LLM│▼输出最终答案这里有一个非常重要的角色第一次出现了Agent Runtime智能体运行时它就像整个系统的调度中心。模型负责思考Runtime 负责执行。10.5 Tool Calling 为什么如此重要Tool Calling 的出现可以说是 AI 应用发展的一个重要分水岭。在它出现之前大模型更像一个知识渊博的顾问能解释概念能回答问题能写文章能生成代码。但所有能力都停留在说的层面。有了 Tool Calling 之后大模型第一次拥有了与外部世界交互的能力查询实时天气搜索互联网调用企业 API查询数据库执行 Python 程序控制浏览器操作本地文件。虽然真正执行这些动作的依然是外部程序但从用户的角度来看AI 已经不再只是一个聊天机器人而开始像一个真正能够做事的助手。因此可以说Tool Calling 并没有改变 LLM 的工作原理却极大扩展了 LLM 的能力边界。本章总结本章我们回答了三个问题为什么 LLM 无法直接操作现实世界因为模型本质上只能处理 Token无法直接访问外部系统。Tool Calling 到底是什么模型负责判断是否需要工具真正执行工具的是外部程序Agent Runtime。为什么 Tool Calling 如此重要它让 AI 从只会说迈向了能够做成为现代 AI Agent 的基础能力。下一章预告

相关新闻

实战解析:如何绕过WAF并逆向WASM加密实现深度渗透测试

实战解析:如何绕过WAF并逆向WASM加密实现深度渗透测试

1. 项目概述:一次针对WAF与WASM加密的实战渗透 最近在做一个授权范围内的安全测试项目,目标是一个金融类Web应用。在初步信息收集和常规漏洞扫描阶段,我遇到了一个典型的“现代防御组合拳”:Web应用防火墙(WAF&#xf…

2026/7/22 8:31:58 阅读更多 →
iOS性能优化利器:Instruments工具全解析

iOS性能优化利器:Instruments工具全解析

1. iOS性能优化与Instruments工具概述在iOS应用开发中,性能优化是确保用户体验的关键环节。一个响应迟缓、内存占用过高或耗电量大的应用,即使用户界面再精美,也难逃被卸载的命运。作为苹果官方提供的性能分析工具套件,Instrument…

2026/7/22 8:31:58 阅读更多 →
征兵管理系统技术实现:微服务架构、数据安全与高并发设计

征兵管理系统技术实现:微服务架构、数据安全与高并发设计

这次我们来看一个与征兵相关的技术项目。虽然"征兵"本身是一个政策性和社会性话题,但在技术领域,我们可以从多个角度来探讨相关的信息化建设、数据处理和系统开发方案。本文将重点分析征兵信息化系统的技术实现方案,包括系统架构、…

2026/7/22 8:31:58 阅读更多 →

最新新闻

嵌入式MMU硬件编程实战:TLB静态配置、保护机制与故障恢复详解

嵌入式MMU硬件编程实战:TLB静态配置、保护机制与故障恢复详解

1. 从硬件视角看MMU:不只是地址转换器 如果你在嵌入式或者系统底层开发领域摸爬滚打过几年,大概率会和我一样,对内存管理单元(MMU)又爱又恨。爱的是,它几乎是现代多任务操作系统和复杂应用能够稳定运行的基…

2026/7/22 9:20:16 阅读更多 →
Rust重构高性能防火墙:雷池SafeLine实践与优化

Rust重构高性能防火墙:雷池SafeLine实践与优化

1. 项目背景与核心价值用Rust重写生产级防火墙这个想法源于我在实际运维工作中遇到的性能瓶颈问题。传统防火墙(如基于iptables的方案)在高并发场景下经常出现CPU占用飙升、规则匹配延迟增加的情况。而雷池SafeLine作为一款国产WAF产品,其&qu…

2026/7/22 9:20:16 阅读更多 →
Open CaptchaWorld:多模态验证码测试与评估平台

Open CaptchaWorld:多模态验证码测试与评估平台

1. 项目概述:Open CaptchaWorld平台的核心定位Open CaptchaWorld是一个面向多模态验证码测试与基准评估的Web平台,旨在为研究人员和开发者提供标准化的测试环境。这个平台最核心的价值在于解决了验证码技术领域长期存在的两个痛点:一是缺乏统…

2026/7/22 9:20:16 阅读更多 →
Godot 源码分析(九):`core/variant/` ── Variant 变体类型系统全景

Godot 源码分析(九):`core/variant/` ── Variant 变体类型系统全景

Godot 源码分析(九):core/variant/ ── Variant 变体类型系统全景 一、为什么 Godot 需要 Variant 在 [开源游戏引擎源码_1.md](file:///d:/my2024/godot/godot/doc/开源游戏引擎源码_1.md) 第三节里我们提过一句:"Godot 用一个叫 Variant 的东西来表示’任意类型的…

2026/7/22 9:20:16 阅读更多 →
任务描述法:如何清晰准确地告诉AI你要写什么

任务描述法:如何清晰准确地告诉AI你要写什么

任务描述法:如何清晰准确地告诉AI你要写什么学习目标 💡 读完这篇文章,你将掌握以下核心能力: 理解为什么"任务描述"是AI写作中最关键的一步掌握任务描述法的六大核心要素学会使用结构化模板来组织你的提示词能够诊断和…

2026/7/22 9:20:16 阅读更多 →
SolidWorks配合关系管理与删除技巧详解

SolidWorks配合关系管理与删除技巧详解

1. SolidWorks配合关系管理基础 在三维建模领域,配合关系(Mate)是定义零部件之间相对位置和运动约束的核心工具。作为SolidWorks的资深用户,我经常遇到需要清理或重建配合关系的情况。配合关系本质上是一种参数化约束,…

2026/7/22 9:19:15 阅读更多 →

日新闻

TI DSP系统配置模块SYSCFG详解:中断机制与主设备优先级配置实战

TI DSP系统配置模块SYSCFG详解:中断机制与主设备优先级配置实战

1. 项目概述与SYSCFG模块的核心价值在嵌入式系统,尤其是像TI C6000系列这样的高性能DSP开发中,我们常常会与芯片手册里那些密密麻麻的寄存器打交道。很多开发者可能更关注算法实现、内存优化或者外设驱动,但对于一个稳定、高效的系统而言&…

2026/7/22 0:00:26 阅读更多 →
微信Server酱:高到达率的应急通知方案实践

微信Server酱:高到达率的应急通知方案实践

1. 为什么我们需要"最次"的通知方案? 在数字化协作环境中,消息通知系统的重要性不言而喻明。但现实情况是,企业级通知方案往往需要复杂的API对接(如企业微信、钉钉、飞书),个人开发者的小项目又经…

2026/7/22 0:00:26 阅读更多 →
甲方要的“简洁“PPT,到底是简洁还是省事?

甲方要的“简洁“PPT,到底是简洁还是省事?

甲方说"简洁一点",乙方听到的是"少做几页"。甲方说"不要太复杂",乙方理解成"别放图表了"。结果交过去,甲方说"我说的简洁不是这个意思"。"简洁"这个词在PPT语境里,是…

2026/7/22 0:00:26 阅读更多 →

周新闻

Go语言静态资源打包方案对比与实践指南

Go语言静态资源打包方案对比与实践指南

1. 项目背景与核心需求在Go语言开发中,我们经常需要处理静态资源文件的打包问题。无论是Web应用的模板文件、前端资源,还是配置文件、证书等,都需要随程序一起分发。传统做法是将这些文件与编译后的二进制文件放在同一目录下,但这…

2026/7/22 8:58:19 阅读更多 →
Go语言实现高性能LDAP认证服务的架构与实践

Go语言实现高性能LDAP认证服务的架构与实践

1. 项目背景与核心价值LDAP(轻量级目录访问协议)作为企业级身份认证的黄金标准,已经服务了超过80%的财富500强公司。我在金融科技领域实施统一认证体系时,发现传统Java方案存在启动慢、内存占用高等痛点。而Go语言凭借其协程并发模…

2026/7/21 5:34:47 阅读更多 →
【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

更多请点击: https://intelliparadigm.com 第一章:AI面试官实战指南的核心价值与适用场景 AI面试官并非替代人类HR的“黑箱工具”,而是以可解释、可审计、可迭代的方式,赋能招聘全链路的关键基础设施。其核心价值在于将主观经验沉…

2026/7/21 8:25:39 阅读更多 →

月新闻