AI 智能体

能够规划并执行多步任务,可访问文件、浏览器与 API 的工具。

13 个工具

智能体是这里最新也最不稳定的分类。它的主张是:工具不再回答问题,而是执行任务 —— 读文件、浏览网页、调 API、写代码、检查自己的结果。顺利的时候,这份杠杆是真实的。智能体和其他所有分类的区别在于它「行动」而不是「建议」,而这改变了你在采用之前需要考虑的事情。

挑选时该看什么

权限就是规格说明

一个智能体是由它被允许接触什么来定义的 —— 你的文件系统、一个已登录你账号的浏览器会话、一把能花钱的 API key、一个它能推送的仓库。有用的问题不是它能做什么,而是它做错时会发生什么。优先选择在不可逆操作前会先问、并且允许你把权限收窄的工具,从能让它发挥作用的最小权限集开始。

它的失败是安静的,不是响亮的

智能体很少崩溃。它们会在一个只做了一半、或者只是看着合理、或者在你去核对之前都像模像样的任务上报告成功。这比一条错误信息难发现得多,也是运行智能体最大的实际成本。请假定每个结果都需要验证,并挑那些「验证比自己做更省事」的任务。

成本随步数增长,而不是随提问次数

一次聊天往来是一次调用。一个智能体处理一项任务可能要调用几十次,每次都重新读一遍上下文,而一个它没能跳出的循环可以很快烧掉预算。找那些会显示步数和花费、并允许你给单次运行设上限的工具 —— 这里的可见性不是奢侈品。

什么时候你其实不需要

如果一项任务的步骤是固定的、你能写下来,那么一个脚本或现成的自动化工具会做得更快、更便宜,而且每次都一模一样。智能体的成本值在那些「步骤取决于沿途发现了什么」的任务上 —— 而在任何「做错了很难撤销」的地方,它都不合适。