如果你从事软件开发、人工智能和大语言模型(LLM)相关工作,你很可能经常使用 AI 智能体。本文将带你构建你的第一个智能体。在动手之前,值得先明确这个术语的含义。答案有很多种,但大多数人认同:AI 智能体是一种软件系统,它使用 LLM 在循环中调用一个或多个工具,以实现某个目标。这个目标可以很简单,比如回答一个问题;也可以很复杂,比如控制你的浏览器预订机票,或开发复杂的软件。
在智能体系统中,循环描述的是模型、应用程序及其工具之间的循环过程。它不一定需要字面意义上的 while 或 for 语句。这里的示例只完整走过该循环一次:模型请求调用工具,Python 运行该工具,模型再利用结果作出回答。出于设计考虑,智能体不会做任何复杂的事情,以便一开始保持简单。
这个示例是一家虚构网上商店的客服助手。订单数据存放在 SQLite 数据库中,因此语言模型无法独自回答订单相关问题。相反,模型会请求调用一个名为 get_order_total 的 Python 函数,该函数查询数据库并返回真实数值。对于 Sarah Jones 的 1001 号订单,正确的总额是 GBP 96.95。
模型可以请求执行某项操作,但是否允许执行、以及实际执行,由 Python 决定。模型通过 Ollama 在本地运行,因此无需云账户或 API 密钥。程序会打印出所请求的函数、其参数以及数据库结果,使整个交互过程清晰可见,而不是隐藏在智能体框架之中。
来源: Towards Data Science · 由HeadlinesBriefing整理摘要