文章介绍了Agent(智能体)的概念和五个关键工作步骤:1) Prompt提示词构建,强调清晰表达需求;2) 利用LLM大模型进行任务规划和知识推理;3) Memory知识库管理,包括感觉、短期和长期记忆;4) Planning任务规划,采用提示词、CoT思维链和ToT思维链等技术;5) Action工具使用,包括内置工具、插件、API和RPA。Agent需要不断调试完善,通过添加多模态等场景提升智能水平。

典型的Agent工作流程

关键步骤一:Prompt提示词**【圈定角色范围、阐述任务背景、习惯特色】**

提示词是Agent接收到的初始输入,它描述了Agent需要完成的任务或解决的问题。提示词可以是文本、图像、语音等多种形式。Agent需要对提示词进行解析和理解,以便为后续的任务规划和行动执行提供指导。

智能体的提示词要统一:对话涉及到发展平台的生态供应方,包括行业规范、背景知识和智能体的提示词。提示词包括上下文和指令,需要注意清晰表达需求、统一称谓代词和避免行业黑话。

(1)通用指令构成

  • Context 上下文:说明想让大模型执行任务的背景

  • Instruction 指令:说明你想让模型执行什么任务

  • Input Data 输入数据:说明用户要输入什么内容

  • Outpt Indicator 输出提示:规定输出结果内容(说清想要+不想要)

(2)Tips

  • 减少模糊表达,明确提出你的需求

  • 指令中的成为代词要统一,不要反复切换,可能会造成AI大模型理解混乱

  • 指令中尽可能不要体现行业黑话,可能会造成AI大模型理解障碍

总结:提示词写得好不好直接影响处理结果

最简单的指令公式: 你想让智能体扮演的角色+希望TA根据用户什么样输入信息来生成什么样的结果+对助手所生成的内容的详细要求

示例

你是一名资深导游。我的目的地以及预计游玩时间是xxxx,你需要根据我提供目的地和预计游玩时间,给我提参观建议,为我制定旅行计划。你所制定的旅行计划必须具有可行性,不能行程太过紧凑,要考虑通行时间。

(可将用户输入内容,带入通配符位置,形成完整的一段命令,发送给模型请求结果)

关键步骤二:LLM大模型**【理解、提取、识别、选择】**

LLM大模型(Large Language Model)是Agent进行任务规划和知识推理的重要工具。它通过对大量文本数据的学习,具备了强大的语言处理能力和知识推理能力。Agent可以利用LLM大模型对提示词进行深入分析,生成可能的解决方案,并进行选择和优化。

关键步骤三:Memory知识库**【调用、匹配、当前输入内容、上下文内容、向量数据库】**

分类简述
感觉记忆当前用户输入内容,包括文本、图像或其他形式,短暂保留感觉印象
短期记忆上下文内容(包括写在Prompt中的信息),处理复杂任务的临时存储空间,受有限的上下文长度限制
长期记忆(字)外部向量存储的知识库,Agent使用时可快速检索,具备储量大的优点。以文本字段内容形式存在
长期记忆(文)外部向量存储的知识库文件,Agent使用时可快速检索,具备存储量大的优点,比如docx、xlxs、csv、pdf、ppt、jpg、txt等
长期记忆(网)填写网页URL、自动检索网页信息,并将网页信息作为知识库

关键步骤四:Planning任务规划**【分析方式、分析思考、推理痕迹】**

任务规划是Agent根据提示词、LLM大模型以及知识库进行决策和规划的过程。它涉及对人物的分解、目标的设定、路径的规划等多个方面。Agent需要综合考虑各种因素,制定出最合适的任务执行方案。

方式技术简述
Prompt提示词任务的分解环节可以由三种方式完成: 1)在大模型输入简单的提示,比如“XYZ的步骤”,或者“实现XYZ的子目标是什么?”; 2)使用特定任务的指令,比如在需要写小说的时候要求大模型“写一个故事大纲”; 3)通过人工提供信息,网站地图/RPA流程最佳实践
CoT思维链已成为一种标准的提示技术,用于提高模型在复杂任务中的表现。模型被要求“一步一步地思考”,将间距地任务分解为更小更简单地步骤。思维链将大人物转化为多个可管理的任务,并帮助人们理解模型的思维过程。
ToT思维链通过在任务的每一步探索多种推理可能性来扩展思维链。它首先将问题分解为多个思考步骤,并在每个步骤中生成多个想法,从而创建一个树状结构。搜索过程可以是BFS(广度优先搜索)或DFS(深度优先搜索)

关键步骤五:Action工具使用**【执行、返回、执行】**

行动执行是Agent根据任务规划结果执行具体操作的过程。他可能涉及与环境的交互、数据的收集和处理、决策的调整等多个环节。Agent需要准确地执行每一步操作,以确保任务能够顺利完成。

方式技术简述
内置工具大模型内置工具,可直接使用,包括有:日历、计算器、代码解释器、搜索等
Plugin插件用于扩展Agent功能的插件,可以通过Agent插件来实现一些特定的功能或者对Agent进行定制化的配置。Agent插件通常包括以下几个部分: 1、插件配置文件:用于配置插件的参数和属性,通常是一个XML或者JSON格式的文件。 2、插件类库:包含插件的代码和依赖库,通常是一个JAR或者DLL文件 3、插件接口:定义了插件与Agent之间的交互接口,包括插件的初始化、启动、停止等操作。
API接口应用程序编程接口(API接口),是应用程序重要的组成部分,就是应用程序对外提供了一个操作数据的入口,这个入口可以是一个函数或类方法,也可以是一个url地址或者一个网络地址
RPA桌面自动化是一种机器人流程自动化技术,它允许通过配置自动化软件模拟和人类在软件系统中交互的动作来执行业务流程,RPA软件机器人在应用程序界面上识别数据并像人类一样操纵应用程序。
Agent的编排真的是需要不断地调试才行,周三去我们集团公司交流智能体,有个部门领导说,智能体的编排就是在不断完善那些场景,比如最开始只支持自然语言,后来场景需要加上了多模态,多模态又需要考虑多种类型的文件处理。这个过程就是一个填坑的过程,慢慢的智能体就会越来越“智能”。

读者福利大放送:如果你对大模型感兴趣,想更加深入的学习大模型**,那么这份精心整理的大模型学习资料,绝对能帮你少走弯路、快速入门**

如果你是零基础小白,别担心——大模型入门真的没那么难,你完全可以学得会

👉 不用你懂任何算法和数学知识,公式推导、复杂原理这些都不用操心;
👉 也不挑电脑配置,普通家用电脑完全能 hold 住,不用额外花钱升级设备;
👉 更不用你提前学 Python 之类的编程语言,零基础照样能上手。

你要做的特别简单:跟着我的讲解走,照着教程里的步骤一步步操作就行。

包括:大模型学习线路汇总、学习阶段,大模型实战案例,大模型学习视频,人工智能、机器学习、大模型书籍PDF。带你从零基础系统性的学好大模型!

现在这份资料免费分享给大家,有需要的小伙伴,直接VX扫描下方二维码就能领取啦😝↓↓↓
在这里插入图片描述

为什么要学习大模型?

数据显示,2023 年我国大模型相关人才缺口已突破百万,这一数字直接暴露了人才培养体系的严重滞后与供给不足。而随着人工智能技术的飞速迭代,产业对专业人才的需求将呈爆发式增长,据预测,到 2025 年这一缺口将急剧扩大至 400 万!!
在这里插入图片描述

大模型学习路线汇总

整体的学习路线分成L1到L4四个阶段,一步步带你从入门到进阶,从理论到实战,跟着学习路线一步步打卡,小白也能轻松学会!
在这里插入图片描述

大模型实战项目&配套源码

光学理论可不够,这套学习资料还包含了丰富的实战案例,让你在实战中检验成果巩固所学知识
在这里插入图片描述

大模型学习必看书籍PDF

我精选了一系列大模型技术的书籍和学习文档(电子版),它们由领域内的顶尖专家撰写,内容全面、深入、详尽,为你学习大模型提供坚实的理论基础。
在这里插入图片描述

大模型超全面试题汇总

在面试过程中可能遇到的问题,我都给大家汇总好了,能让你们在面试中游刃有余
在这里插入图片描述

这些资料真的有用吗?

这份资料由我和鲁为民博士(北京清华大学学士和美国加州理工学院博士)共同整理,现任上海殷泊信息科技CEO,其创立的MoPaaS云平台获Forrester全球’强劲表现者’认证,服务航天科工、国家电网等1000+企业,以第一作者在IEEE Transactions发表论文50+篇,获NASA JPL火星探测系统强化学习专利等35项中美专利。本套AI大模型课程由清华大学-加州理工双料博士、吴文俊人工智能奖得主鲁为民教授领衔研发。

资料内容涵盖了从入门到进阶的各类视频教程和实战项目,无论你是小白还是有些技术基础的技术人员,这份资料都绝对能帮助你提升薪资待遇,转行大模型岗位。
在这里插入图片描述
👉获取方式

😝有需要的小伙伴,可以保存图片到VX扫描下方二维码免费领取【保证100%免费】
在这里插入图片描述
相信我,这套大模型系统教程将会是全网最齐全 最适合零基础的!!

Logo

码道开发者社区,聚焦华为云码道 CodeArts 代码智能体,沉淀 Agent、Skill、鸿蒙开发实战内容,供开发者查阅资料、交流技术、分享工程实践

更多推荐