AI在线 AI在线

Agent 的基本架构

根据《A survey on large language model based autonomous agents》智能体综述文章,Agent核心是需要具备以下几个核心特性与模块:Profile模块: Profile 模块的目的主要是做Agent角色认定,回答的核心问题有: 我是谁? 我在哪? 我该干什么?

Agent 的基本架构

根据《A survey on large language model based autonomous agents》智能体综述文章,Agent核心是需要具备以下几个核心特性与模块:

  • Profile模块: Profile 模块的目的主要是做Agent角色认定,回答的核心问题有: 我是谁?我在哪?我该干什么?无论是在当前的人与人之间的协同,还是人与智能体的协同,亦或是智能体与智能体间的协同。
  • Memory模块: Memory即记忆模块,主要用来存储、获取、检索信息。
  • Planning模块: 制定计划,可以根据过去的行为与目标动态规划下一步的行动。
  • Action模块: 执行模块,执行智能体的具体决策。

图片

Profile 模块

角色模块的目的是识别代理的角色。代理通常通过承担特定角色来执行任务,如程序员、教师和领域专家。角色模块通过将代理的配置文件写入提示中,影响LLM的行为。代理配置文件通常包括基本信息(如年龄、性别和职业)、心理学信息(反映代理的个性)和社交信息(详细说明代理之间的关系)。

角色生成策略

  • 手工方法:代理配置文件由人工指定。例如,Generative Agent通过姓名、目标和与其他代理的关系等信息描述代理。
  • LLM生成方法:代理配置文件由LLMs自动生成。例如,RecAgent首先创建几个种子配置文件,然后利用ChatGPT生成更多配置文件。
  • 数据集对齐方法:代理配置文件从现实世界数据集中获取。例如,[29]根据美国国家选举研究(ANES)中参与者的背景信息为GPT-3分配角色。

Memory 模块

记忆模块在代理架构设计中起着非常重要的作用。它存储从环境中感知到的信息,并利用记录的记忆来促进未来的行动。记忆模块帮助代理积累经验、自我进化,并以更一致、合理和有效的方式行事。

记忆结构

  • 统一记忆:仅模拟人类的短期记忆,通常通过上下文学习实现。例如,RLP和SayPlan使用上下文信息作为短期记忆。
  • 混合记忆:明确模拟人类的短期和长期记忆。例如,Generative Agent和AgentSims使用向量数据库实现长期记忆。

记忆格式

  • 自然语言:记忆信息直接使用自然语言描述。例如,Reflexion和Voyager使用自然语言存储体验反馈。
  • 嵌入:记忆信息被编码为嵌入向量。例如,MemoryBank和ChatDev将对话历史编码为向量。
  • 数据库:记忆信息存储在数据库中。例如,ChatDB和DB-GPT使用数据库作为记忆模块。
  • 结构化列表:记忆信息被组织成列表。例如,GITM使用层次树结构存储子目标的动作列表。

记忆操作

  • 记忆读取:从记忆中提取有意义的信息以增强代理的行动。例如,Generative Agent和GITM使用近期性、相关性和重要性评分函数提取信息。
  • 记忆写入:将感知到的环境信息存储在记忆中。例如,ChatDB和RET-LLM使用不同的策略处理记忆重复和溢出问题。
  • 记忆反思:模拟人类反思能力,生成更抽象、复杂和高层次的信息。例如,Generative Agent和GITM通过反思生成高层次见解。

Planning 模块

规划模块旨在赋予代理类似人类的能力,即将复杂任务分解为更简单的子任务并分别解决。规划模块根据代理在规划过程中是否可以接收反馈分为两类:无反馈规划和有反馈规划。

无反馈规划

  • 单路径推理:最终任务被分解为几个中间步骤,每个步骤只导致一个后续步骤。例如,Chain of Thought(CoT)和Zero-shot-CoT使用推理步骤作为提示。
  • 多路径推理:推理步骤被组织成树状结构,每个中间步骤可能有多个后续步骤。例如,Self-consistent CoT(CoT-SC)和Tree of Thoughts(ToT)使用树状推理结构生成计划。
  • 外部规划器:利用外部规划器生成计划。例如,LLM+P和LLM-DP使用外部规划器处理PDDL。

有反馈规划

  • 环境反馈:从环境中获取反馈以影响代理的未来行为。例如,ReAct和Voyager使用环境反馈进行计划。
  • 人类反馈:直接与人类互动以获取反馈。例如,Inner Monologue使用人类反馈调整其行动策略。
  • 模型反馈:利用预训练模型生成反馈。例如,Reflexion和SelfCheck使用模型反馈改进其推理过程。

Action 模块

行动模块负责将代理的决策转化为具体的结果。该模块位于最下游位置,直接与环境交互。行动模块受到角色、记忆和规划模块的影响。

行动目标

  • 任务完成:代理的行动旨在完成特定任务。例如,Voyager和ChatDev中的代理完成任务。
  • 沟通:代理的行动旨在与其他代理或真实人类沟通。例如,ChatDev和Inner Monologue中的代理进行沟通。
  • 环境探索:代理的行动旨在探索不熟悉的环境。例如,Voyager中的代理探索未知技能。

行动生成

  • 通过记忆回忆行动:行动是根据当前任务从代理记忆中提取信息生成的。例如,Generative Agent和GITM使用记忆信息指导行动。
  • 通过计划跟随行动:代理按照其预先生成的计划采取行动。例如,DEPS和GITM中的代理遵循计划。

行动空间

  • 外部工具:利用外部API、数据库和外部模型扩展行动空间。例如,HuggingGPT、ChatDB和ChemCrow使用外部工具。
  • 内部知识:依赖LLMs的内部知识指导行动。例如,DEPS、ChatDev和Generative Agent使用LLMs的规划、对话和常识理解能力。

行动影响

  • 改变环境:代理通过行动直接改变环境状态。例如,GITM和Voyager中的代理改变环境。
  • 改变内部状态:代理采取的行动改变代理本身。例如,Generative Agent和SayCan中的代理更新记忆。
  • 触发新行动:一个代理行动触发另一个行动。例如,Voyager中的代理在收集到所有必要资源后建造建筑物。

通过上述模块的协同作用,基于LLM的自主代理能够模拟人类行为,有效执行多样化任务。

相关资讯

全网爆火的Manus到底能做什么?超多演示案例来了!

关注科技 AI 圈的同学,在 3 月 6 号这天都被 Manus 刷屏了,那么他是个啥呢? 和 DeepSeek 和 Open AI 有什么区别呢? Manus 官网上是这样说的“Manus 是一个通用的人工智能代理,它连接思想和行动:它不仅会思考,还会提供结果。
3/11/2025 12:54:46 AM
益达

速通BOSS需求!零基础AI Agent高效工作流设计指南

此次会连载一套 AI-Agent 构建的系列,主要分为三部分,首先是速通 AI-Agent 构建的工作流基础,然后是通过 ComfyUI 作为案例来复盘如何快速上手工作流平台,最后则是借助 Agent 平台构建一个 AI Agent 案例,本系列意图主要是帮助大家贯通工作流的搭建形式,并尝试思考为自己的工作搭建一些可用的 AI 助手,或是提供构建的方法指引。 无论你是产品经理还是设计师,你会发现商业场景的 AIGC,几乎都没有办法通过一段需求描述或是简单的 Agent 对话就搞定的,你需要更专业更复杂的 AIGC 过程,那么如何理解复杂? 实现专业?
3/18/2025 8:22:14 AM
泡泡bing

唯有惊叹!一手体验首款通用Agent产品Manus

一个新团队突然发了一个首款通用型的项目:Manus。 演示在此,我人直接看麻了。 看完我的第一感觉,人类又要一败涂地了。
3/7/2025 7:43:25 AM
数字生命卡兹克

速通BOSS需求!零基础AI Agent高效工作流设计指南(二)

前言. 此次会连载一套 AI Agent 构建的系列,主要分为三部分,上篇是速通 AI Agent 构建的工作流基础,本篇则是通过 ComfyUI 作为案例来复盘如何快速上手工作流平台,给大家提供一些思路与窍门,下篇则是借助 Agent 平台构建一个 AI Agent 案例,本系列意图主要是帮助大家贯通工作流的搭建形式,并尝试为自己搭建一些可用的 AI 助手,或是提供构建的方法指引。 上期回顾:.
5/13/2025 2:16:53 AM
泡泡bing

这篇 AI Agent 漫游指南,带你建立全面的科技史观

作者 | kong以OpenAI o1与DeepSeek R1为代表的"类Agent"模型、OpenAI DeepResearch为代表的“真Agent”模型,正在重构AI Agent的技术范式。 Agentic Workflow的王座还没坐热,强化学习驱动的端到端Agent模型训练已呼啸而来。 未来趋势已指明:模型即产品,工程化Agent的命运将如何?
5/27/2025 10:05:00 AM
腾讯技术工程

模型吞噬代码,Agent重构世界:当AI Agent与模型协同进化

大家好,我是肆〇柒。 AI 圈的进化速度之快,已是不争的事实。 去年,MCP(模型上下文协议)发布,随后 AI Coding 赛道愈发热闹,Cursor、Cline、Devin、MGX 等产品层出不穷。
5/29/2025 9:57:38 AM
肆零柒

AI Agent!一个万亿市场正在觉醒

"你能帮我订个周末的餐厅吗? " 这句话,你可能每周都要说一遍。 打开手机,搜索餐厅,对比评分,查看菜单,打电话预订...整个流程下来,至少要花15分钟。
6/11/2025 3:00:00 AM
大数据AI智能圈

Gartner:超 40% 的 AI Agent 智能体项目活不过两年

Gartner最新报告显示,超过40%的AI Agent项目因商业利益不佳或误用炒作,预计将在2027年底前消失。调查发现,仅19%的企业对AI智能体进行了大量投资,而42%持保守态度。#AI技术##商业投资#
6/29/2025 11:36:29 AM
漾仔

Lovart国产版超全测评!10分钟做了我一周的工作量!

嗨大家好! 今天是星流 AI 操作员阿真! 之前我有分享过 Lovart 也就是第一个设计 Agent,整合多种 AI 模型来一站式完成概念到成品的创意过程。
7/7/2025 12:30:19 AM
阿真Irene

不用写产品文案了!手把手教你用Coze搭建设计AI助手​

文案是产品与用户沟通的最直接的桥梁,也是影响用户理解和行为决策的关键。 此前,各业务都陆续建立了自己的语义规范。 怎样让静态的语义文档,变成日常工作中随手能用的一个工具,是推进规范应用的重要环节。
7/18/2025 2:14:11 AM
58UXD 团队

碾压ChatGPT Agent:深度测评国产AI智能体神器MiniMax Agent

上周五,ChatGPT Agent mode 上线了。 之前一直有点偷懒,也嫌贵,嫌麻烦,没咋做 Agent 的对比,这次真的想好好评测一下,让我自己有一个认知,于是花了一天的时间,构建了一些我自己的任务。 拿去测一下各家通用 Agent 的情况。
7/24/2025 12:16:19 AM
数字生命卡兹克

Agent KB:经验池让Agents互相学习!GAIA新开源SOTA,Pass@1性能最高提升6.66

近日,来自 OPPO、耶鲁大学、斯坦福大学、威斯康星大学麦迪逊分校、北卡罗来纳大学教堂山分校等多家机构的研究团队联合发布了 Agent KB 框架。 这项工作通过构建一个经验池并且通过两阶段的检索机制实现了 AI Agent 之间的有效经验共享。 Agent KB 通过层级化的经验检索,让智能体能够从其他任务的成功经验中学习,显著提升了复杂推理和问题解决能力。
7/25/2025 3:57:00 PM
机器之心

阿里国际Marco获SAIL奖!日调用量破10亿次,翻译准确率领跑行业

在近日公布的2025世界人工智能大会卓越人工智能引领者SAIL奖评选中,阿里国际跨境电商AI解决方案Marco成功斩获SAIL之星奖项。 据阿里国际透露,公司AI服务调用量持续攀升,平均日调用量已突破10亿次。 生态开放成效显著通过技术共享策略,阿里国际已向集团外生态伙伴开放AI服务能力。
7/28/2025 4:52:11 PM
AI在线

解构GoldMine OS:AI Agent如何破解RWA“不可能三角”

大家好,我是肆〇柒,随着《香港稳定币法案》从提出到8月1日即将生效,合规稳定币的发行与交易框架首次在香港获得法律背书,这不仅为传统资产上链提供了清晰的监管路径,也让“链上数字货币的规模化合规交易”从概念走向现实。 在这一里程碑事件的背后,市场目光重新聚焦于RWA(Real-World Asset)代币化——如何让黄金、债券、房产等传统资产在区块链世界中焕发新生? GoldMine OS给出了一个惊艳答案。
8/1/2025 1:00:00 AM
肆零柒

AI Agent哪个更好用?12个角度全方位深度分析Dify、N8n、Coze三大工具

在数字化转型的浪潮中,AI Agent 工具正成为企业提升效率、优化流程的关键利器。 然而,面对众多选择,如何挑选最适合的工具成为了一个难题。 本文将深入剖析 Dify、N8n 和 Coze 这三款热门 AI Agent 工具,从功能、价格、学习成本、技术架构到实际应用场景,全方位对比它们的优劣,帮助你在选型时避坑,找到最适合自己的工具。
8/8/2025 7:29:52 AM
A ad钙

第一波!2025年8月精选实用设计干货合集

大家好,这是 2025 年 8 月第一波干货合集! 这期干货合集几乎全都是 AI 工具,有基于 AI 的着陆页生成工具,有给 Blender 做的 AI 助手,有免费生成粉色壁纸的 AI 网站,有免费且具备 AI 功能的在线设计平台,有基于 AI 的 Github Readme 文档生成工具,还有一键生成可交互页面的 AI 平台。 当然,在继续阅读下去之前,记得看看往期干货中有没有你感兴趣的素材:下面我们具体看看这一期的干货:.
8/11/2025 7:35:54 AM
陈子木

AI Agent哪个更好用?12个角度深度对比测评三大知名工具

在数字化转型的浪潮中,AI Agent 工具正成为企业提升效率、优化流程的关键利器。 然而,面对众多选择,如何挑选最适合的工具成为了一个难题。 本文将深入剖析 Dify、N8n 和 Coze 这三款热门 AI Agent 工具,从功能、价格、学习成本、技术架构到实际应用场景,全方位对比它们的优劣,帮助你在选型时避坑,找到最适合自己的工具。
8/8/2025 7:29:52 AM
A ad钙

如果有一个能替你操作手机的Agent,你会用它做什么?

往期作者干货:如果你有一个能替你操作手机的 Agent,你会用它来做什么? 替自己回复微信消息? 下单中午想吃的外卖?
8/23/2025 12:28:55 AM
一泽Eze
  • 1