微信扫码
添加专属顾问
我要投稿
今天和大家聊聊一个经典的,贝壳提出的RAISE Agent架构。除了架构之外,还包含一个全面的智能体训练框架,从数据选取到场景增强等等。
From LLM to Conversational Agent: A Memory Enhanced Architecture with Fine-Tuning of Large Language Models
本文介绍了 RAISE(通过 Scratchpad 和示例进行reasoning和acting),这是一种高级架构,可增强 GPT-4 等大型语言模型 ( LLMs ) 与会话Agent的集成。 RAISE 是 ReAct 框架的增强版,包含双组件记忆系统,反映人类短期和长期记忆,以保持对话的上下文和连续性。它需要一个全面的agent构建场景,包括对话选择、场景提取、CoT 完成和场景增强等阶段,最后进入LLMs培训阶段。这种方法似乎增强了agent在复杂的多轮对话中的可控性和适应性。我们在房地产销售环境中的初步评估表明,RAISE 比传统Agent框架具有一些优势,表明其具有更广泛应用的潜力。这项工作为开发更多上下文感知和多功能对话Agent提供了一个强大的框架,为人工智能领域做出了贡献。
RAISE的核心是它的双组件记忆系统,这就像是我们的短期和长期记忆。短期记忆部分,也就是草稿,会记录下最近的互动信息和结论,而长期记忆部分则负责提取与当前对话相关的信息。
这个架构的厉害之处在于,它能让AI在多轮对话中保持连贯性和上下文意识。这就像是,你和AI聊着聊着,它突然能接上你之前提到的一个话题,这种感觉就像是和真人聊天一样自然。
5种Agent框架差异
附带的还包括一个相对全面的智能Agent构建的模型训练方法,包括对话选择、场景提取、思维链完成和场景增强等阶段,最终达到训练大型语言模型的目的。这种方法不仅能提高Agent的控制性和适应性,还能让AI在复杂对话中表现得更好。
实验结果表明,RAISE在房地产销售领域的对话中,比传统的聊天代理有更好的表现。这不仅仅是在房地产领域,RAISE的这些原理和方法论也可以应用到其他领域,显示出它的多功能性。
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费场景POC验证,效果验证后签署服务协议。零风险落地应用大模型,已交付160+中大型企业
2025-03-10
基于 Apple Silicon 架构的Mac部署DeepSeek-R1-671B 模型本地化指南
2025-03-10
RoostGPT:改变了自动化软件测试的游戏规则
2025-03-09
8分钟打造一个DeepSeek API智能测试引擎:当咖啡还没凉,测试报告已出炉
2025-03-09
lceberg 助力 B 站商业化模型样本行级更新的实践
2025-03-09
单卡4090微调DeepSeek-R1-32B
2025-03-08
QwQ总结能力测评,32b小模型真能超过deepseek吗
2025-03-08
为什么vLLM做不到?解密Ollama越级部署黑科技:以DeepSeek-R1-8B为例
2025-03-07
为什么Manus底层模型没用DeepSeek?——Manus六问六答
2025-02-04
2025-02-04
2024-09-18
2024-07-11
2024-07-09
2024-07-11
2024-07-26
2025-02-05
2025-01-27
2025-02-01