Skip to main content
应用开发

新版智能体应用(Agent 2.0)

新版智能体应用(Agent 2.0)将知识库、MCP 等多种能力统一为工具,并通过自主思考和规划来调用,以解决复杂任务。

版本对比与选型建议

新版智能体为大多数应用场景提供了更优的性能和开发体验,在没有旧版本依赖需求时,推荐使用新版。
对比维度旧版本(Agent 1.0)新版本(Agent 2.0)
规划与调度智能体在检索知识库后,再决策是否调用 MCP 等其他工具。将知识库、MCP 统一为工具,由智能体自主规划在何时、以何种顺序进行调用。
过程透明度只展示最终结果,无法完整回溯中间决策。能完整展示每一轮的"规划-执行-反思"链路的全过程。
适用场景适用于意图单一、流程固定的简单任务。能够完成从简单问答到复杂规划的各类任务。

快速开始:创建一个基础智能体

  1. 访问阿里云百炼控制台应用管理,单击创建应用,选择智能体应用 > Agent 2.0
  2. 填写应用名称,单击立即创建。创建完毕后自动跳转至应用配置界面。
  3. 在模型选择器的下拉菜单中选择模型,例如 千问-Plus-Latest
  4. 在右侧对话框中输入问题:你是谁?

能力配置

模型选择

为确保多步规划效果,推荐选用具备强工具调用能力的模型,如 千问-Max 系列模型。
  1. 在模型选择器的下拉菜单中选择模型。单击更多模型可以选择其他模型。
  2. 单击模型选择器右侧的设置,支持修改的参数如下:
    • 最长回复长度:模型生成的长度限制,不包含提示词。
    • 温度系数:控制生成随机性和多样性,数值越高随机性越强。
    • enable_thinking:是否开启思考模式。开启思考模式有助于提升智能体的反思效果。不支持思考模式的模型无法配置 enable_thinking 参数。

提示词

系统提示词用于定义智能体角色、行为指令与能力边界,以确保其在交互中始终保持一致性、可控性和任务合规性。
  1. 配置系统提示词:配置系统提示词为 请你模仿《百年孤独》的风格来回答我的问题,以下是效果对比:
    • 无系统提示词:模型以默认身份回复。
    • 配置系统提示词:模型以指定风格回复。
  2. 在系统提示词中使用自定义变量(可选):除了支持输入静态文本,系统提示词还允许嵌入自定义变量。
    1. 单击提示词右上方的自定义变量,设置自定义变量,单击确定保存。
    2. 输入 /,使用已配置的变量。

预解析文件

预解析文件功能用于控制上传文件的处理方式。
  • 关闭预解析:关闭后,系统不会主动解析文件。文件的 URL 会作为上下文信息传递给智能体,智能体可在后续步骤中决策是否调用工具,并将该 URL 作为参数传入。
  • 开启预解析:开启后,系统将使用预置解析器处理上传的文档、图像、视频、音频等文件,并返回解析后的文本内容给模型作为参考。
千问-VL 系列模型由于具备多模态能力,即使关闭预解析文件,也能够直接解析图片和视频文件。

内置工具

内置工具在隔离的沙箱环境中运行,提供代码执行和文件操作能力。全部工具默认关闭,按需开启。
工具说明
bash执行 shell 命令,支持 bash、python3、pip 等命令行操作。
write创建或覆盖文件,自动创建父目录。
read读取文件内容,支持按行范围读取大文件。
edit在文件中做精确文本替换(find and replace)。
glob按模式搜索文件,返回匹配的文件路径列表。
grep在文件中搜索内容,支持正则表达式。
download_file将执行过程中生成的文件导出为可下载链接。

知识库

知识库使智能体能够查询外部信息,并将检索到的内容作为生成答案的依据。在新版智能体中,知识库作为智能体的一项技能,作为工具由智能体自主规划调用。这种主动获取知识的方式,在处理私有知识或垂直领域问答时,能提升回答的准确率并有效减少内容幻觉。详情请参见知识库
在回复设置中开启展示回答来源可以展示知识来源和源文件地址。
新版智能体支持通过标签来限定知识库的查询范围。通过为知识库文件设置标签,并在系统提示词(Prompt)中定义使用规则,可以引导智能体根据用户意图,在更小的、更精准的文件范围内进行检索,从而显著提升回答的准确性和相关性。

MCP

在新版智能体中,外部工具均以 MCP 协议接入智能体,并纳入调度体系,包括来自 MCP 广场 的官方 MCP 和自定义 MCP 服务。智能体能够在多步推理中,对 MCP 进行动态的、非固定顺序的调用,以解决更复杂的任务。此外,插件也支持一键转换为 MCP 服务。

数据连接器

数据连接器是百炼平台上智能体、工作流、知识库等访问外部数据的桥梁。通过配置数据连接器,智能体可以直接查询和操作外部数据源中的数据。

应用组件

将已创建的智能体或工作流作为工具接入。需要先将智能体或工作流应用发布为组件。

技能

技能(Skill)是可添加到智能体的能力包,用于让智能体在对话中自动处理特定类型的任务。添加技能后,智能体可在对话中自动识别匹配的任务并调用对应技能进行处理,无需额外编写代码。

记忆

  • 短期记忆:新版智能体支持短期记忆功能,即在多轮会话中为智能体提供上下文信息。可以设置 0 到 30 轮的上下文(0 代表不传递多轮对话记录);轮数越多,对话相关性越强,但输入长度也会相应增加。
  • 长期记忆:该功能计划在未来的迭代中支持。

环境

环境用于配置技能调用所需的鉴权密钥和环境变量。配置后,智能体在调用技能时会自动注入对应的凭证和参数,无需在技能代码中硬编码敏感信息。

回复

回复支持展示回答来源。开启后,将以角标形式展示知识来源和源文件/源网页地址。该功能推荐与知识库和联网搜索 MCP 组合使用。

运行与结果分析

完成应用配置后,可在页面右侧的对话窗口中运行智能体。对于需要多步规划的复杂请求,新版智能体会以卡片流的形式,展示其决策过程和运行轨迹,该过程主要包含以下两种步骤:
  1. 思考 (Thinking):此步骤展示模型的推理逻辑,便于分析其决策路径并定位非预期行为的根源**(仅当选用支持思考模式的模型时出现)**。
  2. 工具调用:此步骤记录了模型执行的具体工具调用入参及其返回的结果。
ReAct 最大轮次(取值范围 1-50)用于限制智能体在单次会话中可以调用工具的最大次数。当超出此限制后,智能体将自动退出工具调用链路并生成最终回复。

应用发布与集成

应用发布是后续所有智能体应用调用、集成的前提条件。

应用发布

在应用配置页面的右上角,单击发布按钮,在弹出窗口中会展示自上次发布以来的配置变更差异。确认发布信息无误后,单击确认发布,即可完成应用发布。

通过 API 调用

您可以在智能体应用发布渠道页签,单击 API 调用右侧的查看 API,查看通过 API 调用新版智能体应用的方法。

应用管理

版本管理

通过版本管理功能,可以编辑历史版本描述信息,或回滚发布过的历史版本。
  1. 在应用配置页,单击顶部导航栏右侧的版本管理
  2. 选中需要回滚的历史版本,将鼠标悬浮至卡片上,单击右上角编辑图标,在编辑版本信息对话框中按需完成修改后,单击确定,即可修改历史版本描述信息。单击覆盖当前草稿,即可回滚至该版本。

计费说明

智能体功能计费主要体现在以下几个方面:
  1. 模型调用
    • 智能体会产生模型调用费用,具体费用取决于模型类型、输入和输出 Token 数量。
    • 具体的模型类型和对应的计费规则请参见模型列表。
  2. 知识库
    • 知识库按量付费。
    • 从知识库召回的文本切片会增加模型输入 Token 数量,可能导致模型推理(调用)费用的增加。
  3. MCP
    • 部分官方 MCP 按模型调用计费,如文生图、文生视频、语音合成等 MCP。
    • 部分 MCP 服务涉及第三方 API 调用,使用后可能会产生费用。这部分费用由第三方收取,阿里云百炼不收取费用。

常见问题

支持将旧版智能体升级到新版本吗?

不支持。旧版智能体和新版智能体基于不同的技术架构,彼此不兼容,无法进行直接的版本切换、升级或降级。 如果您当前在使用旧版智能体,并希望体验新版智能体的功能,请您前往控制台重新创建一个新版智能体应用

为什么智能体未按预期调用已配置的工具?

可从以下四个层面进行排查:
  • 技能配置与挂载:请核实该技能是否已成功创建并正确挂载到当前智能体应用中。
  • 系统提示词的引导性:请检查系统提示词是否清晰地描述了该技能的功能、参数以及适用的场景。模型依赖这些描述信息来决策何时调用技能。
  • 意图与技能的相关性:请评估问题的表述是否清晰,其意图是否能明确指向特定技能。如果意图模糊或与技能功能不相关,模型可能选择不调用。
  • 执行轮次限制:请检查是否达到了 ReAct 轮次上限。智能体可能已规划调用该技能,但在执行到该步骤前因轮次耗尽而被强制终止。

智能体应用是否支持上下文缓存?

支持隐式缓存,暂不支持在应用中配置显式缓存
  • 隐式缓存:智能体在调用支持隐式缓存的模型时会自动生效,无需任何配置、也无法关闭。系统会自动识别并缓存请求的公共前缀(如相同的系统提示词、多轮对话历史、知识库召回内容等),命中缓存的输入 Token 按标准输入单价的 20% 计费,可相应降低模型调用成本。
  • 显式缓存:需要在模型调用请求中主动为指定内容创建缓存标记。智能体应用由平台统一构造模型请求,暂不支持配置显式缓存。