知识库用于为大模型补充私有数据和最新信息。基于 RAG(检索增强生成)技术,大模型在生成回答前会先从知识库中检索相关内容,从而提升回答的准确性。
无专属知识库的应用
无专属知识库时,大模型无法准确回答特定领域的问题。
例如,用户在对话界面中发送"请你帮我挑选一款拍照效果最好的阿里云百炼手机,价格在 3000 元以内",AI 助手因缺乏相关知识库而无法给出准确的产品推荐。
有专属知识库的应用
引入专属知识库后,大模型可准确回答特定领域的问题。
以下模型支持使用知识库。配置千问使用知识库教程
预置模型(阿里云百炼支持的标准模型)
知识库支持对私有数据或文件进行语义检索,可找出语义相同或相近的内容,即使关键词匹配度极低甚至为零。
更多详细信息,请参见阿里云大模型ACA课程的检索增强生成。
本节介绍如何无需编写代码,快速构建一个能够回答特定领域问题(以"阿里云百炼手机"为例)的大模型问答应用。
知识库创建后,可将其关联至同一业务空间下的阿里云百炼应用或外部应用,以处理检索请求。
除在阿里云百炼内构建应用外,也可通过阿里云百炼SDK调用知识库的检索能力,为外部 AI 应用提供检索服务。
具体集成步骤,请参见。
若问答过程中出现知识召回不完整或内容不准确的情况,请参见。
在知识库页面,可查看和管理当前业务空间下的所有知识库。
知识库ID:即每个知识库卡片上
点击后,首先选择知识库规格(标准版:0.03 元/小时,旗舰版:0.2 元/小时),然后按三步完成创建:填写基础信息并选择知识库类型、配置数据来源、设置索引参数。
在知识库页面,点击。
填写基础信息
根据应用场景选择合适的(单一知识库不支持同时选择多个类型)。选择文档搜索类型后,还需选择使用场景(基础文档问答、视觉理解(富文本文档)或极速问答):
文档搜索(检索场景)
适用场景:
metadata(元数据)是与非结构化数据关联的一组附加属性,以 key-value 键值对的形式集成到文本切片中。
作用:元数据为文本切片提供重要的上下文信息,可显著提升知识库检索的准确性。例如,知识库中包含上千个以产品名称命名的产品介绍文件。检索"A产品的功能概述"时,若所有文件正文都含有"功能概述"但均未提及"A产品",知识库可能召回大量无关文本切片。将产品名称作为元数据附加到所有文本切片后,知识库可精准过滤出与"A产品"相关且包含"功能概述"的切片,从而提高检索准确性,同时降低模型输入Token消耗。
用法:通过API调用应用时,可在请求参数
开启后,知识库将所有XLSX、XLS格式文件的首行数据视为表头,并自动拼接到每个文本切片(数据行)中,避免大模型将表头误识别为普通数据行。
生效范围:仅对知识库中 XLSX、XLS 格式的表格文件生效,并以文件首行作为表头;对 PDF、Word、Markdown 等非表格格式文件不生效。该设置在创建知识库(文档切分)时生效,且与切分策略一样,在知识库创建后不可再修改。
处理逻辑:知识库对表格文件按数据行进行切分,即首行(表头)以外的每一行数据生成一个独立的文本切片。开启本设置后,首行表头会自动拼接到每一个数据行切片中,使切片同时携带列名(表头)与该行数据,大模型即可结合列名准确理解每个字段的含义;表头行本身不再作为普通数据行单独处理,从而避免检索与问答时的语义混淆。
若知识库中包含其他格式的文件(如PDF),或表格文件本身不含表头,则无需开启该设置。
选择智能切分(推荐)或自定义切分方式(当智能切分无法正常切割时,可对的部分策略进行调整)。
作用:知识库将文件切分为文本切片,并通过向量模型转换为向量。文本切片和向量以键值对的形式存入向量数据库。知识库创建后,可查看或编辑每个文本切片的具体内容(文字和图片)。
切片标题:每个文本切片除正文内容外还带有一个标题,展示在切片列表中,可用于标识切片并参与检索。切片标题由知识库在文档智能解析阶段依据识别到的标题层级自动生成,分为短标题(
可能的切分结果(最大分段长度=20):
可能的切分结果:
可能的切分结果(按照一级标题切分):
可能的切分结果(正则表达式为
开启该功能后,系统将调用专用轻量级模型,结合对话历史将用户当前问题改写为独立的、上下文完整的新查询,再用于知识库检索。
向量模型用于将原始输入Prompt和知识文本转化为数值向量,以便计算语义相似度。默认的官方向量v4(text-embedding-v4)在语种支持、代码片段向量化效果和向量维度自定义等方面,相比官方向量v3(text-embedding-v3)进行了全面升级,适用于大部分场景。详情请参见。
知识库使用不同向量模型时生成的向量维度(无法修改):
排序模型位于知识库外部,对向量检索初步召回的候选切片进行二次排序,并返回相似度分数最高的前K个文本切片。qwen3-rerank(hybrid)官方排序(推荐)综合考量语义相关性与文本匹配特征(如BM25得分),能更好地处理需要精确关键词命中的查询;若只需语义排序,请选择qwen3-rerank。
排序模型模式
在创建知识库时,可以在「排序模型模式」配置项中选择以下三种模式之一:
该阈值表示允许召回的文本切片的最低相似度分数,用于筛选排序模型返回的结果,只有分数超过此阈值的文本切片才会被召回。
此处设置的是知识库的默认相似度阈值。将知识库关联到具体阿里云百炼应用时,还可为该应用单独设置阈值(将覆盖知识库的默认相似度阈值)。
降低此阈值预期会召回更多文本切片,但可能召回相关度较低的内容;提高此阈值会减少召回的文本切片数量,若设置过高,将导致知识库丢弃相关切片。
假设阿里云百炼应用关联了A1、A2和A3三个知识库,系统从这些库中检索与输入相关的切片,再通过排序模型重排序,选出最相关的前K条加入大模型的输入Token供回答参考。此K值即最大召回数量(上限为20),决定了排序模型提供给大模型参考的文本切片数量。
增大该值可提高大模型的回答准确性,但会相应增加大模型输入Token消耗。
选择向量数据库存储文本向量。的向量数据库可满足知识库的基本功能需求。如需管理、审计或监控数据库等高级功能,建议选择ADB-PG(AnalyticDB for PostgreSQL)。
创建说明(视觉理解)
选择视觉理解(富文本文档)使用场景后,知识库将使用多模态向量模型对文档进行视觉级理解,保留原始版面布局信息,而非采用传统的文本切片方式。
文件格式限制
在选择数据页签的文件上传区域,鼠标悬浮查看格式要求查看。
索引配置差异
视觉理解场景下的索引配置与基础文档问答不同:
支持导入单份xlsx、xls格式的文档,文件大小限制20MB以内。
数据源接入:支持本地上传 XLS 或 XLSX 文件,或从阿里云数据库RDS导入数据。
创建说明(数据查询)
图片问答(图搜场景)
适用场景:
创建说明(图片问答)
向量模型用于将原始输入 Prompt、知识文本及图片转化为数值化向量,以便进行相似度比较。详情请参见。
音视频搜索(音视频内容检索分析场景)
适用场景:
系统先将音视频文件解析所得的文本切分为语义完整的文本切片,再通过向量模型将每个切片转换为向量,以键值对形式存入向量数据库。知识库创建完成后,可查看或编辑各文本切片的具体内容。
:知识库先依据内置的分句标识符将文本序列拆分为若干段落,再根据段落生成文本切片。拆分和切分过程中,知识库会尽量保持语义完整,减少不必要的截断;但当文本切片的字符数超过最大分段长度时,将强制截断。
metadata(元数据)是与音视频文件相关的附加属性,以 key-value 键值对的形式附加到文本切片中。
作用:元数据为文本切片提供重要的上下文信息,可显著提升知识库检索的准确性。例如,某音视频知识库中存有数千个编程培训视频(包含 Python、Java、C++ 等)。检索
向量模型用于将原始输入 Prompt 和文本切片转化为数值化向量,以便计算语义相似度。默认的官方向量 v4(text-embedding-v4)模型在语种支持、代码片段向量化效果和向量维度自定义等方面均优于官方向量 v3(text-embedding-v3)模型,适用于大多数场景。详情请参见。
知识库使用不同向量模型时生成的向量维度(不可修改):
知识库内容的任何变更均会实时同步到所有引用该知识库的应用中。
自动更新(推荐)
通过对象存储OSS类型连接器监听OSS内数据变动,自动同步更新至知识库,实现知识的实时更新。操作步骤如下:
自动更新(推荐)
使用阿里云关系型数据库RDS或自建MySQL管理知识数据,可实现知识库的自动同步更新(延迟通常为分钟级,请求高峰期可能为小时级),详见。
手动更新
当知识库的数据源为应用数据中的数据表时,只能手动更新,分为以下两步。
步骤一:更新数据表
进入数据连接页签,在左侧列表中选择目标数据表,单击。
自动更新
暂不支持。
手动更新
在知识库页面,找到目标知识库,单击卡片上的。
知识库创建后,仅支持修改知识库名称、知识库描述和相似度阈值,其他配置均无法更改(如需更改,须删除并重新创建知识库)。编辑操作仅支持通过控制台进行,无对应API。
操作步骤:在知识库页面,找到目标知识库,单击卡片上的,再单击。
删除知识库前,建议先解除其与所有已发布的阿里云百炼应用的关联。
删除知识库步骤
对每个关联了该知识库的已发布应用,依次执行以下操作:
旗舰版提供RCU以保障高QPS下的检索性能,并支持更大的存储容量;标准版适合开发测试或低并发场景。
标准版与旗舰版支持互转。旗舰版的RCU数量支持修改。
同一知识库每个自然日最多允许变配1次。
RCU:RCU(Retrieval Compute Unit)是知识库检索并发能力的度量单位。1 RCU ≈ 支撑在线检索最高50 QPS。RCU越大,可支撑的并发数越高。
操作步骤:
命中测试用于验证知识库能否为AI应用提供准确的知识输入。通过模拟用户提问,检查知识库的召回结果并调优相似度阈值。
命中测试中的排序模型支持三种模式:问答模式(默认,适合用户提问与文档内容不完全匹配的场景)、相似模式(适合查询与文档内容高度相似的场景)和自定义高级模式。不同模式下,同一查询的排序得分可能存在显著差异(例如,同一切片在问答模式下得分47%,在相似模式下可达69%)。
通过命中测试,可以:
场景1:客户咨询产品价格
场景2:技术问题排查
场景3:视觉理解文档检索(视觉理解知识库)
场景4:极速问答(极速问答知识库)
重排(Rerank)功能的开关位置取决于调用知识库的方式,配置错误可能导致排序功能未生效或产生非预期费用。
旧版智能体应用、工作流应用
在应用页面,找到已挂载的知识库,单击其右侧的按钮,进入页面后对开关进行设置。
新版智能体应用
OpenAPI
知识库的检索调用日志、字段说明、SQL示例与监控边界,详见。
关于知识库支持的数据源与容量等信息,请参见。
单个阿里云百炼应用可关联的知识库数量:
新版智能体应用(Agent 2.0):
时,可能产生相应费用。
知识库采用按量付费(后付费)模式,按小时统计各计费项用量并自动扣费。请保持阿里云账户余额充足(可前往费用与成本充值),避免因欠费导致服务中断。
账单查询:账单详情
如需获取最新完整的知识库API列表及输入输出参数,请参见API 目录(知识库)。
如需了解相关API的具体用法和代码示例,请参见。
Q: 调用知识库相关API时返回错误码 BailianIndexServiceNotOpen,应如何处理?
错误码 BailianIndexServiceNotOpen 表示阿里云百炼知识库服务尚未激活。请登录阿里云百炼控制台,进入数据 > 知识库页面,点击立即开通按钮激活知识库服务后重试。
Q: 文件含插图(需阿里云百炼应用在回答时返回),应如何处理?
方式一(仅适用智能体应用)
文件正确引用图片示例
提示词模板示例
实际问答效果
文件错误引用图片示例
提示词模板示例
实际问答效果
在对话测试界面中,输入提示语后,AI 回复仅返回纯文本内容,未展示任何图片。
解释:直接在文件中嵌入图片时,阿里云百炼应用不会在回答中展示该图片。
字段类型支持 string、double、long、datetime 和 image_url。配置完成后可在导入数据区域上传 xlsx 或 xls 格式文件(不超过 20 MB)。
在页面右侧的输入框中发起提问。
例如:"简单介绍阿里云百炼X1手机。"
正确引用图片示例
提示词模板示例
用户提示词和阿里云百炼应用返回的结果
在阿里云百炼平台知识库数据预览页面,阿里云百炼手机数据显示导入成功。结构化数据表格包含三列:型号(string)、说明(string)、图片(image_url)。示例数据行中,型号为阿里云百炼 X1,说明字段包含屏幕(6.7 英寸 1440x3200 像素 120Hz)、存储(256GB+12GB RAM)、电池(5000mAh)、摄像(超感光四摄)及参考售价 4599-4999 等参数,图片列为对应的图片资源 URL。
Q: 操作知识库时,遇到报错"缺少该模块的权限",应如何处理?
RAM 用户默认无法执行创建、更新、删除知识库等写操作,需由阿里云账号(主账号)为其授予
Q: 如何导出知识库到本地?
当前不支持一键导出。您可调用ListChunks接口,编写脚本批量拉取文档和切片数据作为替代方案。
Q: 长文本大模型(Long-Context LLM)和RAG怎么选?
长文本大模型(如 Qwen-Long)与 RAG 均可通过引入外部信息优化输出,但各有侧重。长文本大模型逐 Token 全量审视输入文本,在深度理解和长文本摘要方面通常更具优势,但计算和推理成本较高;RAG 通过跨源快速检索,只关注最相关的 Token,更适合无需全局理解、仅需整合最新信息片段即可快速作答的事实型问题场景。
通过阿里云百炼快速构建在线知识库问答应用,实现全天候(7 × 24)响应用户咨询,提升用户体验与业务竞争力:
支持的模型
以下模型支持使用知识库。配置千问使用知识库教程
预置模型(阿里云百炼支持的标准模型)
- 千问-QwQ/Long/Max/Plus/Turbo/Coder/Deep-Research
- 千问VL-Max/Plus/Flash/OCR
- 千问-开源版(Qwen3、Qwen2.5、Qwen2等)
- 第三方文本生成模型(DeepSeek-R1、DeepSeek-V3.1、abab6.5s、Llama3.1、Yi-Large等)
指基于以下模型调优后的自定义模型。
- 千问-Plus/Turbo
- 千问VL-Max/Plus
- 千问-开源版(Qwen3、Qwen2.5、Qwen2等)
- 千问VL-Max/Plus
- 千问-开源版(Qwen2.5等)
工作原理
知识库支持对私有数据或文件进行语义检索,可找出语义相同或相近的内容,即使关键词匹配度极低甚至为零。
更多详细信息,请参见阿里云大模型ACA课程的检索增强生成。
快速开始
本节介绍如何无需编写代码,快速构建一个能够回答特定领域问题(以"阿里云百炼手机"为例)的大模型问答应用。
1. 构建知识库
- 进入知识库,选择或点击;
- 填写和,其余设置保持默认,点击。
- 选择配置类目,上传阿里云百炼系列手机产品介绍.docx文件。点击,然后点击。
2. 集成到业务应用
知识库创建后,可将其关联至同一业务空间下的阿里云百炼应用或外部应用,以处理检索请求。
集成到智能体应用
- 进入应用管理页面,找到目标智能体应用,点击卡片上的,并为应用选择模型。
- 点击页面上文档知识库右侧的 + 按钮,添加上一步创建的知识库。相似度阈值和权重可保持默认。
哪款阿里云手机适合拍照?
实际答案(千问Vivid 7...)中并不包含查询中的任何关键词。
下表中的关键词相似度基于 Jaccard 计算,语义相似度基于
text-embedding-v4 模型计算的 Cosine 相似度。| 召回文本 | 关键词相似度 | 语义相似度 |
|---|---|---|
| 千问Vivid 7:智能摄影新体验 | 0 | 0.43 |
| 阿里云百炼Ace Ultra:游戏玩家之选 | 0.17 | 0.32 |
| 阿里云百炼Flex Fold+:折叠屏新纪元 | 0.25 | 0.24 |
- 相似度阈值:仅语义相似度高于此阈值的文本才会被召回。阈值设置过高会导致相关文本被过滤丢弃。
- 关键限制:权重仅在同类型知识库之间生效。例如,文档搜索类知识库的权重不影响数据查询类知识库的召回顺序,反之亦然。
- 工作原理:系统先计算用户问题与各知识库内容的相关度,筛选出最相关的文本切片,再将相似度分数与对应知识库的权重相乘,经加权重排后输出给大模型参考(加权得分越高,被采纳的可能性越大)。
集成到工作流应用
- 进入应用管理页面,找到目标工作流应用,点击卡片上的配置。将知识库节点拖入画布,连接在节点之后。
- 配置知识库节点:
- 输入:在变量名
content右侧的值下拉列表中,选择query。下拉列表为树形结构,需展开"内置变量"分组后选择 query。 - 选择知识库:知识库节点支持以下两种选择方式。
- 选择固定知识库:从下拉菜单中选择上一步创建的知识库。适用于每次调用同一知识库的场景。
- 动态引入:配置
CodeList变量,根据上游节点的输出动态指定知识库。适用于需根据不同输入检索不同知识库的场景。
- 设置 TopK(可选):决定返回给下游节点(通常为大模型节点)的知识片段数量。增大该值通常能提升大模型回答的准确性,但会相应增加大模型的输入 Token 消耗。
- 输入:在变量名
- 将大模型节点拖入画布,连接在知识库节点之后、结束节点之前。
- 配置大模型节点:
- 在列表中,为节点选择模型。
- 在中,输入指示大模型使用知识库的提示词。输入"/"可插入
result变量(表示知识库检索返回的结果)。 - 例如,输入提示词标题
# 知识库,正文为请记住以下材料{知识库1/result},他们可能对回答问题有帮助。
- 配置结束节点:输入
/,选择大模型1result,输出大模型返回的结果。 - 点击页面右上角的,在页面右侧的输入框中输入问题,大模型将基于所构建的知识库进行回答。
集成到外部应用
除在阿里云百炼内构建应用外,也可通过阿里云百炼SDK调用知识库的检索能力,为外部 AI 应用提供检索服务。
具体集成步骤,请参见。
3. 优化知识库效果(可选)
若问答过程中出现知识召回不完整或内容不准确的情况,请参见。
操作指南
在知识库页面,可查看和管理当前业务空间下的所有知识库。
知识库ID:即每个知识库卡片上 ID 字段的值,用于API调用等场景。
创建知识库
点击后,首先选择知识库规格(标准版:0.03 元/小时,旗舰版:0.2 元/小时),然后按三步完成创建:填写基础信息并选择知识库类型、配置数据来源、设置索引参数。
在知识库页面,点击。
填写基础信息
根据应用场景选择合适的(单一知识库不支持同时选择多个类型)。选择文档搜索类型后,还需选择使用场景(基础文档问答、视觉理解(富文本文档)或极速问答):
- 基础文档问答:适用于纯文本文档的语义检索。
- 视觉理解(富文本文档):使用多模态向量模型对 PDF、图片等富文本文档进行视觉级理解和索引,保留原始版面信息。适合含有复杂排版、图表、公式的文档,支持文字、图片和图文组合三种命中测试模式。
- 极速问答:针对检索速度进行优化,适合高度结构化或简单文档类型(如 FAQ、产品参数表等),提供极速低延时的问答体验。索引配置与基础文档问答一致,差异在于后端检索策略针对低延迟场景进行了专项优化。仅支持文本查询,不支持图片输入。
选择视觉理解后,向量模型将自动切换为 qwen3 多模态向量(qwen3-vl-embedding),不可更改。
- 适用于企业内部文档、产品手册等非结构化数据(即未按预定义表结构组织的数据,包含文本、表格和图片)的检索。
- 若文件包含图片,且需阿里云百炼应用在回答中返回,请选择文档搜索。
- 选择数据:为知识库指定数据来源(文件或内容)。数据源内容将导入知识库,用于后续检索。支持本地上传和云端导入(选择现有类目或文件)两种方式。
- 本地上传:直接从本地电脑上传文件。展开下方折叠面板了解如何选择解析方式。
- :不支持解析文件中的插图与图表。解析速度最快,10~20 页纯文本文档通常在数秒至 1 分钟内完成。
-
文档智能解析:对文件中的插图进行文本识别与提取,生成文本摘要。摘要将与其他非图片内容一同切分并向量化,参与知识库检索。解析速度较快,10
20 页含插图文档通常需要 15 分钟。 -
大模型文档解析:使用千问VL模型的智能体应用支持对文件中插图和图表内容进行提问。如需识别和理解文件中的插图与图表,请选择。因需调用大模型进行深度理解,10
20 页含图表文档通常需要 210 分钟。 - Qwen VL解析:专用于图片文件。可指定千问VL模型并传入 Prompt,以指导对图片版面及元素的识别与提取。单张图片通常在数秒至 1 分钟内完成解析。
-
音视频解析:对文件进行语音识别、视频帧提取(仅限视频)和剧情解析(仅限视频),将所有声画信息按时间轴结构化对齐。解析耗时与文件时长正相关,30 分钟音频约需 5
15 分钟,1 小时视频(含剧情解析)约需 1560 分钟。- 语音识别:通过录音文件识别将语音转为文本。暂不支持识别音乐或自然环境声(如喇叭声、钟声、雷声等)。
- 视频帧提取:从视频中抽取有代表性的画面,并生成对应的文本描述。
- 剧情解析(需手动开启):分析视频内容,定位具体事件并标注时间戳,生成对应的文本描述。开启后会显著增加解析时间。
- 云端导入:从阿里云对象存储OSS导入已有文件。
- 索引配置:定义导入数据的处理和存储方式,直接影响检索效果。
以下配置项中,仅"向量存储"选用 ADB-PG 时可能产生费用,其余配置均免费。
Meta信息抽取
metadata(元数据)是与非结构化数据关联的一组附加属性,以 key-value 键值对的形式集成到文本切片中。
作用:元数据为文本切片提供重要的上下文信息,可显著提升知识库检索的准确性。例如,知识库中包含上千个以产品名称命名的产品介绍文件。检索"A产品的功能概述"时,若所有文件正文都含有"功能概述"但均未提及"A产品",知识库可能召回大量无关文本切片。将产品名称作为元数据附加到所有文本切片后,知识库可精准过滤出与"A产品"相关且包含"功能概述"的切片,从而提高检索准确性,同时降低模型输入Token消耗。
用法:通过API调用应用时,可在请求参数metadata_filter中指定metadata。应用检索知识库时,将先根据metadata筛选相关文件。
如何配置metadata
下方示例中,该文件所有文本切片的元数据包含 5 个自定义属性:date(文件中出现的所有年份)、reference(文件中出现的所有参考文献)、filename(文件名称)、keywords(文件中出现的关键词)以及author(文件作者信息)。
开启Meta信息抽取,然后单击为该知识库中的所有文件附加统一或个性化的元数据。切分时,每个文件的元数据将集成到各自的文本切片中。
新建Meta信息模板说明
取值方法说明:
- 常量:为知识库中的所有文件附加固定属性。如上方示例所示,若知识库中所有文件的作者相同,可统一设置字段名为
author的常量。 - 变量:为知识库中的每个文件附加可变属性。目前支持
file_name和cat_name。选择file_name时,阿里云百炼将文件名称附加到其元数据中,如上方示例所示。选择cat_name时,阿里云百炼将文件所在类目的名称附加到文件元数据中。 - 大模型:系统依据设定的实体描述规则,对知识库中每个文件的文本内容进行匹配,自动识别并提取相关信息,将其作为属性附加到文件元数据中。
date 的大模型字段,实体描述配置如下:
在实体描述输入框中填写日期信息,只提取年份,然后单击确定。
- 正则:系统依据设置的正则表达式,对知识库中每个文件的文本内容进行匹配,提取符合该表达式的内容,并将其作为属性添加到文件元数据中。
reference 的正则字段,正则表达式配置如下:
正则表达式的值设置为 《.*?》。
- 关键词搜索:系统在每个文件中查找预设的关键词,并将匹配到的关键词作为属性添加至文件元数据中。
融资,租赁,产业,汽车,钢铁,绿色,环保,资本,排放。
由于该文件中仅出现了"融资、产业、绿色、资本"这四个关键词,系统只提取了这四个关键词作为该文件 keywords 属性的值。
- 是否参与检索:开启后,元数据字段和值将与文本切片内容一同参与知识库检索;关闭时,仅文本切片内容参与检索,元数据字段和值不参与。
- 是否参与模型回复:开启后,元数据字段和值将与文本切片内容一同参与大模型的回答生成;关闭时,仅文本切片内容参与大模型回答生成,元数据字段和值不参与。
Excel文件表头拼装
开启后,知识库将所有XLSX、XLS格式文件的首行数据视为表头,并自动拼接到每个文本切片(数据行)中,避免大模型将表头误识别为普通数据行。
生效范围:仅对知识库中 XLSX、XLS 格式的表格文件生效,并以文件首行作为表头;对 PDF、Word、Markdown 等非表格格式文件不生效。该设置在创建知识库(文档切分)时生效,且与切分策略一样,在知识库创建后不可再修改。
处理逻辑:知识库对表格文件按数据行进行切分,即首行(表头)以外的每一行数据生成一个独立的文本切片。开启本设置后,首行表头会自动拼接到每一个数据行切片中,使切片同时携带列名(表头)与该行数据,大模型即可结合列名准确理解每个字段的含义;表头行本身不再作为普通数据行单独处理,从而避免检索与问答时的语义混淆。
若知识库中包含其他格式的文件(如PDF),或表格文件本身不含表头,则无需开启该设置。
切片方式
选择智能切分(推荐)或自定义切分方式(当智能切分无法正常切割时,可对的部分策略进行调整)。
作用:知识库将文件切分为文本切片,并通过向量模型转换为向量。文本切片和向量以键值对的形式存入向量数据库。知识库创建后,可查看或编辑每个文本切片的具体内容(文字和图片)。
切片标题:每个文本切片除正文内容外还带有一个标题,展示在切片列表中,可用于标识切片并参与检索。切片标题由知识库在文档智能解析阶段依据识别到的标题层级自动生成,分为短标题(title,切片所属的最近一级标题)和层级标题(hier_title,自最高级标题到当前标题的完整路径,各级以 |> 连接,例如 一级标题|>二级标题)。因此文档的标题结构越清晰(如 PDF、Word、Markdown 等含规范章节标题的文档),生成的切片标题越完整;对于按数据行切分、通常不含文本标题层级的表格类文件(如 Excel),切片标题取决于解析时能否识别到标题层级,未识别到时可能为空。切片标题也支持在切片管理中手动编辑。
:系统默认的切分策略,经评测对多数文件可获得最佳检索效果。
原理: 使用 **** 时,知识库先依据内置的分句标识符将文件拆分为若干段落,再根据这些段落创建文本切片。拆分和切分过程中,知识库尽量保证每个部分的语义完整,减少不必要的切分,但当文本切片的字符数超过 最大分段长度 时,将被强制截断。
:适合对Token数量有严格要求的场景,例如使用上下文长度较小的模型时。
重叠字符数 : 相邻文本切片的重叠字符数。建议设置为最大分段长度的10%到25%,以保留文本切片间的语义相关性,提高多切片召回质量。注意该参数值必须小于最大分段长度,否则会导致文档切分chunk异常。
示例
示例文本:
- 文本切片1:"阿里云百炼知识库提供多种文件处理方式。您可以根"
- 文本切片2:"据需求选择最合适的方法。"
- 文本切片1:"创建知识库 ... 获得最佳的检索效果。"
- 文本切片2:"自定义切分 ... 的部分策略进行调整。"
- 文本切片1:"创建知识库 ... 的部分策略进行调整。"
- 文本切片1:"创建知识库 ... 选择最合适的方法。"
- 文本切片2:"智能切分 ... 获得最佳的检索效果。"
- 文本切片3:"自定义切分 ... 的部分策略进行调整。"
(?<=。)按句号切分文件。当文本切片的字符数超过最大分段长度时,将被强制截断。
示例
示例文本:
(?<=。)):
- 文本切片1:"阿里云百炼知识库提供多种文件处理方式。"
- 文本切片2:"您可以根据需求选择最合适的方法。"
多轮对话改写
开启该功能后,系统将调用专用轻量级模型,结合对话历史将用户当前问题改写为独立的、上下文完整的新查询,再用于知识库检索。
向量模型
向量模型用于将原始输入Prompt和知识文本转化为数值向量,以便计算语义相似度。默认的官方向量v4(text-embedding-v4)在语种支持、代码片段向量化效果和向量维度自定义等方面,相比官方向量v3(text-embedding-v3)进行了全面升级,适用于大部分场景。详情请参见。
知识库使用不同向量模型时生成的向量维度(无法修改):
- text-embedding-v4:512维
- text-embedding-v3:512维
- qwen3 多模态向量(qwen3-vl-embedding):使用场景选择「视觉理解」时自动启用,支持对图片和富文本文档进行视觉理解后生成向量
排序模型
排序模型位于知识库外部,对向量检索初步召回的候选切片进行二次排序,并返回相似度分数最高的前K个文本切片。qwen3-rerank(hybrid)官方排序(推荐)综合考量语义相关性与文本匹配特征(如BM25得分),能更好地处理需要精确关键词命中的查询;若只需语义排序,请选择qwen3-rerank。
排序模型模式
在创建知识库时,可以在「排序模型模式」配置项中选择以下三种模式之一:
- 问答模式(默认):根据查询与候选切片的"问答匹配度"评分,适合用户提出完整问题、期望从切片中找到答案的场景。
- 相似模式:根据查询与候选切片的"语义相似度"评分,适合查询与切片表述风格相近的场景。
- 自定义高级模式:填写一段不超过 200 个字符的自然语言指令来干预重排序过程,适合有特殊排序需求的场景。
- 知识库类型限制:仅适用于文档搜索类、数据查询类、音视频搜索类知识库。图片问答类知识库不支持。
- 使用场景限制:仅基础文档问答使用场景支持。视觉理解(富文本文档)和极速问答不支持。
相似度阈值
该阈值表示允许召回的文本切片的最低相似度分数,用于筛选排序模型返回的结果,只有分数超过此阈值的文本切片才会被召回。
此处设置的是知识库的默认相似度阈值。将知识库关联到具体阿里云百炼应用时,还可为该应用单独设置阈值(将覆盖知识库的默认相似度阈值)。
降低此阈值预期会召回更多文本切片,但可能召回相关度较低的内容;提高此阈值会减少召回的文本切片数量,若设置过高,将导致知识库丢弃相关切片。
最大召回数量
假设阿里云百炼应用关联了A1、A2和A3三个知识库,系统从这些库中检索与输入相关的切片,再通过排序模型重排序,选出最相关的前K条加入大模型的输入Token供回答参考。此K值即最大召回数量(上限为20),决定了排序模型提供给大模型参考的文本切片数量。
增大该值可提高大模型的回答准确性,但会相应增加大模型输入Token消耗。
向量存储
选择向量数据库存储文本向量。的向量数据库可满足知识库的基本功能需求。如需管理、审计或监控数据库等高级功能,建议选择ADB-PG(AnalyticDB for PostgreSQL)。
创建说明(视觉理解)
选择视觉理解(富文本文档)使用场景后,知识库将使用多模态向量模型对文档进行视觉级理解,保留原始版面布局信息,而非采用传统的文本切片方式。
文件格式限制
在选择数据页签的文件上传区域,鼠标悬浮查看格式要求查看。
索引配置差异
视觉理解场景下的索引配置与基础文档问答不同:
- 向量模型:自动选择 qwen3 多模态向量(qwen3-vl-embedding),创建后不可更改。
- 多轮对话改写:可配置开启或关闭。
- 相似度阈值:默认 0.20。
- 最终召回最大数量:默认 5。
- 切片方式:视觉理解不使用传统文本切片(智能切分/自定义切分等),而是基于视觉索引对文档整页进行理解。
- 适合构建基于结构化数据(按预定义表结构组织的数据)的问答系统,例如 FAQ、商品数据、人员信息查询助手等。
- 若数据为完整的 FAQ 问答对,请选择数据查询。例如,Excel 文件包含两列,分别为
问题和答案。数据查询类知识库支持将问题列用于知识库检索,答案列用于大模型回答参考。
文档搜索类知识库无法实现此效果。
- 选择数据:为知识库指定数据来源(含文件或内容)。数据源内容将导入知识库,用于后续检索。支持本地上传和从RDS导入两种方式。
知识库创建后数据源不可更改,且单个知识库不支持同时使用多个数据源。
- 本地上传:从本地计算机上传数据表(XLS 或 XLSX 格式,首行必须为表头)。
- 从RDS导入(关联数据库):数据表存储于阿里云RDS中。操作步骤请参见。
- 索引配置:定义导入数据的处理和存储方式,直接影响检索效果。
是否参与检索/参与模型回复
- 是否参与检索:开启后,知识库将在该列数据中执行检索。
- 是否参与模型回复:开启后,该列的检索结果将作为大模型生成回答的输入信息。示例配置:对"姓名"、"性别"、"岗位"、"年龄"列开启,仅对"姓名"和"岗位"列开启后,知识库将在所有列中执行检索,但仅将"姓名"和"岗位"两列的检索结果提供给大模型作为回答依据。
由于"年龄"列未开启参与模型回复,关联该知识库的大模型仍无法回答"张三的年龄"。
- 适合构建以图搜图、以图搜"图文"的多模态检索应用,如商品导购助手、视觉问答助手等。
XLS、XLSX 文件或RDS数据表中需包含公开可访问的图片 URL,以便构建图片索引。详见下方创建说明。
- 选择数据:为知识库指定数据来源(含文件或内容)。数据源内容将导入知识库,用于后续检索。支持本地上传和从RDS导入两种方式。
知识库创建后数据源不可更改,且单个知识库不支持同时使用多个数据源。
- 本地上传:从本地计算机上传数据表(XLS 或 XLSX 格式)。
- 字段要求:数据表中至少需包含一个类型为
image_url的字段,用于生成图片索引。 - 构建过程:知识库将访问
image_url字段中的图片 URL,提取视觉特征并转换为向量存储。 - 检索过程:知识库将用户上传图片生成的向量与已存储的图片向量进行相似度比对,返回最相关的记录。
- 字段要求:数据表中至少需包含一个类型为
- 从RDS导入(关联数据库):数据表存储于阿里云RDS中。操作步骤请参见。
- 索引配置:定义导入数据的处理和存储方式,直接影响检索效果。
向量模型
向量模型用于将原始输入 Prompt、知识文本及图片转化为数值化向量,以便进行相似度比较。详情请参见。
- qwen2.5 多模态向量(qwen2.5-vl-embedding):将单模态或混合模态输入表征为统一向量,适用于跨模态检索、图搜等场景。例如,输入一张衬衫图片并附加文本"找相似风格但更显年轻的款式",模型能将图像与文本指令融合为一个向量进行理解。
- 多模态向量 v1(multimodal-embedding-v1):为每个输入部分(图片、文字)分别生成独立向量。
- qwen3 多模态向量(qwen3-vl-embedding):qwen2.5-vl-embedding 的升级版本,在图文融合理解和跨模态检索精度方面进一步提升。
向量存储
音视频搜索(音视频内容检索分析场景)
适用场景:
- 构建基于音视频内容的智能检索与问答应用,如直播回放问答、课程助教、客服质检等。
- 基于多模态内容进行二次创作(根据文字需求从知识库检索音视频片段,生成脚本、字幕或剪辑建议)。
- 选择数据:为知识库指定数据来源(含音视频文件)。数据源内容将导入知识库,用于后续检索。支持本地上传和云端导入(选择现有类目或已解析文件)两种方式。
- 本地上传:从本地计算机上传音视频文件并进行解析。展开下方折叠面板,了解解析方式的具体选项。
- 音视频解析:对文件执行语音识别、视频帧提取(仅限视频)和剧情解析(仅限视频),将全部声画信息按时间轴结构化对齐。解析耗时与文件时长正相关,30 分钟音频约需 5
15 分钟,1 小时视频(含剧情解析)约需 1560 分钟。- 语音识别:字幕内容解析器通过录音文件识别将语音转为文本。暂不支持识别音乐或自然环境声(如喇叭声、钟声、雷声等)。
- 视频帧提取:从原始视频中抽取代表性画面,并生成对应的文本描述。
- 剧情解析(需手动开启):分析视频内容,定位具体事件并标注时间戳,同时生成相应的文本描述。开启后会显著增加解析时间。
- 云端导入:从阿里云对象存储OSS导入音视频文件并进行解析。
- 索引配置:定义导入音视频文件的处理和存储方式,直接影响检索效果。
以下配置项中,仅"向量存储"选用 ADB-PG 时可能产生费用,其余配置均免费。
切片方式
系统先将音视频文件解析所得的文本切分为语义完整的文本切片,再通过向量模型将每个切片转换为向量,以键值对形式存入向量数据库。知识库创建完成后,可查看或编辑各文本切片的具体内容。
:知识库先依据内置的分句标识符将文本序列拆分为若干段落,再根据段落生成文本切片。拆分和切分过程中,知识库会尽量保持语义完整,减少不必要的截断;但当文本切片的字符数超过最大分段长度时,将强制截断。
Meta信息抽取
metadata(元数据)是与音视频文件相关的附加属性,以 key-value 键值对的形式附加到文本切片中。
作用:元数据为文本切片提供重要的上下文信息,可显著提升知识库检索的准确性。例如,某音视频知识库中存有数千个编程培训视频(包含 Python、Java、C++ 等)。检索Python基础语法时,若多个课程中均出现基础语法一词,可能同时召回 Java、C++ 等课程的文本切片(与查询无关)。将编程语言类型作为元数据附加到对应视频的所有文本切片后,知识库即可精准过滤出同时满足编程语言类型=Python且包含基础语法条件的文本切片,从而提高检索准确性,同时降低模型的输入 Token 消耗。
用法:通过API调用应用时,可在请求参数metadata_filter中指定metadata。应用检索知识库时,将先按metadata筛选相关文件。
如何配置metadata
该视频文件(包含其所有文本切片)的元数据含有 3 个自定义属性:teacher(培训视频讲师信息)、filename(文件名)以及keywords(视频中出现的关键词)。
开启Meta信息抽取,然后单击,为该知识库中所有文件附加统一或个性化的元数据。切分时,每个文件的元数据将集成到各自的文本切片中。
新建Meta信息模板说明
取值方法说明:
- 常量:为知识库中所有音视频文件统一附加一个固定属性。如上方示例所示,若知识库中所有课程视频均由同一位讲师授课,可统一设置字段名为
teacher的常量,为所有视频填入该讲师姓名。 - 变量:为知识库中每个音视频文件附加一个可变属性。目前支持
file_name和cat_name两种属性。选择file_name时,阿里云百炼将文件名附加到其元数据中(如上方示例所示);选择cat_name时,将文件所在类目的名称附加到文件元数据中。 - 关键词搜索:系统在每个音视频中查找预设关键词,并将匹配到的关键词作为属性添加至该文件的元数据中。
Python、C++、Java、PHP。
由于该音视频中仅出现了"Python"这一关键词,因此系统只提取"Python"作为该文件 keywords 属性的值。
- 是否参与检索:开启后,元数据字段和值将与文本切片内容一同参与知识库检索;关闭时,仅文本切片内容参与检索。
- 是否参与模型回复:开启后,元数据字段和值将与文本切片内容一同作为大模型生成回答的输入;关闭时,仅文本切片内容参与大模型的回答生成。
向量模型
向量模型用于将原始输入 Prompt 和文本切片转化为数值化向量,以便计算语义相似度。默认的官方向量 v4(text-embedding-v4)模型在语种支持、代码片段向量化效果和向量维度自定义等方面均优于官方向量 v3(text-embedding-v3)模型,适用于大多数场景。详情请参见。
知识库使用不同向量模型时生成的向量维度(不可修改):
- text-embedding-v4:512 维
- text-embedding-v3:512 维
更新知识库
知识库内容的任何变更均会实时同步到所有引用该知识库的应用中。
文档搜索类知识库
自动更新(推荐)
通过对象存储OSS类型连接器监听OSS内数据变动,自动同步更新至知识库,实现知识的实时更新。操作步骤如下:
- 创建连接器:前往创建连接器,创建OSS类型的连接器并选择进行监听的Bucket。
- 创建知识库:创建一个知识库,在选择数据步骤的数据来源选项选择创建完成的OSS类型的连接器。
- 创建 Bucket:前往OSS控制台,创建用于存储原始文件的OSS Bucket。
- 创建知识库:创建一个非结构化知识库,用于存储私有知识内容。
- 创建自定义函数:前往FC控制台,针对文件变更事件(如新增、删除等)创建函数,具体操作请参见创建函数。函数通过调用的相关 API,将OSS上的文件变更同步至知识库。
- 创建OSS触发器:在FC中,为上一步创建的自定义函数关联OSS触发器。当检测到文件变更事件(例如新文件上传至OSS)时,对应触发器将被激活,驱动FC执行相应函数。
- 如何新增文件:单击,勾选已有文件。
- 如何删除文件:找到目标文件后,单击其右侧的删除。
- 如何修改文件内容:当前不支持文件的原地更新或覆盖上传。需先删除知识库中的旧版本文件,再将修改后的新版本文件重新导入知识库。
- 查看切片:在知识库详情页,可查看当前知识库的全部切片列表,按文档筛选或搜索切片内容。
- 编辑切片:对解析异常或内容有误的切片,可直接修改文字内容。保存后新内容立即生效,用于后续检索。
- 新增切片:当文件中某段关键信息被切片策略遗漏时,可手动新增一条切片。新增时需选择所属文档,并填写切片内容(最多 6000 字符)。对于图片问答类知识库,还可在新增切片时上传关联图片。
- 删除切片:包含错误信息或重复内容的切片可单独删除,不影响同文档其他切片的检索。
不同知识库类型支持的切片操作存在差异:编辑切片(更新内容)所有类型的知识库均支持,新增和删除方面,文档搜索类、数据查询类、图片问答类知识库均支持;音视频搜索类知识库仅支持删除切片。切片操作仅影响知识库的检索结果,不会修改数据管理中的源文件。
数据查询、图片问答类知识库
图片问答类知识库的详情页没有直接的上传数据按钮,需通过查看数据源链接跳转到连接器详情页进行数据更新操作。
- 如何插入新数据:导入类型选择。需上传一个仅包含表头和新增数据行的Excel文件。
文件表头须与当前表结构一致。可使用页面上的功能获取标准表头文件,并在该文件中直接填写新数据。
- 如何删除数据:导入类型选择。需上传一个包含表头及最新完整数据(已移除待删除记录)的Excel文件。
- 如何修改数据:导入类型选择。需上传一个包含表头及最新完整数据(已包含相应修改)的Excel文件。
每次更新后仍需手动重复以上步骤。
音视频搜索类知识库
自动更新
暂不支持。
手动更新
在知识库页面,找到目标知识库,单击卡片上的。
- 如何新增文件:单击,勾选数据连接中的已有文件。
- 如何删除文件:找到目标文件后,单击其右侧的删除。
此操作仅将文件从知识库中移除,不会删除数据连接中的源文件。
- 如何修改文件内容:当前不支持文件的原地更新或覆盖上传。需先删除知识库中的旧版本文件,再将修改后的新版本文件重新导入知识库。
编辑知识库
知识库创建后,仅支持修改知识库名称、知识库描述和相似度阈值,其他配置均无法更改(如需更改,须删除并重新创建知识库)。编辑操作仅支持通过控制台进行,无对应API。
操作步骤:在知识库页面,找到目标知识库,单击卡片上的,再单击。
同一知识库每个自然日最多允许变配1次,超出后操作将被静默拒绝(无错误提示)。
删除知识库
删除知识库前,建议先解除其与所有已发布的阿里云百炼应用的关联。
已关联的未发布应用不影响删除操作。
- 在应用管理页面,找到关联该知识库的应用,单击。
- 在知识库列表中移除该知识库,单击页面右上角的,按提示重新发布应用。
- 在知识库页面,找到目标知识库,单击卡片上的,再单击。
变更配置
旗舰版提供RCU以保障高QPS下的检索性能,并支持更大的存储容量;标准版适合开发测试或低并发场景。
标准版与旗舰版支持互转。旗舰版的RCU数量支持修改。
同一知识库每个自然日最多允许变配1次。
RCU:RCU(Retrieval Compute Unit)是知识库检索并发能力的度量单位。1 RCU ≈ 支撑在线检索最高50 QPS。RCU越大,可支撑的并发数越高。
如果知识库(旗舰版)使用平台存储,降级为标准版前,需将已用存储空间降至80 GB以下。可通过删除知识库内的文件或数据来释放存储空间。
- 在知识库页面,找到目标知识库,单击卡片上的,再单击编辑。
- 根据当前版本,在弹出的窗口中选择相应操作:
- 标准版:选择升级。
- 旗舰版:选择降级或变更RCU数量。
- 按照界面提示完成操作,单击确定保存后配置即时生效。
命中测试
命中测试用于验证知识库能否为AI应用提供准确的知识输入。通过模拟用户提问,检查知识库的召回结果并调优相似度阈值。
命中测试中的排序模型支持三种模式:问答模式(默认,适合用户提问与文档内容不完全匹配的场景)、相似模式(适合查询与文档内容高度相似的场景)和自定义高级模式。不同模式下,同一查询的排序得分可能存在显著差异(例如,同一切片在问答模式下得分47%,在相似模式下可达69%)。
通过命中测试,可以:
- 验证知识库能否为AI应用提供有效的知识输入
- 调优相似度阈值,平衡召回率与准确性
- 发现知识库中的内容缺失或质量问题
场景示例
场景1:客户咨询产品价格
操作步骤
- 在知识库页面,找到目标知识库,单击卡片上的。
- 在测试界面输入问题(建议收集用户常见问题),观察召回结果。
- 召回结果:即本次测试的命中结果(已按相似度降序排列),单击任一切片即可查看其具体内容。
- 图标:若为图片问答类知识库,系统会先将输入图片转为向量并检索相关记录,再将这些记录与提问一起交由大模型生成回答;若为文档搜索、数据查询或音视频搜索类知识库,上传的图片不参与检索;若为使用场景选择「视觉理解」的文档搜索类知识库,上传图片同样参与检索,支持纯文字、纯图片和图文组合三种查询模式,图文组合查询可提升召回相似度。
- 确认相关文本切片是否被正确召回。如未召回,需调整相似度阈值并重复上一步。
- 单击,可对比不同阈值设置下的历史召回效果。
重排(Rerank)配置
重排(Rerank)功能的开关位置取决于调用知识库的方式,配置错误可能导致排序功能未生效或产生非预期费用。
旧版智能体应用、工作流应用
在应用页面,找到已挂载的知识库,单击其右侧的按钮,进入页面后对开关进行设置。
应用内的配置优先级高于知识库本身的配置。
- 在知识库卡片上,单击;
- 在处选择;
- 单击使配置生效。
新版智能体将知识库作为标准工具调用,配置以知识库自身设置为准。
- 控制台:即您在知识库的或页面所做的配置。
- API:相关参数设置,参阅。
- 优先级:API参数设置优先级高于控制台页面配置。
日志与监控
知识库的检索调用日志、字段说明、SQL示例与监控边界,详见。
配额与限制
关于知识库支持的数据源与容量等信息,请参见。
单个阿里云百炼应用可关联的知识库数量:
新版智能体应用(Agent 2.0):
- 各类型知识库均可无限量关联。
- 文档搜索类:最多5个
- 数据查询类:最多5个
- 图片问答类:最多1个
- 音视频搜索类:最多5个(旧版智能体应用)/ 不支持(工作流应用)
计费说明
时,可能产生相应费用。
| 步骤 | 计费情况 |
|---|---|
| 构建知识库 | 不收费。 |
| 集成到业务应用 | 调用阿里云百炼应用时,知识库召回的文本切片会增加大模型输入 Token 数量,从而可能增加模型推理(调用)费用。详情请参见计费项与定价。 |
| 管理与运维 | 不收费。 |
若仅通过调用Retrieve 接口在知识库中检索,不经过阿里云百炼应用生成回答,则不产生费用。
| 计费项 | 说明 |
|---|---|
| 规格费用 | 标准版 或 旗舰版 知识库的实际运行时长费用,价格详见。变更配置时,按变更时间点分段计费。 |
| 向量、排序模型调用费用 | 创建、更新或检索知识库时会调用向量(embedding)和排序(rerank)模型,按输入 Token 用量计费,价格以页为准。 |
API参考
如需获取最新完整的知识库API列表及输入输出参数,请参见API 目录(知识库)。
如需了解相关API的具体用法和代码示例,请参见。
常见问题
构建知识库
Q: 调用知识库相关API时返回错误码 BailianIndexServiceNotOpen,应如何处理?
错误码 BailianIndexServiceNotOpen 表示阿里云百炼知识库服务尚未激活。请登录阿里云百炼控制台,进入数据 > 知识库页面,点击立即开通按钮激活知识库服务后重试。
处理图片及多模态内容
Q: 文件含插图(需阿里云百炼应用在回答时返回),应如何处理?
使用文档搜索类知识库
方式一(仅适用智能体应用)
- 在构建知识库时,知识库类型选择文档搜索,使用场景选择视觉理解(富文本文档)。
- 选择视觉理解(富文本文档)回复后,知识库将从文件插图中提取摘要,大模型根据摘要与问题的相关性自主决定是否插入图片。
- 创建或编辑智能体应用时,选择千问-Plus或千问-Plus-Latest模型(经测试,两款模型效果最佳)。点击文档知识库右侧的+按钮,添加上一步构建的知识库。
- 将图片上传至公网可访问位置并获取完整 URL。推荐使用 OSS,具体操作请参见将图片上传至OSS并使用其文件URL。
- 在文件中插入完整 URL(不支持相对路径)。不支持直接在文档中嵌入图片文件(如通过复制粘贴或菜单插入本地图片),必须使用公网可访问的URL链接引用图片。
若已按说明操作但图片仍无法显示,请检查文本切片中的URL是否完整,确认是否存在多余空格或特殊字符(可能被系统误解析),如有问题可直接编辑修正。
使用图片问答类知识库
- 将图片上传至公网可访问位置并获取完整 URL。推荐使用 OSS,具体操作请参见将图片上传至OSS并使用其文件URL。
- 在表格页签中新建数据表,并添加 image_url 类型字段用于存储图片的完整 URL。
- image_url 字段不支持存储相对路径。
- 单个 image_url 字段不支持存储多个图片 URL。若单条记录需关联多张图片,须为每张图片分别创建独立的
image_url字段(如image_1、image_2等)。 - 数据表中每个 image_url 指向的图片大小不得超过 3 MB,超出限制将导致知识库创建失败。
- 数据表创建后无法新增或修改 image_url 类型字段,请在初次设计表结构时预留所有所需的图片字段。
- 构建知识库时,知识库类型选择图片问答。
- 创建或编辑智能体应用时,点击(图片问答类知识库)右侧的+按钮,添加上一步构建的知识库,并将提示词模板修改为:
权限与安全
Q: 操作知识库时,遇到报错"缺少该模块的权限",应如何处理?
RAM 用户默认无法执行创建、更新、删除知识库等写操作,需由阿里云账号(主账号)为其授予管理员权限(或至少同时包含应用数据-操作与知识库-操作权限)。
Q: 知识库是否私有?其他组织或用户能否访问?
知识库仅限其所在业务空间内的成员访问和操作,不对外公开。
Q: 阿里云是否会使用我账号下的知识库回答其他用户的问题?
阿里云严格保护数据隐私,不会将您的知识库用于回答其他用户的问题或模型训练。数据安全与隐私承诺详见。