本文属于机器翻译版本。若本译文内容与英语原文存在差异,则一律以英文原文为准。
建立托管知识库
注意
为了优化易用性、准确性和成本的组合,我们建议您选择 Bedrock 管理知识库。
借助 Bedrock 托管知识库,Amazon Bedrock 可以为您管理提取、存储、索引和检索基础设施。您提供数据源,Amazon Bedrock 负责管理数据摄取管道、数据存储设置和检索优化,包括默认情况下嵌入服务管理模型并使用服务管理模型进行重新排名。您可以选择在创建时提供自己的 Bedrock 嵌入模型,也可以在查询时提供自己的重排序模型。与知识库相比,这简化了设置过程, Customer-managed 知识库中必须配置和管理一些底层基础架构。
基岩管理与 Customer-managed 知识库
下表总结了 Bedrock Managed 和 Customer-managed 知识库之间的主要区别:
| 功能 | 基岩管理 | Customer-Managed |
|---|---|---|
| 代理检索 | 支持 | 不支持 |
| 数据存储 | Auto-scaling 嵌入、文本、元数据和原始文件的数据存储。完全由 Bedrock 管理。 | 客户选择、配置、扩展和更新矢量和文本数据存储库 |
| 搜索类型 | 代理和语义混合检索已针对跨文件类型摄取进行了优化 | 选择自己的搜索策略 |
| 托管嵌入模型 | 内置托管模型针对准确性和性能进行了优化,无需额外付费 | 无 |
| 自定义嵌入模型 | 选择任何具有 float32 和 1024 维度的 Bedrock 嵌入模型 | 选择任何基岩嵌入模型 |
| 管理式重新排名 | 内置托管语义重排器,针对准确性和性能进行了优化,无需额外付费 | 无 |
| 自定义重新排名 | 从 Bedrock 中选择你的 reranker 模型 | 从 Bedrock 中选择你的 reranker 模型 |
| 连接器 | 7 个原生连接器(S3 SharePoint、Confluence、网络爬虫、谷歌云端硬盘、 OneDrive自定义) | S3 和自定义 |
| 数据解析 | Built-in 多模式文件类型的解析器 | 在 “文本”、“基础模型” 和 “基岩数据自动化” 的 “默认” 中进行选择 |
| 分块 | 可选择内置(默认)或固定大小 | 可选择内置(默认)或固定大小 |
| AgentCore 网关集成 | 支持 | 不支持 |
| 基础架构管理 | 无需填写 | 您可以预置和维护您的矢量数据库,并可以直接访问它 |
| 适用于 | End-to-end 使用本机连接器和代理检索进行托管 RAG | 自定义矢量数据库配置 |
| 亚马逊快速集成 | 在 Quick 中以知识库的身份进行本地关联 | 客户建立自己的集成 |