View a markdown version of this page

网页搜索工具 - Amazon Bedrock AgentCore

网页搜索工具

人工智能代理正在改变组织与信息交互的方式,但他们面临着一个基本的局限性:他们的知识在培训时被冻结。当用户询问今天的股票价格或一小时前发货的软件版本时,仅仅依赖其培训数据的代理商无法提供准确的答案。

构建自定义网络搜索集成来解决这个问题非常昂贵——购买第三方搜索API,管理密钥、配额和速率限制,解析提供商之间不一致的结果格式,构建片段提取逻辑以便模型获得相关的段落而不是原始的HTML,推断客户查询的去向以及如何保留数据,以及随着时间的推移保持新鲜度和覆盖范围。其中每一个本身都是一个项目。

Amazon Bedrock 上的网络搜索工具 AgentCore 消除了这种复杂性。它是一种完全托管的 MCP-compliant Web 搜索功能,可让您的代理从 Web 检索信息,而无需任何基础架构开销。它可用作托管连接器,您可以将其连接到 AgentCore 网关。代理通过标准tools/list调用发现它,并像任何其他模型上下文协议工具一样调用它。无需配置搜索 API,无需管理出站凭证,也无需维护结果解析粘合剂。

以下各节将介绍主要功能、专门构建的 Web 索引的架构、隐私保障、用例以及如何设置 Web Search Tool。

关键功能

  • Up-to-date 信息访问权限 — 检索当前的网络结果,包括标题、网址、片段和发布日期,以便在最新信息中获取地面工作人员的回复。

  • 零基础架构管理 — 无需配置第三方搜索 API,也无需扩展即可配置。网关会自动将网络搜索作为标准的 MCP 工具公开。

  • 与@@ 框架无关 — 通过标准模型上下文协议与 Strands Ag ents LangChain LangGraph、、、CrewaI 或任何 MCP-compatible 客户端配合使用。

  • Purpose-built Web 索引 — 由跨越数百亿个文档的 Amazon-operated Web 索引提供支持。

  • 高可信度事实的知识图谱 — 将实体及其关系置于基础上,以提供事实答案,而不是离开模型从提取的页面文本中推断出答案。

  • 语义片段提取 — 从每个网页中提取语义相关的段落,针对模型的上下文窗口进行了优化,而不是返回原始的 HTML 或整页。

Purpose-built 网络索引

许多向代理添加网络搜索的解决方案都是第三方搜索引擎的封装。Amazon Bedrock AgentCore 上的网络搜索工具与众不同——它由亚马逊直接构建和运营的网络索引提供支持。

覆盖面广

该索引涵盖数百亿份文档。这种规模对覆盖范围很重要——当索引范围广泛而不是仅限于最受欢迎的页面时,可以更有效地回答有关利基库或模糊产品规格的长尾问题。

持续更新

Amazon 会持续刷新索引,在几分钟内反映出新的和变更的内容。对于回答有关价格走势的问题或刚刚发布的公告的代理商来说,最近窗口是有根据的答案和自信的错误答案之间的区别。当你的经纪人搜索 “今天发生了什么” 时,结果反映了今天的实际情况。

高可信度事实的知识图表

Web Search Tool 包括一个内置的知识图表,可以为实体及其关系奠定基础。对于事实问题(例如谁担任角色或某件事何时成立),知识图谱提供了高度可信的答案,而不是让模型从提取的页面文本中推断出答案。这减少了特工仅从片段中拼凑出答案时可能发生的那种微妙的事实偏差。

针对模型上下文进行了优化的语义片段提取

该工具不会将原始的 HTML 转储或整页交给模型,而是执行语义相关的片段提取。它从每个网页中提取实际与查询相关的段落,并以针对模型的上下文窗口进行了优化的形式返回这些段落。结果是每个代币更密集、更相关的上下文——模型可以看到重要的部分,在样板和导航chrome上花费更少的代币,这有助于提高被引答案的精度。

私密性设计

对于许多企业来说,阻碍网络搜索部署的问题不是 “它行得通吗”,而是 “我的用户的查询去了哪里,他们会怎样?” Web Search Tool 的构建使这些答案非常简单。

查询永远不会离开 AWS

当您的代理发出搜索时,查询将完全在 AWS 基础架构内提供。客户查询不会发送到第三方搜索引擎,也不会发送到外部 AWS搜索引擎。网关对 AWS拥有的连接器进行身份验证,并在内部路由请求,因此数据路径端对 AWS 端地保持在内部。对于有数据流出问题的团队,这会删除整个类别的审核。

工作原理

Web 搜索工具是一个内置的连接器。网关负责架构管理、参数管理、端点解析和服务身份验证。

  1. 网关设置-使用创建网关并添加 Web 搜索工具目标connectorId: "web-search"。网关会对工具架构进行快照并配置集成。

  2. 工具发现-您的代理调用 tools/list Gateway 端点并发现带有其输入架构的WebSearch工具。

  3. 搜索调用-您的代理tools/call使用自然语言查询(最多 200 个字符)进行呼叫。网关向后端进行身份验证,并在后端内部 AWS路由请求。

  4. 结构化结果 — 该工具以文本和结构化 JSON 格式返回包含语义相关的文本片段、URL、标题和发布日期的结果。

  5. 有@@ 根据的回应-您的代理使用结果撰写带有引用来源的回复。

使用案例

  • Up-to-date 研究 — 通过搜索网络并将结果与来源引文进行综合,回答有关时事、股票价格或最近公告的问题。

  • Fact-checking— 通过搜索主要来源并使用知识图支持的事实答案来确认或更正数字,从而验证文档中的主张。

  • 竞争情报 — 监控来自公共网络来源的竞争对手公告、产品发布或定价变化。

  • 淘汰陈旧知识 — 允许代理访问培训截止后发布的信息,例如新软件发布、政策变更或突破性进展。

设置 Web 搜索工具

有关如何使用 Web 搜索工具连接器配置创建网关目标的说明,包括使用 Python SDK 和 CLI 的设置示例,请参阅目标配置指南中的设置网络搜索工具

搭配安全带使用

要提供AgentCore 安全带 Web 搜索功能,请将您在设置 Web Search Tool 中创建的网关作为agentcore_gateway工具附加到安全带。线束执行角色需要网关 ARN 上的bedrock-agentcore:InvokeGateway权限。有关端到端演练,请参阅线束文档中的工具

配置域筛选

您可以通过配置域名拒绝列表来限制允许网络搜索工具查询哪些域。有关配置示例和详细信息,请参阅目标配置指南中的配置域筛选

配置网关服务角色

Gateway 需要一个允许 AgentCore 服务代表您执行操作的服务角色。有关所需的 IAM 权限和策略配置,请参阅目标配置指南中的配置网关服务角色

输入架构

当通过以下方式调用时,Web 搜索工具接受以下输入架构tools/call

{ "inputSchema": { "type": "object", "properties": { "query": { "description": "The search query string", "type": "string" }, "maxResults": { "description": "Maximum number of results to return. Valid range: 1-25. Defaults to 10.", "type": "integer" } }, "required": ["query"] } }
字段 类型 必需 描述

query

字符串

搜索查询字符串。必须不超过 200 个字符。

maxResults

integer

要返回的最大结果数量。有效范围:1-25。默认值为 10。

响应格式

Web 搜索工具按以下 MCP-compliant 格式返回结果:

{ "isError": false, "content": [ { "type": "text", "text": "{\"id\":\"824f89d0\",\"results\":[{\"text\":\"Python 3.13 was released on October 7, 2024, featuring improvements to the interactive interpreter, experimental free-threaded mode, and a preliminary JIT compiler...\",\"publishedDate\":\"2024-10-07\",\"url\":\"https://example.com/python/releases/3.13\",\"title\":\"Python 3.13 Release Highlights\"}]}" } ] }
字段 类型 必需 描述

text

字符串

搜索结果的文字内容或片段

url

字符串

源网页的网址

title

字符串

来源网页的标题

publishedDate

字符串

结果公布日期

可用性

Web 搜索工具连接器在美国东部(弗吉尼亚北部)us-east-1区域可用。

由于 Amazon 运营着完整的搜索堆栈,因此新鲜度、覆盖范围、相关性和摘要质量的改进会自动通过同一个托管连接器流向您的代理。您无需进行版本升级或迁移。

可接受的用途

如果您使用网络搜索工具,则您应对自己以及您的最终用户对从网络搜索工具(“搜索结果”)检索到的内容(“搜索结果”)的使用负责。在向使用搜索结果的最终用户显示的任何输出中,您都必须保留并显示每个搜索结果中提供的来源引文和链接。您不得使用网络搜索工具 (a) 批量提取、存储或复制搜索结果中的内容,或 (b) 建立或填充竞争索引或数据库。