View a markdown version of this page

使用 AWS Glue 和 Amazon Bedrock 进行亚马逊 OpenSearch 趋势查询 - 使用 AWS Glue 和 Amazon Bedrock 进行亚马逊 OpenSearch 趋势查询

本文属于机器翻译版本。若本译文内容与英语原文存在差异,则一律以英文原文为准。

使用 AWS Glue 和 Amazon Bedrock 进行亚马逊 OpenSearch 趋势查询

发布日期:2024 年 12 月 18 日 (图表历史)

该架构演示了如何使用 AWS AWS Glue Amazon Bedrock、A mazon Service 、矢量嵌入、 K-means 集群和 LLM 等 OpenSearch 服务来识别热门搜索查询,从而优化内容策略和改善用户体验。

使用 AWS Glue 和 Amazon Bedrock 进行亚马逊 OpenSearch 趋势查询

架构图显示了使用亚马逊 OpenSearch 服务、AWS Glue 和步进函数进行趋势查询识别。Amazon Bedrock

以下步骤描述了架构:

  1. 最终用户在搜索页面上搜索文章。查询将发送到亚马逊 OpenSearch 服务以检索结果。

  2. 搜索查询日志使用 API 网关代理通过 Amazon Kinesis 数据流进行流式传输。

  3. Amazon Data Firehose在最大缓冲限制下每 15 分钟合并搜索查询日志。

  4. Lambda 函数压缩搜索查询日志,以优化 Amazon S3 存储。

  5. EventBridge每日调度程序会触发步进函数以识别趋势查询。

  6. AWS Glue 爬虫为存储在 Amazon S3 中的搜索查询日志创建目录表。

  7. AWS Glue 任务整合查询日志并将其转换为Parquet文件以提高查询性能。

  8. AWS Glue 爬虫为存储在 Amazon S3 中的Parquet文件创建目录表。

  9. AWS Gl K-means ue 任务使用集群处理数据,创建搜索查询集群并将其存储在 Amazon S3 中。

  10. AWS Glue 爬虫为存储在 Amazon S3 中的搜索查询集群创建目录表。

  11. Athena 查询每个集群的前 n 个查询,并将 CSV 文件作为输入传递给 Lambda 函数。

  12. Lambda 循环处理 CSV 文件,调用Amazon Bedrock以识别每个集群最相关的搜索查询,并将结果存储在 DynamoDB 中。https://docs.aws.amazon.com/amazondynamodb/latest/developerguide/Introduction.html

  13. 当用户打开搜索页面时,应用程序逻辑使用 API 网关使用 Lambda 和 DynamoDB 表检索热门趋势查询,以显示在搜索页面上。

  14. 业务分析师使用趋势查询 API 来分析热门搜索查询并定义内容策略。

延伸阅读

有关更多信息,请参阅以下资源:

图表历史

要获得有关此参考架构图更新的通知,请订阅 RSS 提要。

变更说明日期

初次发布

参考架构图首次发布。

2024 年 12 月 18 日

注意

要订阅 RSS 更新,必须为正在使用的浏览器启用 RSS 插件。