本文属于机器翻译版本。若本译文内容与英语原文存在差异,则一律以英文原文为准。
使用联邦航空管理局 SWIM 数据湖
发布日期:2021 年 3 月 10 日 (图表历史)
美国联邦航空管理局 (FAA) 全系统信息管理 (SWIM) 数据湖提供航空飞行和天气信息的实时交付。这有助于航空公司优化运营。
该架构通过一系列AWS Lambda函数和亚马逊 Kinesis 数据流处理 SWIM 数据。它转换、丰富和分析飞行数据。然后,您可以使用 Amazon Quick Sight 对结果进行可视化或通过自定义应用程序使用结果。
FAA SWIM 数据湖图
以下步骤描述了架构:
-
SWIM 消费者应用程序消耗 SWIM 数据。它将数据发送到 Kinesis 数据流。
-
Lambda 将 XML 数据转换为 JSON 格式。
-
Lambda 简化了下游处理的 JSON 数据。
-
Lambda 筛选客户的航班数据。它向 Kinesis 数据流写入一个副本,将另一个副本写入后续的 Lambda 函数。
-
Lambda 使用操作或外部数据集丰富了客户的航班消息。
-
Lambda 向亚马逊 Auror a 写入了丰富的飞行数据。
-
Lambda 将丰富的飞行数据写入 Kinesis 数据流。
-
AWS Glue提取、转换和加载 (ETL) 任务使用适当的分区将丰富的飞行数据从 JSON 转换到 Parquet。这些作业将 Parquet 文件注册为 AWS Glue 数据目录中的外部表。
-
雅典娜、亚马逊 Redshift 和亚马逊 Aurora 等服务会分析经过转换和丰富的飞行数据。
-
Quick 、自定义应用程序和 API 等服务会消耗分析的数据。
-
AWS Glue 数据目录存储数据库和表。它们代表了亚马逊 S3、Amazon Aurora 和 Amazon Redshift 中的原始、经过转换、丰富和分析的数据集。
延伸阅读
有关更多信息,请参阅以下资源:
图表历史
要接收有关此参考架构图的更新,请订阅 RSS 提要。
| 变更 | 说明 | 日期 |
|---|---|---|
初次发布 | 参考架构图首次发布。 | 2021 年 3 月 10 日 |
RSS 订阅要求
要订阅 RSS 更新,必须为正在使用的浏览器启用 RSS 插件。