Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.
Aufbau eines einheitlichen Katalogs mit Amazon DataZone
Veröffentlichungsdatum: 20. November 2024 () Geschichte des Diagramms
Der einheitliche Datenkatalog dient als zentrale Ablage für alle Datenbestände Ihres Unternehmens. Diese Architektur zeigt, wie Datensilos Amazon DataZone aufgebrochen werden, indem Daten aus verschiedenen Quellen zusammengeführt und verbesserte Suchfunktionen sowie das Vertrauen in Daten gefördert werden.
Aufbau eines einheitlichen Katalogs mit Amazon DataZone
Die folgenden Schritte beschreiben die Architektur:
-
Extrahieren Sie Daten mit Amazon AppFlow, AWS Glue, Amazon Kinesis, Amazon Managed Streaming for Apache Kafka (Amazon MSK) oder AWS Database Migration Service (AWS DMS).
-
Speichern Sie die Daten je nach Endbenutzeranforderungen in Amazon S3, Amazon Redshift oder speziell entwickelten Datenbanken wie DynamoDB. Amazon Aurora https://docs.aws.amazon.com/amazondynamodb/latest/developerguide/Introduction.html Entwerfen Sie Data Lakes, um strukturierte, halbstrukturierte und unstrukturierte Rohdaten kostengünstig zu speichern.
-
Durchforsten Sie strukturierte und halbstrukturierte Daten aus Amazon S3 mithilfe von AWS Glue Crawler, der Metadaten in den AWS Glue-Datenkatalog schreibt. https://docs.aws.amazon.com/glue/latest/dg/catalog-and-crawler.html Führen Sie mithilfe von AWS Glue Data Quality
Datenqualitätsprüfungen für ruhende Katalogtabellen durch. Verwenden Sie Java Database Connectivity (JDBC) -Datenquellen, um die Daten zu crawlen und zu katalogisieren. -
Die Amazon DataZone Domain fungiert als zentraler Hub für das Katalog-Repository. Verwenden Sie die AWS Glue-Datenkatalog-Datenquelle, um vorhandene Datenbestände aus Data Lakes und Datenbanken zu integrieren. Extrahieren Sie mit Amazon Redshift automatisch technische Metadaten von Datenbanktabellen und Ansichten inAmazon DataZone.
-
Verwenden Sie das Amazon DataZone Datenportal,
um Daten eigenständig zu entdecken, zu katalogisieren, zu teilen und zu verwalten. -
Organisieren Sie Amazon DataZone Entitäten mithilfe von Domäneneinheiten auf verschiedenen Hierarchieebenen.
-
Amazon DataZoneDatenprojekte bieten einen Raum für die Zusammenarbeit, in dem Mitglieder Datenbestände aus ihren jeweiligen Geschäftsbereichen integrieren können. Geschäftsglossare definieren Geschäftsbegriffe im Zusammenhang mit Datenbeständen. Metadatenformulare erweitern den Geschäftskontext von Asset-Metadaten. Benutzerdefinierte Ressourcen erweitern den Katalog über vordefinierte Systemressourcen hinaus.
-
Katalogisieren Sie unstrukturierte Datenbestände, die in Amazon S3 gespeichert sind, und veröffentlichen Sie sie dort, Amazon DataZone indem Sie sie mit relevanten benutzerdefinierten Asset-Typen kennzeichnen.
-
Jedes Datenobjekt, das in das System eingebunden Amazon DataZone ist, ist Teil von Inventory. Bereichern Sie den Datenbestand mit Geschäftskatalogen, Datenherkunft und Datenqualität, um die Auffindbarkeit zu verbessern.
Weitere Informationen
Weitere Informationen finden Sie in den folgenden Ressourcen:
Geschichte des Diagramms
Abonnieren Sie den RSS-Feed, um über Aktualisierungen dieses Referenzarchitekturdiagramms informiert zu werden.
| Änderung | Beschreibung | Datum |
|---|---|---|
Erste Veröffentlichung | Das Referenzarchitekturdiagramm wurde zuerst veröffentlicht. | 20. November 2024 |
Anmerkung
Um RSS-Updates zu abonnieren, muss ein RSS-Plugin für den von Ihnen verwendeten Browser aktiviert sein.