Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.
Replizieren von S3-Tabellen
Amazon S3-Tabellen unterstützen die automatische Replikation von Apache Iceberg-Tabellen, die in Amazon S3-Tabellen-Buckets gespeichert sind. Replikationsziele können sich in derselben AWS Region, in mehreren AWS Regionen, demselben Konto oder auf andere AWS Konten befinden. Indem Sie die Replikation für Ihre Tabellen konfigurieren, können Sie schreibgeschützte Replikate Ihrer Daten an mehreren Standorten verwalten. Sie können Replikate verwenden, um die Datenverfügbarkeit zu verbessern, Compliance-Anforderungen zu erfüllen und die Zugriffsleistung für verteilte Anwendungen zu erhöhen.
Die S3-Tabellenreplikation gewährleistet die Datenkonsistenz, indem alle Tabellenaktualisierungen, einschließlich Snapshots, Metadaten und Datendateien, in derselben Reihenfolge wie die Quelltabelle in der Zieltabelle gespeichert werden.
Wann sollte die S3-Tabellenreplikation verwendet werden
Sie können die S3-Tabellenreplikation für die folgenden Zwecke verwenden:
-
Latenz minimieren — Wenn sich Ihre Kunden an zwei geografischen Standorten befinden, können Sie die Latenz beim Zugriff auf Tabellen minimieren, indem Sie Lesereplikate in AWS Regionen verwalten, die Ihren Benutzern geografisch näher sind.
-
Einhaltung gesetzlicher Vorschriften — Sie können Read Replicas an bestimmten geografischen Standorten oder AWS Konten verwalten, was Ihnen helfen kann, bestimmte behördliche oder Compliance-Anforderungen zu erfüllen. Sie können den Replizierungszieltabellen-Bucket so konfigurieren, dass Tabellen mit anderen AWS KMS-Schlüsseln als der Quelltabellen-Bucket verschlüsselt werden.
-
Zentralisierte Analysen — Wenn Ihre Daten auf mehrere AWS Regionen verteilt sind, können Sie Region-specific Datensätze in eine zentrale Region replizieren, um einheitliche Berichte, regionsübergreifende Analysen und Modelltraining für maschinelles Lernen zu ermöglichen. Dadurch entfällt die Notwendigkeit, regionsübergreifende Abfragen durchzuführen oder benutzerdefinierte Datenaggregationspipelines zu erstellen.
-
Test- und Entwicklungsumgebungen — Sie können Read-Repliken von Produktionstabellen in separaten Buckets AWS-Konten oder Tabellen-Buckets erstellen, um realistische Testdaten für Entwicklungs- und QA-Teams bereitzustellen. Dadurch werden die Test-Workloads von den Produktionssystemen isoliert und gleichzeitig sichergestellt, dass die Testumgebungen über aktuelle, produktionsähnliche Daten verfügen, ohne dass manuelle Exporte oder Datensynchronisierungsprozesse erforderlich sind.
Features
Die S3-Tabellenreplikation bietet die folgenden Funktionen.
Read-only Replikate für S3-Tabellen
Bei der S3-Tabellenreplikation werden schreibgeschützte Replikate Ihrer Apache Iceberg-Tabellen in Tabellen-Buckets erstellt. Sie können Replikate unabhängig voneinander mit einer beliebigen Engine abfragen. Iceberg-compatible
Automatisch verwaltete Replikate
Der S3-Tabellen-Replikationsdienst verwaltet automatisch Replikattabellen. Bei der Replikation werden Replikate in der Regel innerhalb von Minuten nach der Aktualisierung der Quelle aktualisiert. S3 Tables schreibt alle Aktualisierungen in derselben Reihenfolge wie die Quelltabelle fest, um die Konsistenz zu gewährleisten.
Replikation auf mehrere Ziele
Sie können dieselbe Tabelle in mehrere Zieltabellen-Buckets replizieren. Replikationsziele können sich innerhalb desselben AWS-Region, mehrerer Konten AWS-Regionen, desselben AWS Kontos oder anderer AWS Konten befinden.
Unabhängige Aufbewahrung von Snapshots
Der Snapshot-Ablauf für Replikattabellen ist unabhängig von der Quelltabelle, sodass Sie bei Bedarf unterschiedliche Aufbewahrungsfristen für Replikattabellen festlegen können. Beispielsweise können Sie Ihre Quelltabelle so konfigurieren, dass Snapshots 30 Tage lang aufbewahrt werden, und gleichzeitig eine Aufbewahrungsfrist von 90 Tagen für Replikattabellen festlegen. Wenn Sie einen längeren Aufbewahrungszeitraum für Replikate konfigurieren, bleiben Snapshots, die an der Quelle ablaufen, in den Replikaten verfügbar und abfragbar. Diese Konfiguration bietet erweiterte Funktionen für Zeitreisen für historische Analysen.
Pflegen Sie Replikattabellen in kostengünstigeren Speicherebenen
Sie können Zieltabellen-Buckets so konfigurieren, dass sie die Intelligent-Tiering S3-Speicherklasse verwenden, wodurch die Speicherkosten automatisch auf der Grundlage von Zugriffsmustern optimiert werden, ohne dass die Leistung beeinträchtigt wird oder ein betrieblicher Aufwand entsteht. S3 Intelligent-Tiering eignet sich gut für Replikattabellen, auf die möglicherweise weniger häufig zugegriffen wird.
Weitere Informationen zur Replikation von S3-Tabellen finden Sie in den folgenden Themen.