View a markdown version of this page

Replizieren von S3-Tabellen - Amazon Simple Storage Service

Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.

Replizieren von S3-Tabellen

Amazon S3-Tabellen unterstützen die automatische Replikation von Apache Iceberg-Tabellen, die in Amazon S3-Tabellen-Buckets gespeichert sind. Replikationsziele können sich in derselben AWS Region, in mehreren AWS Regionen, demselben Konto oder auf andere AWS Konten befinden. Indem Sie die Replikation für Ihre Tabellen konfigurieren, können Sie schreibgeschützte Replikate Ihrer Daten an mehreren Standorten verwalten. Sie können Replikate verwenden, um die Datenverfügbarkeit zu verbessern, Compliance-Anforderungen zu erfüllen und die Zugriffsleistung für verteilte Anwendungen zu erhöhen.

Die S3-Tabellenreplikation gewährleistet die Datenkonsistenz, indem alle Tabellenaktualisierungen, einschließlich Snapshots, Metadaten und Datendateien, in derselben Reihenfolge wie die Quelltabelle in der Zieltabelle gespeichert werden.

Wann sollte die S3-Tabellenreplikation verwendet werden

Sie können die S3-Tabellenreplikation für die folgenden Zwecke verwenden:

  • Latenz minimieren — Wenn sich Ihre Kunden an zwei geografischen Standorten befinden, können Sie die Latenz beim Zugriff auf Tabellen minimieren, indem Sie Lesereplikate in AWS Regionen verwalten, die Ihren Benutzern geografisch näher sind.

  • Einhaltung gesetzlicher Vorschriften — Sie können Read Replicas an bestimmten geografischen Standorten oder AWS Konten verwalten, was Ihnen helfen kann, bestimmte behördliche oder Compliance-Anforderungen zu erfüllen. Sie können den Replizierungszieltabellen-Bucket so konfigurieren, dass Tabellen mit anderen AWS KMS-Schlüsseln als der Quelltabellen-Bucket verschlüsselt werden.

  • Zentralisierte Analysen — Wenn Ihre Daten auf mehrere AWS Regionen verteilt sind, können Sie Region-specific Datensätze in eine zentrale Region replizieren, um einheitliche Berichte, regionsübergreifende Analysen und Modelltraining für maschinelles Lernen zu ermöglichen. Dadurch entfällt die Notwendigkeit, regionsübergreifende Abfragen durchzuführen oder benutzerdefinierte Datenaggregationspipelines zu erstellen.

  • Test- und Entwicklungsumgebungen — Sie können Read-Repliken von Produktionstabellen in separaten Buckets AWS-Konten oder Tabellen-Buckets erstellen, um realistische Testdaten für Entwicklungs- und QA-Teams bereitzustellen. Dadurch werden die Test-Workloads von den Produktionssystemen isoliert und gleichzeitig sichergestellt, dass die Testumgebungen über aktuelle, produktionsähnliche Daten verfügen, ohne dass manuelle Exporte oder Datensynchronisierungsprozesse erforderlich sind.

Features

Die S3-Tabellenreplikation bietet die folgenden Funktionen.

Read-only Replikate für S3-Tabellen

Bei der S3-Tabellenreplikation werden schreibgeschützte Replikate Ihrer Apache Iceberg-Tabellen in Tabellen-Buckets erstellt. Sie können Replikate unabhängig voneinander mit einer beliebigen Engine abfragen. Iceberg-compatible

Automatisch verwaltete Replikate

Der S3-Tabellen-Replikationsdienst verwaltet automatisch Replikattabellen. Bei der Replikation werden Replikate in der Regel innerhalb von Minuten nach der Aktualisierung der Quelle aktualisiert. S3 Tables schreibt alle Aktualisierungen in derselben Reihenfolge wie die Quelltabelle fest, um die Konsistenz zu gewährleisten.

Replikation auf mehrere Ziele

Sie können dieselbe Tabelle in mehrere Zieltabellen-Buckets replizieren. Replikationsziele können sich innerhalb desselben AWS-Region, mehrerer Konten AWS-Regionen, desselben AWS Kontos oder anderer AWS Konten befinden.

Unabhängige Aufbewahrung von Snapshots

Der Snapshot-Ablauf für Replikattabellen ist unabhängig von der Quelltabelle, sodass Sie bei Bedarf unterschiedliche Aufbewahrungsfristen für Replikattabellen festlegen können. Beispielsweise können Sie Ihre Quelltabelle so konfigurieren, dass Snapshots 30 Tage lang aufbewahrt werden, und gleichzeitig eine Aufbewahrungsfrist von 90 Tagen für Replikattabellen festlegen. Wenn Sie einen längeren Aufbewahrungszeitraum für Replikate konfigurieren, bleiben Snapshots, die an der Quelle ablaufen, in den Replikaten verfügbar und abfragbar. Diese Konfiguration bietet erweiterte Funktionen für Zeitreisen für historische Analysen.

Pflegen Sie Replikattabellen in kostengünstigeren Speicherebenen

Sie können Zieltabellen-Buckets so konfigurieren, dass sie die Intelligent-Tiering S3-Speicherklasse verwenden, wodurch die Speicherkosten automatisch auf der Grundlage von Zugriffsmustern optimiert werden, ohne dass die Leistung beeinträchtigt wird oder ein betrieblicher Aufwand entsteht. S3 Intelligent-Tiering eignet sich gut für Replikattabellen, auf die möglicherweise weniger häufig zugegriffen wird.

Weitere Informationen zur Replikation von S3-Tabellen finden Sie in den folgenden Themen.