View a markdown version of this page

Replica delle tabelle S3 - Amazon Simple Storage Service

Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.

Replica delle tabelle S3

Le tabelle Amazon S3 supportano la replica automatica delle tabelle Apache Iceberg archiviate nei bucket di tabelle Amazon S3. Le destinazioni di replica possono trovarsi all'interno della stessa AWS regione, su più AWS regioni, sullo stesso account o su altri account. AWS Configurando la replica per le tabelle, è possibile mantenere repliche di sola lettura dei dati in più sedi. È possibile utilizzare le repliche per migliorare la disponibilità dei dati, soddisfare i requisiti di conformità e aumentare le prestazioni di accesso per le applicazioni distribuite.

La replica di S3 Tables mantiene la coerenza dei dati inviando tutti gli aggiornamenti delle tabelle, inclusi snapshot, metadati e file di dati, nella tabella di destinazione nello stesso ordine della tabella di origine.

Quando utilizzare la replica di S3 Tables

È possibile utilizzare la replica di S3 Tables per i seguenti scopi:

  • Riduci al minimo la latenza: se i tuoi clienti si trovano in due aree geografiche, puoi ridurre al minimo la latenza durante l'accesso alle tabelle mantenendo le repliche di lettura nelle AWS regioni geograficamente più vicine agli utenti.

  • Conformità normativa: puoi mantenere le repliche di lettura in aree geografiche o AWS account specifici, il che potrebbe aiutarti a soddisfare determinati requisiti normativi o di conformità. È possibile configurare il bucket della tabella di destinazione della replica per crittografare le tabelle con chiavi AWS KMS diverse da quelle di origine.

  • Analisi centralizzata: se i dati sono distribuiti in più AWS regioni, è possibile replicare i Region-specific set di dati in una regione centralizzata per la creazione di report unificati, l'analisi interregionale e l'addestramento dei modelli di machine learning. Ciò elimina la necessità di eseguire query su più regioni o creare pipeline di aggregazione dei dati personalizzate.

  • Ambienti di test e sviluppo: puoi creare repliche di lettura delle tabelle di produzione in bucket separati Account AWS o di tabelle per fornire dati di test realistici per i team di sviluppo e controllo qualità. Ciò isola i carichi di lavoro di test dai sistemi di produzione, garantendo al contempo che gli ambienti di test dispongano di dati attuali e simili a quelli di produzione senza esportazioni manuali o processi di sincronizzazione dei dati.

Funzionalità

La replica di S3 Tables offre le seguenti funzionalità.

Read-only repliche per tabelle S3

La replica di S3 Tables crea repliche di sola lettura delle tabelle Apache Iceberg su bucket di tabelle. Puoi interrogare le repliche in modo indipendente utilizzando qualsiasi motore. Iceberg-compatible

Repliche gestite automaticamente

Il servizio di replica S3 Tables mantiene automaticamente le tabelle di replica. La replica in genere aggiorna le repliche entro pochi minuti dagli aggiornamenti all'origine. S3 Tables esegue il commit di tutti gli aggiornamenti nello stesso ordine della tabella di origine per mantenere la coerenza.

Replica su più destinazioni

È possibile replicare la stessa tabella su più bucket di tabelle di destinazione. Le destinazioni di replica possono trovarsi all'interno dello stesso Regione AWS, su più account Regioni AWS, nello stesso AWS account o in altri account. AWS

Conservazione indipendente delle istantanee

La scadenza delle istantanee per le tabelle di replica è indipendente dalla tabella di origine e consente di impostare periodi di conservazione diversi sulle tabelle di replica, se necessario. Ad esempio, è possibile configurare la tabella di origine per conservare le istantanee per 30 giorni impostando un periodo di conservazione di 90 giorni per le tabelle di replica. Se si configura un periodo di conservazione più lungo sulle repliche, le istantanee che scadono all'origine rimangono disponibili e interrogabili nelle repliche. Questa configurazione offre funzionalità estese di viaggio nel tempo per l'analisi storica.

Mantieni le tabelle di replica in livelli di storage a basso costo

È possibile configurare i bucket della tabella di destinazione per utilizzare la classe di Intelligent-Tiering storage S3, che ottimizza automaticamente i costi di storage in base ai modelli di accesso senza impatto sulle prestazioni o sovraccarico operativo. S3 Intelligent-Tiering è adatto per tabelle di replica a cui è possibile accedere meno frequentemente.

Per ulteriori informazioni sulla replica delle tabelle S3, consulta i seguenti argomenti.