

Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.

# Concetti di distribuzione dei dati
<a name="data-delivery-concepts"></a>

 Usa questo argomento per esaminare i concetti chiave per le tabelle di streaming e la distribuzione di Amazon S3 in Amazon Kinesis Data Streams. 

## Aggiornamento dei dati
<a name="data-delivery-concepts-data-freshness"></a>

 L'aggiornamento dei dati definisce il tempo massimo (in secondi) in cui Kinesis Data Streams memorizza nel buffer i record in ingresso prima di consegnarli alla destinazione. È possibile configurare l'aggiornamento dei dati tra 300 e 900 secondi (da 5 a 15 minuti). Il valore predefinito è 300 secondi. 
+  **Valori inferiori**: consegna più rapida a destinazione con lotti di dimensioni inferiori. 
+  **Valori più elevati**: raggruppamento in batch più efficiente, che produce un numero inferiore di file di dimensioni maggiori a destinazione. 

## Formati di input per tabelle di streaming
<a name="data-delivery-concepts-input-formats-s3-tables"></a>

 Durante la distribuzione alle tabelle di streaming su Apache Iceberg, la distribuzione dei dati supporta i seguenti formati di record di input. Entrambi i formati richiedono AWS Glue Schema Registry. 
+  **JSON**: semplici record JSON. È necessario fornire uno `GSRSchemaARN` (lo schema di uno schema del Registro di AWS Glue schema) che faccia riferimento a uno schema registrato in AWS Glue Schema Registry. 
+  **GSR\_JSON ** (AWS Glue Schema Registry JSON) — Record JSON con l'ID dello schema incorporato in ogni record. Lo schema viene risolto automaticamente da Schema Registry. AWS Glue 

## Formati di input per bucket Amazon S3 per uso generico
<a name="data-delivery-concepts-input-formats-s3"></a>

 Nella distribuzione a bucket Amazon S3 per uso generico, la distribuzione dei dati supporta i seguenti formati di record di input. Non è richiesto alcun registro degli schemi. 
+ **JSON**: semplici record JSON.
+ **STRING ** — record di UTF-8 stringa.
+ **BYTE\_ARRAY ** — record binari non elaborati.

**Nota**  
 Il `GSR_JSON` formato non è supportato per i bucket Amazon S3 generici. È disponibile solo per la distribuzione ai tavoli di streaming su Apache Iceberg. 

## Applicazione dello schema
<a name="data-delivery-concepts-schema-enforcement"></a>

 Per le tabelle di streaming su Apache Iceberg, ogni record viene convalidato rispetto allo schema registrato nello AWS Glue Schema Registry. I record non conformi allo schema non vengono inviati alla tabella di streaming. I metadati relativi agli errori vengono scritti nella coda delle lettere morte per la risoluzione dei problemi. La distribuzione dei dati non supporta l'evoluzione dello schema. Ciò include l'aggiunta di nuovi campi, la rimozione di campi esistenti, la ridenominazione dei campi o la modifica dei tipi di dati dei campi. 

## Nessun riempimento
<a name="data-delivery-concepts-no-backfill"></a>

 La tua destinazione riceve solo i record prodotti dopo aver creato la tabella di streaming o configurato la consegna S3. I record esistenti nello stream non vengono compilati nuovamente. 

## Nuova tabella per spedizione
<a name="data-delivery-concepts-new-table-per-channel"></a>

 Ogni tavolo in streaming consegnato crea il proprio tavolo Iceberg a destinazione. La consegna alle tabelle esistenti non è supportata. Si specificano l'ARN del bucket della tabella, lo spazio dei nomi e il nome della tabella durante la chiamata. `CreateChannel` 

## Dead-letter coda
<a name="data-delivery-concepts-dead-letter-queue"></a>

 Una coda per le lettere morte raccoglie informazioni sui record che non è stato possibile recapitare correttamente. 
+  **Tabelle in streaming su Apache Iceberg**: è richiesta una coda per le lettere morte. È necessario specificare un bucket S3 e un prefisso per i record non riusciti. 
+  **Bucket Amazon S3 per uso generico**: una coda di lettere morte è facoltativa. Se non specificato, per impostazione predefinita è lo stesso bucket di destinazione con un prefisso di errore. 

 La coda delle lettere morte contiene gli identificatori dei record e il contesto dell'errore, non i payload completi dei record. 

## Compattazione in linea
<a name="data-delivery-concepts-inline-compaction"></a>

 La distribuzione dei dati esegue la compattazione in linea aggregando i record su frammenti in file di dimensioni ottimali. Ciò riduce il numero di file di piccole dimensioni nella destinazione e migliora le prestazioni delle query. 

## Stati di consegna
<a name="data-delivery-concepts-channel-states"></a>

 Una consegna attraversa i seguenti stati durante il suo ciclo di vita: 
+ **CREAZIONE**: la consegna è in fase di provisioning.
+ **ATTIVO**: la consegna prevede la consegna dei record.
+ **AGGIORNAMENTO**: è in corso una modifica della configurazione.
+ **ELIMINAZIONE**: la consegna viene rimossa.
+ **FALLITA**: la consegna ha riscontrato un errore irreversibile.

## Append-only consegna
<a name="data-delivery-concepts-append-only"></a>

 La spedizione è di sola spedizione. Gli aggiornamenti e gli upsert non sono supportati. Ogni record dello stream viene scritto come una nuova riga nella destinazione. 