

Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.

# Concepts de diffusion de données
<a name="data-delivery-concepts"></a>

 Utilisez cette rubrique pour passer en revue les concepts clés relatifs aux tableaux de streaming et à la diffusion d'Amazon S3 dans Amazon Kinesis Data Streams. 

## Actualité des données
<a name="data-delivery-concepts-data-freshness"></a>

 La fraîcheur des données définit la durée maximale (en secondes) pendant laquelle Kinesis Data Streams met en mémoire tampon les enregistrements entrants avant de les transmettre à la destination. Vous pouvez configurer la fraîcheur des données entre 300 et 900 secondes (5 à 15 minutes). La valeur par défaut est de 300 secondes. 
+  **Valeurs inférieures ** : livraison plus rapide vers votre destination grâce à des lots plus petits. 
+  **Valeurs plus élevées ** : traitement par lots plus efficace, qui produit des fichiers moins nombreux et plus volumineux à la destination. 

## Formats d'entrée pour les tableaux de streaming
<a name="data-delivery-concepts-input-formats-s3-tables"></a>

 Lors de la diffusion vers des tables de streaming sur Apache Iceberg, la diffusion des données prend en charge les formats d'enregistrement d'entrée suivants. Les deux formats nécessitent AWS Glue Schema Registry. 
+  **JSON ** : enregistrements JSON simples. Vous devez fournir un `GSRSchemaARN` (nom d'un AWS Glue schéma de registre de schémas) qui fait référence à un schéma enregistré dans le registre de AWS Glue schémas. 
+  **GSR\_JSON ** (AWS Glue Schema Registry JSON) — Enregistrements JSON dont l'ID de schéma est intégré à chaque enregistrement. Le schéma est résolu automatiquement à partir du registre des AWS Glue schémas. 

## Formats d'entrée pour les compartiments Amazon S3 à usage général
<a name="data-delivery-concepts-input-formats-s3"></a>

 Lors de la diffusion vers des compartiments Amazon S3 à usage général, la diffusion des données prend en charge les formats d'enregistrement d'entrée suivants. Aucun registre de schéma n'est requis. 
+ **JSON ** : enregistrements JSON simples.
+ **STRING ** — enregistrements de UTF-8 chaînes.
+ **BYTE\_ARRAY ** — enregistrements binaires bruts.

**Note**  
 Le `GSR_JSON` format n'est pas pris en charge pour les compartiments Amazon S3 à usage général. Il est disponible uniquement pour la diffusion sur les tables de streaming d'Apache Iceberg. 

## Application du schéma
<a name="data-delivery-concepts-schema-enforcement"></a>

 Pour les tables de streaming sur Apache Iceberg, chaque enregistrement est validé par rapport au schéma enregistré dans AWS Glue Schema Registry. Les enregistrements qui ne sont pas conformes au schéma ne sont pas transmis à votre table de diffusion. Les métadonnées d'échec sont écrites dans la file d'attente de lettres mortes à des fins de dépannage. La fourniture de données ne prend pas en charge l'évolution des schémas. Cela inclut l'ajout de nouveaux champs, la suppression de champs existants, le changement de nom des champs ou la modification des types de données des champs. 

## Pas de remblai
<a name="data-delivery-concepts-no-backfill"></a>

 Votre destination reçoit uniquement les enregistrements produits après la création de la table de diffusion ou la configuration de la diffusion S3. Les enregistrements existants dans le flux ne sont pas remplis. 

## Nouveau tableau par livraison
<a name="data-delivery-concepts-new-table-per-channel"></a>

 Chaque diffusion de table en streaming crée sa propre table Iceberg à destination. La diffusion vers des tables existantes n'est pas prise en charge. Vous spécifiez l'ARN, l'espace de noms et le nom de la table du bucket de tables lors de l'appel`CreateChannel`. 

## Dead-letter file d'attente
<a name="data-delivery-concepts-dead-letter-queue"></a>

 Une file d'attente de lettres mortes capture les informations relatives aux enregistrements qui n'ont pas pu être livrés correctement. 
+  **Tables de streaming sur Apache Iceberg ** : une file d'attente de lettres mortes est requise. Vous devez spécifier un compartiment S3 et un préfixe pour les enregistrements ayant échoué. 
+  **Compartiments Amazon S3 à usage général ** : une file d'attente de lettres mortes est facultative. S'il n'est pas spécifié, il utilise par défaut le même compartiment de destination avec un préfixe d'erreur. 

 La file d'attente de lettres mortes contient les identificateurs d'enregistrement et le contexte de l'erreur, et non les charges utiles complètes des enregistrements. 

## Compactage en ligne
<a name="data-delivery-concepts-inline-compaction"></a>

 La diffusion des données effectue un compactage en ligne en agrégeant les enregistrements de fragments dans des fichiers de taille optimale. Cela réduit le nombre de petits fichiers sur la destination et améliore les performances des requêtes. 

## États de livraison
<a name="data-delivery-concepts-channel-states"></a>

 Une livraison passe par les états suivants au cours de son cycle de vie : 
+ **CRÉATION ** : la livraison est en cours de provisionnement.
+ **ACTIF ** : la livraison fournit des enregistrements.
+ **MISE À JOUR ** : une modification de configuration est en cours.
+ **SUPPRESSION ** : la livraison est en cours de suppression.
+ **ÉCHEC ** : la livraison a rencontré une erreur irrécupérable.

## Append-only livraison
<a name="data-delivery-concepts-append-only"></a>

 La livraison se fait uniquement en annexe. Les mises à jour et les modifications ne sont pas prises en charge. Chaque enregistrement du flux est écrit sous la forme d'une nouvelle ligne à la destination. 