View a markdown version of this page

Concetti chiave di Amazon Ingestion OpenSearch - OpenSearch Servizio Amazon

Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.

Concetti chiave di Amazon Ingestion OpenSearch

Prima di iniziare a usare OpenSearch Ingestion, è utile comprendere questi concetti chiave.

Pipeline

Dal punto di vista OpenSearch dell'ingestione, una pipeline si riferisce a un singolo raccoglitore di dati fornito creato all'interno del Servizio. OpenSearch Puoi considerarlo come l'intero file di configurazione YAML, che include una o più sottopipeline. Per i passaggi per creare una pipeline di ingestion, consulta. Creazione di pipeline

Sub-pipeline

Definite le pipeline secondarie all'interno di un file di configurazione YAML. Ogni subpipeline è una combinazione di una sorgente, un buffer, zero o più processori e uno o più sink. È possibile definire più sottopipeline in un singolo file YAML, ognuna con sorgenti, processori e sink univoci. Per facilitare il monitoraggio con CloudWatch e altri servizi, ti consigliamo di specificare un nome di pipeline distinto da tutte le relative sottopipeline.

È possibile mettere insieme più sottopipeline all'interno di un singolo file YAML, in modo che l'origine di una sottopipeline sia un'altra sub-pipeline e il relativo sink sia una terza sottopipeline. Per vedere un esempio, consulta Utilizzo di una pipeline di OpenSearch ingestione con Collector OpenTelemetry.

Origine

Il componente di input di una sottopipeline. Definisce il meccanismo attraverso il quale una pipeline consuma i record. La fonte può consumare eventi ricevendoli tramite HTTPS o leggendo da endpoint esterni come Amazon S3. Esistono due tipi di sorgenti: basate su push e su pull. Push-based fonti, come i log HTTP e OtEL, trasmettono i record agli endpoint di inserimento. Pull-basedfonti, come Otel trace e S3, estraggono i dati dalla fonte.

Processori

Unità di elaborazione intermedie in grado di filtrare, trasformare e arricchire i record nel formato desiderato prima di pubblicarli nel sink. Il processore è un componente opzionale di una pipeline. Se non si definisce un processore, i record vengono pubblicati nel formato definito nell'origine. È possibile avere più di un processore. Una pipeline esegue i processori nell'ordine in cui li definisci.

Sink

Il componente di output di una subpipeline. Definisce una o più destinazioni in cui una subpipeline pubblica i record. OpenSearch Ingestion supporta OpenSearch i domini di servizio come sink. Supporta anche le subpipeline come pozzi. Ciò significa che è possibile mettere insieme più sottopipeline all'interno di una singola pipeline di OpenSearch Ingestion (file YAML). Self-managed OpenSearch i cluster non sono supportati come sink.

Buffer

La parte di un processore che funge da livello tra l'origine e il sink. Non puoi configurare manualmente un buffer all'interno della pipeline. OpenSearch L'ingestione utilizza una configurazione del buffer predefinita.

Route

Parte di un processore che consente agli autori di pipeline di inviare solo eventi che soddisfano determinate condizioni a diversi sink.

Una definizione di subpipeline valida deve contenere una sorgente e un sink. Per ulteriori informazioni su ciascuno di questi elementi della pipeline, consultate il riferimento di configurazione.