View a markdown version of this page

Configurazione di un obiettivo per un'integrazione zero-ETL - AWS Aderenza

Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.

Configurazione di un obiettivo per un'integrazione zero-ETL

Ci sono diverse opzioni offerte da AWS Glue quando si configura un target per un'integrazione zero-ETL. L'obiettivo può essere un Amazon Redshift data warehouse crittografato o un'architettura Lakehouse di Amazon. SageMaker

Prima di selezionare la destinazione per l'integrazione Zero-ETL, è necessario configurare una delle seguenti risorse di destinazione. Le opzioni di configurazione per una destinazione in un'integrazione Zero-ETL includono:

Nota

Non è possibile modificare la destinazione di un'integrazione Zero-ETL dopo la creazione.

Configurazione di un bucket S3 per uso generico

Questa sezione descrive i prerequisiti e i passaggi di configurazione per configurare un bucket S3 generico come storage per il tuo target in un'integrazione zero-ETL, utilizzando l'architettura Lakehouse di Amazon. SageMaker

Prima di creare un'integrazione zero-ETL con l'architettura Lakehouse di Amazon SageMaker utilizzando lo storage S3 generico, devi completare le seguenti attività di configurazione:

  • Configura un AWS Glue database

  • Fornire la policy RBAC del catalogo

  • Creare un ruolo IAM

  • Associa il ruolo di destinazione, il KMS (opzionale) e la connessione (opzionale) alla risorsa di destinazione

  • (Facoltativo) Configurare le proprietà della tabella di destinazione

Impostazione di un AWS Glue database

Per configurare un database di destinazione nel Data Catalog con una bucket location generica di Amazon S3:

  1. Nella home page della AWS Glue console, seleziona Database in Data Catalog.

  2. Scegliere Aggiungi database in alto a destra. Se è stato già creato un database, assicurarsi che sia impostata la posizione con l'URI di Amazon S3 per il database.

  3. Inserire un nome e una Posizione (URI Amazon S3). Si prega di notare che la posizione è necessaria per l'integrazione Zero-ETL. Al termine, fare clic su Crea database.

Nota

Il bucket Amazon S3 per uso generico deve trovarsi nella stessa regione del AWS Glue database.

Per informazioni sulla creazione di un nuovo database in AWS Glue, consulta Getting started with the Data Catalog.

È possibile anche usare la CLI create-database per creare il database in AWS Glue. Tenere presente che LocationUri in --database-input è obbligatorio.

Ottimizzazione delle tabelle Iceberg

Una volta creata una tabella AWS Glue nel database di destinazione, puoi abilitare la compattazione per velocizzare le query in Amazon Athena. Per informazioni sulla configurazione delle risorse (Ruolo IAM) per la compattazione, consultare Prerequisiti per l'ottimizzazione delle tabelle.

Per ulteriori informazioni sull'impostazione della compattazione sulla AWS Glue tabella creata dall'integrazione, consulta Ottimizzazione delle tabelle Iceberg.

Fornire una policy RBAC (Resource Based Access) per il catalogo

Per le integrazioni che utilizzano un AWS Glue database, aggiungi le seguenti autorizzazioni alla politica RBAC del catalogo per consentire le integrazioni tra origine e destinazione.

Nota

Per le integrazioni tra account, sia l'utente che crea la politica del ruolo di integrazione che la politica delle risorse del catalogo devono consentire l'accesso alla risorsa. glue:CreateInboundIntegration Per lo stesso account è sufficiente una policy in materia di risorse o una policy di ruolo che consenta a glue:CreateInboundIntegration l'utilizzo della risorsa. Entrambi gli scenari devono comunque consentire a glue.amazonaws.com per glue:AuthorizeInboundIntegration.

È possibile accedere alle Impostazioni del catalogo in Data Catalog. Fornire quindi le seguenti autorizzazioni e inserire le informazioni mancanti.

{ "Version": "2012-10-17", "Statement": [ { "Principal": { "AWS": [ "arn:aws:iam::123456789012:user/Alice" ] }, "Effect": "Allow", "Action": [ "glue:CreateInboundIntegration" ], "Resource": [ "arn:aws:glue:us-east-1:111122223333:catalog", "arn:aws:glue:us-east-1:111122223333:database/database-name" ], "Condition": { "StringLike": { "aws:SourceArn": "arn:aws:dynamodb:us-east-1:444455556666:table/table-name" } } }, { "Principal": { "Service": [ "glue.amazonaws.com" ] }, "Effect": "Allow", "Action": [ "glue:AuthorizeInboundIntegration" ], "Resource": [ "arn:aws:glue:us-east-1:111122223333:catalog", "arn:aws:glue:us-east-1:111122223333:database/database-name" ], "Condition": { "StringEquals": { "aws:SourceArn": "arn:aws:dynamodb:us-east-1:444455556666:table/table-name" } } } ] }

Creazione di un ruolo IAM di destinazione

Creare un ruolo IAM con le seguenti autorizzazioni e relazioni di fiducia:

{ "Version": "2012-10-17", "Statement": [ { "Action": "s3:ListBucket", "Resource": "arn:aws:s3:::amzn-s3-bucket", "Effect": "Allow" }, { "Action": [ "s3:GetObject", "s3:PutObject", "s3:DeleteObject" ], "Resource": "arn:aws:s3:::amzn-s3-demo-bucket/prefix/*", "Effect": "Allow" }, { "Action": [ "glue:GetDatabase" ], "Resource": [ "arn:aws:glue:us-east-1:111122223333:catalog", "arn:aws:glue:us-east-1:111122223333:database/database-name" ], "Effect": "Allow" }, { "Action": [ "glue:CreateTable", "glue:GetTable", "glue:GetTables", "glue:DeleteTable", "glue:UpdateTable", "glue:GetTableVersion", "glue:GetTableVersions", "glue:GetResourcePolicy" ], "Resource": [ "arn:aws:glue:us-east-1:111122223333:catalog", "arn:aws:glue:us-east-1:111122223333:database/database-name", "arn:aws:glue:us-east-1:111122223333:table/database-name/*" ], "Effect": "Allow" }, { "Action": [ "cloudwatch:PutMetricData" ], "Resource": "*", "Condition": { "StringEquals": { "cloudwatch:namespace": "AWS/Glue/ZeroETL" } }, "Effect": "Allow" }, { "Action": [ "logs:CreateLogGroup", "logs:CreateLogStream", "logs:PutLogEvents" ], "Resource": "*", "Effect": "Allow" } ] }

Aggiungi la seguente politica di fiducia per consentire al AWS Glue servizio di assumere il ruolo:

{ "Version": "2012-10-17", "Statement": [ { "Effect": "Allow", "Principal": { "Service": "glue.amazonaws.com" }, "Action": "sts:AssumeRole" } ] }

Associa il ruolo di destinazione, KMS (opzionale) e Connection (opzionale) alla risorsa di destinazione

Associa il ruolo di destinazione sopra indicato alla risorsa di destinazione, ad esempio il AWS Glue database. Facoltativamente, è possibile configurare KMS per crittografare i dati prima di archiviarli nella tabella iceberg di destinazione e Connection ARN per accedere al bucket S3 per il database di destinazione. AWS Glue Ciò consentirà di accedere AWS Glue ai dati sulla posizione S3 di destinazione utilizzando il ruolo fornito e, facoltativamente, di crittografarli utilizzando la chiave KMS fornita. Se il bucket S3 di destinazione è configurato per essere accessibile utilizzando un determinato VPC, l'ARN di connessione può essere associato per consentire AWS Glue l'esecuzione dell'elaborazione all'interno di quel VPC. Per ulteriori informazioni sulla configurazione di un VPC, consulta Create a VPC. https://docs.aws.amazon.com/vpc/latest/userguide/create-vpc.html

La schermata mostra la configurazione di un target in un'integrazione zero-ETL.

Oppure utilizzando la CLI/API AWS Glue :

aws glue create-integration-resource-property \ --resource-arn arn:aws:glue:us-east-1:123456789012:database/database-name \ --target-processing-properties '{"RoleArn": "arn:aws:iam::123456789012:role/gmi_target_role"}' \ --region us-east-1

(Facoltativo) Configurare le proprietà della tabella di destinazione

Facoltativamente, le proprietà della tabella di destinazione possono essere configurate per le tabelle di destinazione che verranno sincronizzate con la destinazione.

Puoi configurare queste impostazioni nella sezione Impostazioni di output del flusso di lavoro di creazione dell'integrazione nella AWS Glue console:

La schermata mostra la sezione delle impostazioni di output con le opzioni di unnesting dello schema, le opzioni di partizionamento dei dati e la configurazione del nome della tabella di destinazione.

Quando si seleziona Specifica chiavi di partizione personalizzate, è possibile configurare le chiavi di partizione e le relative specifiche di funzione e conversione:

La schermata mostra le impostazioni di output con la configurazione delle chiavi di partizione personalizzate e la tabella di configurazione delle specifiche di partizione.

Se l'origine e la destinazione si trovano nello stesso account, questa configurazione può essere eseguita come parte del flusso di lavoro di creazione dell'integrazione dall'interfaccia utente della AWS Glue console. Ma se la destinazione si trova in un account diverso, è necessario completare questa configurazione prima di creare l'integrazione. Quando si utilizza la CLI o l'API, questa operazione deve essere eseguita prima di richiamare l' Create-Integration API anche quando sia l'origine che la destinazione si trovano nello stesso account. AWS Glue L'interfaccia utente della console incapsula semplicemente questa chiamata API per lo stesso scenario di account.

Se non è configurato, verranno utilizzati i valori predefiniti durante la sincronizzazione della tabella. Questa configurazione può anche essere modificata in qualsiasi momento dopo la creazione dell'integrazione.

Nota

Se questa proprietà viene aggiornata dopo la creazione dell'integrazione, potrebbe attivare una risincronizzazione completa della tabella quando la configurazione aggiornata è in conflitto con la configurazione esistente. Ad esempio, aggiornando la tabella «un-nesting» da '' a 'No-Unnest' o cambiando la Full-Unnest colonna della partizione.

Conflitti tra proprietà della tabella Target

Due elementi identificano un insieme di proprietà della tabella di destinazione: l'ARN della risorsa di destinazione e il nome della tabella di origine. La risorsa di destinazione è il AWS Glue database per un target Amazon S3 generico. Per un target Amazon S3 Tables, è il catalogo Amazon S3 Tables. Ogni combinazione di risorsa di destinazione e tabella di origine può essere associata a una sola integrazione alla volta. Di conseguenza, due integrazioni non possono scrivere la stessa tabella di origine nella stessa risorsa di destinazione. Se crei una seconda integrazione per la stessa combinazione, AWS Glue identifica il conflitto e lo previene. Ciò impedisce a un'integrazione di sovrascrivere i dati di un'altra integrazione.

AWS Glue applica questa regola indipendentemente dal fatto che utilizzi la console, la CLI o l'API. Nella console, la fase delle impostazioni di output rileva i conflitti prima di continuare, quindi puoi risolverli prima di creare l'integrazione. Questo vale per le sorgenti a tabella singola come Amazon DynamoDB e per le fonti a più tabelle come le applicazioni SaaS. Le proprietà di destinazione di una tabella di origine possono essere di proprietà di una sola integrazione, quindi una tabella sorgente già rivendicata da un'altra integrazione non viene replicata dalla tua finché non risolvi il conflitto.

Il modo in cui la console mostra un conflitto dipende dal numero di tabelle di origine:

  • Per le origini con più tabelle, la console mostra lo stato di ciascuna tabella di origine in due colonne: Azione richiesta e Note. Queste colonne mostrano quali tabelle richiedono attenzione.

  • Per le fonti a tabella singola, la console mostra le stesse informazioni in un avviso in linea. Esiste una sola tabella di origine.

La schermata seguente mostra la tabella delle impostazioni di output multitabella (SaaS) con le colonne Azione richiesta e Note.

Tabella delle impostazioni di output (esempio SaaS) con le colonne Action required e Notes; una riga è contrassegnata per un conflitto di destinazione.

La console mostra il messaggio nella colonna Note per le sorgenti con più tabelle o nell'avviso in linea per le origini a tabella singola. Contrassegna una tabella di origine quando si verifica una delle seguenti condizioni:

  • Un'altra integrazione sta già scrivendo la tabella di origine nella risorsa di destinazione selezionata. Scegli una risorsa di destinazione diversa o rimuovi la tabella di origine dall'altra integrazione.

  • Il nome della tabella di output è già registrato nella risorsa di destinazione selezionata per una tabella di origine diversa. Immettete un nome diverso per la tabella di output.

  • Due o più tabelle di origine sono mappate allo stesso nome di tabella di output. Questo vale per le sorgenti SaaS con più tabelle. Assegna a ciascuna tabella di origine il proprio nome di tabella di output.

  • Il nome della tabella di output non è valido. Immettete un nome valido che contenga solo lettere minuscole, numeri e caratteri di sottolineatura e che contenga un massimo di 255 caratteri. Per le destinazioni del catalogo Amazon S3 Tables, il nome non può iniziare con un trattino basso.

  • AWS Glue rileva una modifica simultanea delle impostazioni di output.

Le modifiche simultanee non sono bloccanti

Una modifica simultanea significa che un altro utente ha aggiornato le stesse impostazioni di output mentre stavi lavorando. A differenza delle altre condizioni in questo elenco, una modifica simultanea non ti blocca. Aggiorna per ottenere le impostazioni più recenti o continua con quelle correnti.

Utilizzando la CLI o l'API:

aws glue create-integration-table-properties \ --resource-arn arn:aws:glue:us-east-1:123456789012:database/database-name \ --table-name table-name \ --target-table-config '{ "UnnestSpec":"TOPLEVEL"|"FULL"|"NOUNNEST", "PartitionSpec": [ { "FieldName":"string", "FunctionSpec":"string", "ConversionSpec":"string"} ... ], "TargetTableName":"string" }' \ --region us-east-1

Dopo aver configurato l'architettura Lakehouse di Amazon SageMaker con lo storage a bucket Amazon S3 generico, puoi procedere al Configurazione dell'integrazione con la destinazione completamento della configurazione dell'integrazione.

Configurazione di un bucket target di Amazon S3 Tables

Questa sezione descrive i prerequisiti e i passaggi di configurazione per configurare Amazon S3 Tables come obiettivo per l'integrazione zero-ETL, utilizzando l'architettura Lakehouse di Amazon. SageMaker

Prima di creare un'integrazione Zero-ETL con Tabelle Amazon S3 come destinazione, è necessario completare le seguenti attività di configurazione:

  • Configurazione del bucket di tabelle Amazon S3 (e integrazione dei servizi di analisi)

  • Fornire la policy RBAC del catalogo

  • Creare un ruolo IAM

  • Associa il ruolo di destinazione, il KMS (opzionale) e la connessione (opzionale) alla risorsa di destinazione

  • (Facoltativo) Configurare le proprietà della tabella di destinazione

Configura il bucket di tabelle Amazon S3 (con integrazione dei servizi di analisi)

  1. Creare un bucket Tabelle S3 nel proprio account seguendo le istruzioni in Nozioni di base su Tabelle Amazon S3.

  2. Abilita le integrazioni di Analytics con il tuo S3-Table bucket seguendo queste istruzioni: Integrazione AWS dei servizi con Amazon S3 Tables.

  3. Questo creerà un nuovo catalogo in. S3-Table AWS Lake Formation

Fornire la policy RBAC del catalogo

È necessario aggiungere le seguenti autorizzazioni alla Policy RBAC del catalogo per consentire le integrazioni tra l'origine e la destinazione del catalogo Tabelle Amazon S3.

La politica sulle risorse di Target AWS Glue Catalog deve includere le autorizzazioni AWS Glue di servizio per. AuthorizeInboundIntegration Inoltre, è richiesta CreateInboundIntegration l'autorizzazione sull'entità principale di origine che crea l'integrazione o nella politica AWS Glue delle risorse di destinazione.

Nota

In uno scenario con più account, sia la politica relativa alle risorse del AWS Glue catalogo principale di origine che quella di destinazione devono includere glue:CreateInboundIntegration le autorizzazioni sulla risorsa.

{ "Version": "2012-10-17", "Statement": [ { "Principal": { "AWS": [ "arn:aws:iam::123456789012:user/Alice" ] }, "Effect": "Allow", "Action": [ "glue:CreateInboundIntegration" ], "Resource": [ "arn:aws:glue:us-east-1:111122223333:catalog/s3tablescatalog/*" ], "Condition": { "StringLike": { "aws:SourceArn": "arn:aws:dynamodb:us-east-1:444455556666:table/table-name" } } }, { "Principal": { "Service": [ "glue.amazonaws.com" ] }, "Effect": "Allow", "Action": [ "glue:AuthorizeInboundIntegration" ], "Resource": [ "arn:aws:glue:us-east-1:111122223333:catalog/s3tablescatalog/*" ], "Condition": { "StringEquals": { "aws:SourceArn": "arn:aws:dynamodb:us-east-1:444455556666:table/table-name" } } } ] }
Nota

Sostituisci s3tablescatalog con il nome del catalogo principale delle tue tabelle S3 (se diverso). Il valore predefinito (quando il S3-Table catalogo è ospitato nello stesso account) ès3tablescatalog.

Creare un ruolo IAM

Creare un ruolo IAM con le seguenti autorizzazioni e relazioni di fiducia:

{ "Version": "2012-10-17", "Statement": [ { "Action": [ "s3tables:ListTableBuckets", "s3tables:GetTableBucket", "s3tables:GetTableBucketEncryption", "s3tables:GetNamespace", "s3tables:CreateNamespace", "s3tables:ListNamespaces", "s3tables:CreateTable", "s3tables:DeleteTable", "s3tables:GetTable", "s3tables:GetTableEncryption", "s3tables:ListTables", "s3tables:GetTableMetadataLocation", "s3tables:UpdateTableMetadataLocation", "s3tables:GetTableData", "s3tables:PutTableData" ], "Resource": "arn:aws:s3tables:us-east-1:111122223333:bucket/s3-table-bucket", "Effect": "Allow" }, { "Action": [ "cloudwatch:PutMetricData" ], "Resource": "*", "Condition": { "StringEquals": { "cloudwatch:namespace": "AWS/Glue/ZeroETL" } }, "Effect": "Allow" }, { "Action": [ "logs:CreateLogGroup", "logs:CreateLogStream", "logs:PutLogEvents" ], "Resource": "*", "Effect": "Allow" } ] }

Aggiungi la seguente policy di fiducia nel ruolo IAM di destinazione per consentire al AWS Glue Service di assumerla:

{ "Version": "2012-10-17", "Statement": [ { "Effect": "Allow", "Principal": { "Service": "glue.amazonaws.com" }, "Action": "sts:AssumeRole" } ] }
Nota

Assicurati che non vi sia un'istruzione DENY esplicita per questo ruolo IAM di destinazione nella policy sulle risorse del S3-Tables bucket. Un DENY esplicito sovrascriverebbe qualsiasi autorizzazione ALLOW e impedirebbe il corretto funzionamento dell'integrazione.

Associa il ruolo di destinazione, KMS (opzionale) e Connection (opzionale) alla risorsa di destinazione

Associa il ruolo di destinazione sopra indicato alla risorsa di destinazione. Facoltativamente, è possibile configurare KMS per crittografare i dati prima dell'archiviazione nella tabella iceberg di destinazione e Connection ARN per accedere al bucket S3 di destinazione. Se il bucket S3 di destinazione è configurato per essere accessibile utilizzando un determinato VPC, l'ARN di connessione può essere associato per consentire l'esecuzione dell'elaborazione all'interno di quel VPC. AWS Glue Per ulteriori informazioni sulla configurazione di un VPC, consulta Create a VPC. https://docs.aws.amazon.com/vpc/latest/userguide/create-vpc.html

Utilizzo della AWS Glue CLI/API:

aws glue create-integration-resource-property \ --resource-arn arn:aws:glue:us-east-1:123456789012:catalog/s3tablescatalog/S3 table bucket name \ --target-processing-properties '{ "RoleArn": "arn:aws:iam::123456789012:role/target_role" }' \ --region us-east-1

(Facoltativo) Configurare le proprietà della tabella di destinazione

Facoltativamente, le proprietà della tabella di destinazione possono essere configurate per le tabelle di destinazione che verranno sincronizzate con la destinazione. Si applicano le stesse regole descritte nella sezione sugli obiettivi S3 per uso generico. Per l'elenco completo delle condizioni di conflitto, vedereConflitti tra proprietà della tabella Target.

Utilizzo della CLI o dell'API:

aws glue create-integration-table-properties \ --resource-arn arn:aws:glue:us-east-1:123456789012:catalog/s3tablescatalog/S3 table bucket name \ --table-name table-name \ --target-table-config '' \ --region us-east-1

Dopo aver configurato lo S3-Tables storage Amazon utilizzando l'architettura Lakehouse di Amazon SageMaker, puoi procedere Configurazione dell'integrazione con la destinazione al completamento della configurazione dell'integrazione.

Configurazione di un Amazon Redshift Obiettivo di archiviazione gestito

Questa sezione descrive i prerequisiti e i passaggi di configurazione per configurare uno storage Amazon Redshift gestito (RMS) come destinazione per l'integrazione zero-ETL, utilizzando l'architettura Lakehouse di Amazon. SageMaker

Prima di creare un'integrazione Zero-ETL con un'architettura Lakehouse di Amazon SageMaker utilizzando lo storage gestito Redshift, devi completare le seguenti attività di configurazione:

  • Configura un cluster o un gruppo di lavoro Serverless Amazon Redshift

  • Registra l' Amazon Redshift integrazione con Lake Formation

  • Creazione di un catalogo gestito in Lake Formation

  • Configurazione delle autorizzazioni IAM

Configurazione Amazon Redshift archiviazione gestita

Per configurare lo storage Amazon Redshift gestito per l'integrazione Zero-ETL:

Dopo aver configurato il catalogo Amazon SageMaker Lakehouse con storage Amazon Redshift gestito, puoi procedere Configurazione dell'integrazione con la destinazione al completamento della configurazione dell'integrazione.

Configurazione di un Amazon Redshift obiettivo del data warehouse

Questa sezione descrive i prerequisiti e le fasi di configurazione per configurare un Amazon Redshift data warehouse come obiettivo per l'integrazione Zero-ETL.

Prima di creare un'integrazione Zero-ETL con una destinazione di Amazon Redshift data warehouse, è necessario completare le seguenti attività di configurazione:

  • Configura un Amazon Redshift cluster o un gruppo di lavoro Serverless

  • Configurazione della distinzione tra maiuscole e minuscole

  • Configurazione delle autorizzazioni IAM

Configurazione di Amazon Redshift data warehouse

Per configurare un Amazon Redshift data warehouse per l'integrazione Zero-ETL:

  1. Andare alla console Amazon Redshift e fare clic su Crea cluster o utilizzare un cluster esistente. Per creare un Amazon Redshift cluster, consulta Creazione di un cluster. Per un gruppo di lavoro Amazon Redshift serverless, fare clic su Crea gruppo di lavoro. Per creare un gruppo di lavoro Amazon Redshift serverless, consulta Creazione di un gruppo di lavoro con uno spazio dei nomi.

  2. Se crei un nuovo cluster, scegli una dimensione del cluster appropriata e assicurarsi che il cluster sia crittografato. Per Serverless, configurare le impostazioni del gruppo di lavoro in base alle proprie esigenze.

  3. Assicurati che il Amazon Redshift gruppo di lavoro o il cluster di destinazione abbia il enable_case_sensitive_identifier parametro attivato affinché l'integrazione abbia successo. Per ulteriori informazioni sull’attivazione della distinzione tra maiuscole e minuscole, consulta Turn on case sensitivity for your data warehouse nella Guida alla gestione di Amazon Redshift.

  4. Configura le autorizzazioni IAM per consentire all'integrazione Zero-ETL di accedere al tuo data warehouse. Amazon Redshift Sarà necessario creare un ruolo IAM con le seguenti autorizzazioni:

    • Autorizzazioni per accedere al cluster o al gruppo di lavoro Amazon Redshift

    • Autorizzazioni per creare e gestire database e tabelle in Amazon Redshift

    • CloudWatch e CloudWatch Registra le autorizzazioni per il monitoraggio

  5. Una volta completata la configurazione Amazon Redshift del gruppo di lavoro o del cluster, è necessario configurare il data warehouse per le integrazioni zero-ETL. Per ulteriori informazioni consultare Nozioni base sulle integrazioni Zero-ETL nella Guida alla gestione di Amazon Redshift.

Nota

Quando si utilizza un Amazon Redshift data warehouse come destinazione, l'integrazione crea uno schema nel database specificato per archiviare i dati replicati. Il nome dello schema deriva dal nome dell'integrazione.

Nota

Il Amazon Redshift gruppo di lavoro o il cluster di destinazione deve avere il enable_case_sensitive_identifier parametro attivato affinché l'integrazione abbia successo.

Dopo aver configurato il Amazon Redshift data warehouse, puoi procedere Configurazione dell'integrazione con la destinazione al completamento della configurazione dell'integrazione.

Configurazione dell'integrazione con la destinazione

Dopo aver configurato le risorse di origine e di destinazione, segui questi passaggi per completare la configurazione dell'integrazione:

  1. Vai alla pagina "Zero-ETL integrazioni» e avvia il flusso di lavoro di creazione dell'integrazione.

  2. Seleziona la risorsa sorgente configurata nei passaggi precedenti.

  3. Seleziona o specifica la risorsa di destinazione (stesso account o account incrociato) configurata nei passaggi precedenti.

  4. Seleziona il ruolo IAM di destinazione configurato in precedenza.

  5. Seleziona l'opzione Fix it for me (disponibile solo quando il target si trova nello stesso account).

    • Per i normali target Amazon S3 (AWS Glue Database) e S3-Table (Catalog), ciò consentirà di:

      • Applica un principio di servizio autorizzato alla policy sulle risorse del catalogo di destinazione.

      • Applica un ARN principale di AWS Glue origine autorizzato alla politica delle risorse del catalogo di destinazione.

    • Per il Amazon Redshift target, ciò consentirà di:

      • Applica un'entità di servizio autorizzata al Amazon Redshift cluster o al gruppo di lavoro Serverless.

      • Applica un ARN AWS Glue di origine autorizzato al Amazon Redshift cluster o al gruppo di lavoro Serverless.

      • Associare un nuovo set di parametri con enable_case_sensitive_identifier = true.

Usa quanto segue per creare l'integrazione tramite API o CLI: API. CreateIntegration