

# Usar a estrutura do Delta Lake no Glue AWS Glue Studio
<a name="gs-data-lake-formats-delta"></a>

## Usar a estrutura do Delta Lake em fontes de dados
<a name="gs-data-lake-formats-delta-source"></a>

### Usar a estrutura do Delta Lake em fontes de dados do Amazon S3
<a name="gs-data-lake-formats-delta-lake-s3-data-source"></a>

1.  No menu Fonte, selecione Amazon S3. 

1.  Se você escolher a tabela do Data Catalog como o tipo de fonte do Amazon S3, escolha um banco de dados e uma tabela. 

1.  AWS Glue StudioO exibe o formato como Data Lake e o URL do Amazon S3. 

1.  Escolha **Opções adicionais** para inserir um par de chave-valor. Por exemplo, um par de chave-valor pode ser: **chave**: timestampAsOf e **valor**: 2023-02-24 14:16:18.   
![A captura de tela mostra a seção Opções adicionais na guia Propriedades da fonte de dados para um nó de fonte de dados do Amazon S3.](http://docs.aws.amazon.com/pt_br/glue/latest/dg/images/data_lake_formats_additional_options.png)

1.  Se você escolher o local do Amazon S3 como o **tipo de fonte do Amazon S3**, escolha a URL do S3 clicando em **Procurar o Amazon S3**. 

1.  Em **Formato de dados**, escolha Delta Lake. 
**nota**  
 Se o AWS Glue Studio não conseguir inferir o esquema da pasta ou arquivo do Amazon S3 selecionado, escolha **Opções adicionais** para selecionar uma nova pasta ou arquivo.   
 Em **Opções adicionais**, escolha entre as seguintes opções em **Inferência de esquema**:   
 Deixe o AWS Glue Studio escolher automaticamente um arquivo de amostra. O AWS Glue Studio escolherá um arquivo de amostra no local do Amazon S3 para que o esquema possa ser inferido. No campo **Arquivo amostrado automaticamente**, você pode visualizar o arquivo que foi selecionado automaticamente. 
 Escolha um arquivo de amostra do Amazon S3. Escolha o arquivo do Amazon S3 a ser usado clicando em **Procurar no Amazon S3**. 

1.  Clique em **Inferir esquema**. Depois, você poderá visualizar o esquema de saída clicando na guia **Esquema de saída**. 

### Usar a estrutura do Delta Lake em fontes de dados do Data Catalog
<a name="gs-data-lake-formats-delta-catalog"></a>

1.  No menu **Fonte**, escolha AWS Glue Studio Data Catalog. 

1.  Na guia **Propriedades da fonte de dados**, escolha um banco de dados e uma tabela. 

1.  AWS Glue StudioO exibe o tipo de formato como Data Lake e o URL do Amazon S3. 
**nota**  
 Se sua fonte Delta Lake ainda não estiver registrada na tabela do AWS Glue Data Catalog, você tem duas opções:   
 Crie um crawler do AWS Glue para o armazenamento de dados Delta Lake. Para obter mais informações, consulte [Como especificar opções de configuração para um armazenamento de dados do Delta Lake](https://docs.aws.amazon.com/glue/latest/dg/crawler-configuration.html#crawler-delta-lake). 
 Use uma fonte de dados do Amazon S3 para selecionar sua fonte de dados Delta Lake. Consulte [Usar a estrutura do Delta Lake em fontes de dados do Amazon S3](#gs-data-lake-formats-delta-lake-s3-data-source). 

## Usar formatos do Delta Lake em destinos de dados
<a name="gs-data-lake-formats-delta-target"></a>

### Usar formatos do Delta Lake em destinos de dados do Data Catalog
<a name="gs-data-lake-formats-delta-target-catalog"></a>

1.  No menu **Destino**, escolha AWS Glue Studio Data Catalog. 

1.  Na guia **Propriedades da fonte de dados**, escolha um banco de dados e uma tabela. 

1.  AWS Glue StudioO exibe o tipo de formato como Data Lake e o URL do Amazon S3. 

### Usar formatos do Delta Lake em fontes de dados do Amazon S3
<a name="gs-data-lake-formats-delta-target-s3"></a>

 Insira os valores ou selecione-os entre as opções disponíveis para configurar o formato do Delta Lake. 
+  **Tipo de compactação**: escolha uma das opções de tipo de compactação: não compactado ou Snappy. 
+  **Local de destino do Amazon S3**: escolha o local de destino do Amazon S3 clicando em **Procurar no S3**. 
+  **Opções de atualização do Data Catalog**: atualizar o Data Catalog não é compatível com esse formato no editor visual do Glue Studio. 
  +  Do not update the Data Catalog (Não atualizar o Data Log): (padrão) escolha essa opção se você não quiser que o trabalho atualize o Data Catalog, mesmo que o esquema seja alterado ou novas partições sejam adicionadas. 
  +  Para atualizar o catálogo de dados após a execução do trabalho do AWS Glue, execute ou agende um crawler do AWS Glue. Para obter mais informações, consulte [Como especificar opções de configuração para um armazenamento de dados do Delta Lake](https://docs.aws.amazon.com/glue/latest/dg/crawler-configuration.html#crawler-delta-lake). 
+  **Chaves de partição**: escolha quais colunas serão usadas como chaves de particionamento na saída. Para adicionar mais chaves de partição, escolha **Adicionar uma chave de partição**. 
+  Opcionalmente, escolha **Opções adicionais** para inserir um par chave-valor. Por exemplo, um par de chave-valor pode ser: **chave**: timestampAsOf e **valor**: 2023-02-24 14:16:18. 