

Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.

# Seuils d'agrégation minimaux
<a name="custom-min-agg-thresholds"></a>

L'agrégation des données est une technique renforçant la confidentialité qui permet de renforcer l'anonymisation en empêchant les requêtes de renvoyer des résultats concernant des individus ou de petits groupes. Lorsque des seuils d'agrégation minimaux sont configurés sur vos tables, AWS Clean Rooms supprime les résultats qui n'atteignent pas le seuil minimum spécifié par le fournisseur de données.

**Topics**
+ [Seuils d'agrégation](#custom-min-agg-aggregation-thresholds)
+ [Remplacer le seuil d'agrégation minimum pour des colonnes de sortie spécifiques](#custom-min-agg-output-override)
+ [Autoriser les expressions imbriquées dans les fonctions d'agrégation](#custom-min-agg-nested-expressions)
+ [Configuration des seuils d'agrégation minimaux dans la console](#custom-min-agg-console)
+ [Considérations et restrictions](#custom-min-agg-considerations)

## Seuils d'agrégation
<a name="custom-min-agg-aggregation-thresholds"></a>

Vous pouvez configurer des seuils d'agrégation minimaux dans une règle d'analyse personnalisée pour votre table configurée. Les fournisseurs de données spécifient le `identityColumns` et le`minimumIdentityCount`, N. Les valeurs prises en charge `minimumIdentityCount` sont comprises entre 2 et 100 000. La `identityColumns` valeur doit être un `string``varchar`, ou un `char` type. Les seuils d'agrégation minimaux garantissent qu'au moins N sujets de données distincts contribuent à chaque ligne du résultat d'une requête SQL. Pour plus d'informations sur la manière dont les filtres de requête `identityColumns` interagissent, consultez[Contrôles de comparaison](custom-comparison-controls.md).

L'exemple suivant définit le seuil d'agrégation minimum à 100 avec `user_id` comme `identityColumns` valeur :

```
{
  "aggregationThresholds": [
    {
      "identityColumns": [
        "user_id"
      ],
      "minimumIdentityCount": 100,
      "type": "COUNT_DISTINCT"
    }
  ]
}
```

## Remplacer le seuil d'agrégation minimum pour des colonnes de sortie spécifiques
<a name="custom-min-agg-output-override"></a>

Les colonnes de sortie ont des niveaux de sensibilité différents et les fournisseurs de données peuvent appliquer `minimumIdentityCount` des valeurs différentes en fonction de la colonne de sortie. Par exemple, il `campaign_id` peut s'agir d'une colonne à faible sensibilité avec un seuil minimum de 5 sujets de données distincts, tandis que `postal_code` et `income_bracket` obtenir un seuil minimum de 100 car il s'agit de colonnes à haute sensibilité.

Un remplacement par colonne est accepté`0`, ce qui exempte cette colonne de sortie de l'agrégation minimale ou d'une valeur comprise entre 2 et 100 000.

L'exemple suivant définit une dérogation au seuil d'agrégation minimum pour la `campaign_id` colonne :

```
{
  "outputColumnThresholds": [
    {
      "outputColumnName": "campaign_id",
      "minimumIdentityCount": 5
    }
  ]
}
```

## Autoriser les expressions imbriquées dans les fonctions d'agrégation
<a name="custom-min-agg-nested-expressions"></a>

L'autorisation d'expressions dans les fonctions d'agrégation augmente le risque que les personnes concernées puissent être réidentifiées dans les requêtes en salle blanche. Le paramètre par défaut pour `allowedAggregateExpressionType` est`COLUMNS_ONLY`, qui est recommandé comme configuration de confidentialité améliorée. Avec ce paramètre, seules les colonnes sont acceptées dans une fonction d'agrégation, telle que :
+ SUM(coût)
+ COUNT(DISTINCTidentifiant\_campagne)

Sinon, pour les collaborations où l'exécuteur de requêtes est un partenaire de confiance, vous pouvez `ANY_EXPRESSION` l'autoriser dans une fonction d'agrégation. Ce paramètre augmente la flexibilité des requêtes SQL qui peuvent être exécutées sur vos données, mais présente un risque de confidentialité car les exécuteurs de requêtes peuvent isoler de petits groupes au sein d'une fonction d'agrégation.

**Examen de la confidentialité et de la conformité requis**  
Avant d'autoriser les fonctions d'agrégation `ANY_EXPRESSION` internes, consultez vos équipes chargées de la confidentialité, de la sécurité, des affaires juridiques et de la conformité pour vous assurer que cela est conforme aux exigences de votre organisation.

Voici un exemple d'expression dans une fonction d'agrégation qui est généralement considérée comme sûre :
+ SUM(coût \* quantité)

Voici un exemple d'expression d'une fonction d'agrégation considérée comme présentant un risque pour la confidentialité :
+ SUM(CASEWHENzip\_code = « 10001 » THEN salaire 0) ELSE END

Voici un `aggregationThresholds` exemple complet :

```
{
  "aggregationThresholds": [
    {
      "identityColumns": [
        "user_id"
      ],
      "minimumIdentityCount": 100,
      "type": "COUNT_DISTINCT",
      "allowedAggregateExpressionType": "COLUMNS_ONLY",
      "outputColumnThresholds": [
        {
          "outputColumnName": "campaign_id",
          "minimumIdentityCount": 5
        }
      ]
    }
  ]
}
```

## Configuration des seuils d'agrégation minimaux dans la console
<a name="custom-min-agg-console"></a>

Vous configurez des seuils d'agrégation minimaux dans le cadre de l'ajout d'une règle d'analyse personnalisée à une table configurée, une fois que celle-ci existe. Pour le flux guidé par les règles d'analyse personnalisées complet, consultez[Ajouter une règle d'analyse personnalisée à un tableau (flux guidé)](add-analysis-rule.md#add-custom-analysis-rule-wizard).

**Pour configurer des seuils d'agrégation minimaux**

1. Connectez-vous à Console de gestion AWS et ouvrez la AWS Clean Rooms console à l'adresse [ https://console.aws.amazon.com/cleanrooms](https://console.aws.amazon.com/cleanrooms/home).

1. Dans le volet de navigation de gauche, choisissez ** Tables**, puis choisissez la table que vous avez configurée.

1. Sur la page détaillée de la table configurée, choisissez ** Configurer la règle d'analyse**.

1. Pour Type de règle d'**analyse**, choisissez ** Personnalisé**.

1. Choisissez ** Revoir chaque nouvelle analyse ** ou ** Autoriser toute analyse par des collaborateurs spécifiques**. Les étapes restantes suivent le ** chemin ** Autoriser toute analyse par des collaborateurs spécifiques.

1. Choisissez ** Ajouter un compte AWS ** pour configurer les partenaires qui peuvent soumettre des analyses sur cette table configurée, puis choisissez celui Compte AWS à autoriser.

1. Sur ** Spécifier les contrôles des résultats d'analyse : facultatif**, pour ** Appliquer les seuils d'agrégation ? **, choisissez ** Oui**.

1. Configurez le seuil d'agrégation minimum.

   1. Choisissez votre colonne d'identité. La colonne d'identité doit être de `char` type A `string``varchar`, ou.

   1. Spécifiez votre nombre d'identité minimum. Les valeurs prises en charge sont comprises entre 2 et 100 000.

   1. ****Le type d'agrégat est préconfiguré pour ** Count distinct**.

1. Pour ** Autoriser les expressions imbriquées dans les fonctions d'agrégation ? **, la valeur par défaut est ** Non**. Si cette option est désactivée, la configuration de confidentialité améliorée est activée. Pour de plus amples informations, veuillez consulter [Autoriser les expressions imbriquées dans les fonctions d'agrégation](#custom-min-agg-nested-expressions).

1. (Facultatif) Configurez les remplacements de colonne de sortie.

   1. Choisissez ** Ajouter un remplacement ** de colonne.

   1. Choisissez votre colonne de sortie dans la liste déroulante.

   1. Spécifiez votre nombre d'identité minimum. Les valeurs prises en charge visent `0` à exempter la colonne de l'agrégation minimale, soit entre 2 et 100 000.

   Pour de plus amples informations, veuillez consulter [Remplacer le seuil d'agrégation minimum pour des colonnes de sortie spécifiques](#custom-min-agg-output-override).

1. (Recommandé) Configurez les colonnes autorisées pour la comparaison.

   1. Par défaut, toutes les colonnes peuvent être comparées. La configuration explicite des colonnes autorisées pour la comparaison littérale et colonne à colonne constitue une configuration de confidentialité améliorée.

   1. Choisissez Liste ** personnalisée**.

   1. Choisissez les colonnes autorisées pour la comparaison littérale. Par exemple, autoriser la `state` colonne permet au lanceur de requêtes d'exécuter une requête avec un filtre littéral, tel que`WHERE state = 'New York'`.

   1. Choisissez les colonnes qui peuvent être utilisées pour la comparaison colonne à colonne. Par exemple, autoriser la `state` colonne permet au lanceur de requêtes d'exécuter une jointure entre tables avec une comparaison de colonnes, telle que`JOIN my_table t ON t.state = partner_table.state`.

   Pour de plus amples informations, veuillez consulter [Contrôles de comparaison](custom-comparison-controls.md).

1. Choisissez **Suivant**.

1. Choisissez **Suivant**. La confidentialité différentielle est désactivée et n'est pas prise en charge avec des seuils d'agrégation minimaux ou des contrôles de comparaison. Pour de plus amples informations, veuillez consulter [Limitations](custom-considerations.md#custom-limitations).

1. Passez en revue la configuration de vos règles d'analyse personnalisées.

1. Choisissez ** Configurer la règle d'analyse**.

1. Associez le tableau configuré à une collaboration. Pour de plus amples informations, veuillez consulter [Étape 2 : associer une table configurée](associate-configured-table.md#associate-config-table).

## Considérations et restrictions
<a name="custom-min-agg-considerations"></a>

Des considérations et des limites s'appliquent lorsque vous utilisez des seuils d'agrégation minimaux. Pour obtenir la liste complète, consultez [Considérations et restrictions](custom-considerations.md).