

Las traducciones son generadas a través de traducción automática. En caso de conflicto entre la traducción y la version original de inglés, prevalecerá la version en inglés.

# Umbrales mínimos de agregación
<a name="custom-min-agg-thresholds"></a>

La agregación de datos es una técnica que mejora la privacidad y ayuda a reforzar la anonimización al impedir que las consultas arrojen resultados sobre personas o grupos pequeños. Cuando se configuran umbrales mínimos de agregación en las tablas, se AWS Clean Rooms suprimen los resultados que no cumplen con el umbral mínimo especificado por el proveedor de datos.

**Topics**
+ [Umbrales de agregación](#custom-min-agg-aggregation-thresholds)
+ [Anular el umbral mínimo de agregación para columnas de salida específicas](#custom-min-agg-output-override)
+ [Permitir expresiones anidadas en funciones agregadas](#custom-min-agg-nested-expressions)
+ [Configurar los umbrales mínimos de agregación en la consola](#custom-min-agg-console)
+ [Consideraciones y limitaciones](#custom-min-agg-considerations)

## Umbrales de agregación
<a name="custom-min-agg-aggregation-thresholds"></a>

Puede configurar los umbrales mínimos de agregación en una regla de análisis personalizada para la tabla configurada. Los proveedores de datos especifican el `identityColumns` y el `minimumIdentityCount` N. Los valores admitidos `minimumIdentityCount` oscilan entre 2 y 100 000. El `identityColumns` valor debe ser un `char` tipo `string``varchar`,, o. Los umbrales mínimos de agregación garantizan que cada fila del resultado de una consulta SQL contenga al menos N sujetos de datos distintos que contribuyen a ella. Para obtener información sobre cómo `identityColumns` interactúa con los filtros de consulta, consulte. [Controles de comparación](custom-comparison-controls.md)

En el siguiente ejemplo, se establece el umbral mínimo de agregación en 100 con `user_id` como `identityColumns` valor:

```
{
  "aggregationThresholds": [
    {
      "identityColumns": [
        "user_id"
      ],
      "minimumIdentityCount": 100,
      "type": "COUNT_DISTINCT"
    }
  ]
}
```

## Anular el umbral mínimo de agregación para columnas de salida específicas
<a name="custom-min-agg-output-override"></a>

Las columnas de salida tienen diferentes niveles de sensibilidad y los proveedores de datos pueden aplicar `minimumIdentityCount` valores diferentes en función de la columna de salida. Por ejemplo, `campaign_id` puede ser una columna de baja sensibilidad con un umbral mínimo de 5 sujetos de datos distintos, `postal_code` y `income_bracket` obtener un umbral mínimo de 100 porque son columnas de alta sensibilidad.

Se acepta una anulación por columna`0`, lo que exime a esa columna de salida de la agregación mínima, o de un valor entre 2 y 100 000.

En el siguiente ejemplo, se establece una anulación del umbral de agregación mínimo para la columna: `campaign_id`

```
{
  "outputColumnThresholds": [
    {
      "outputColumnName": "campaign_id",
      "minimumIdentityCount": 5
    }
  ]
}
```

## Permitir expresiones anidadas en funciones agregadas
<a name="custom-min-agg-nested-expressions"></a>

Permitir las expresiones dentro de las funciones de agregación aumenta el riesgo de que los interesados puedan volver a identificarse en las consultas de sala limpia. La configuración predeterminada `allowedAggregateExpressionType` es`COLUMNS_ONLY`, que se recomienda como configuración de privacidad mejorada. Con esta configuración, solo se aceptan columnas dentro de una función de agregación, como:
+ SUM(costo)
+ COUNT(DISTINCTcampaign\_id)

Como alternativa, en el caso de las colaboraciones en las que el ejecutor de la consulta sea un socio de confianza, puedes incluir una función de `ANY_EXPRESSION` agregación. Esta configuración aumenta la flexibilidad de las consultas SQL que se pueden ejecutar en los datos, pero supone un riesgo para la privacidad, ya que los ejecutores de consultas pueden aislar grupos pequeños dentro de una función de agregación.

**Se requiere una revisión de la privacidad y el cumplimiento**  
Antes de permitir `ANY_EXPRESSION` la entrada a funciones agregadas, consulta a tus equipos de privacidad, seguridad, asuntos legales y cumplimiento para asegurarte de que cumplen los requisitos de tu organización.

El siguiente es un ejemplo de una expresión de una función de agregación que, por lo general, se considera segura:
+ SUM(costo \* cantidad)

El siguiente es un ejemplo de una expresión de una función de agregación que se considera un riesgo para la privacidad:
+ SUM(CASEWHENzip\_code = '10001' THEN salario 0) ELSE END

El siguiente es un ejemplo completo: `aggregationThresholds`

```
{
  "aggregationThresholds": [
    {
      "identityColumns": [
        "user_id"
      ],
      "minimumIdentityCount": 100,
      "type": "COUNT_DISTINCT",
      "allowedAggregateExpressionType": "COLUMNS_ONLY",
      "outputColumnThresholds": [
        {
          "outputColumnName": "campaign_id",
          "minimumIdentityCount": 5
        }
      ]
    }
  ]
}
```

## Configurar los umbrales mínimos de agregación en la consola
<a name="custom-min-agg-console"></a>

Los umbrales mínimos de agregación se configuran como parte de la adición de una regla de análisis personalizada a una tabla configurada, una vez que la tabla configurada exista. Para ver el flujo guiado completo de las reglas de análisis personalizadas, consulte[Agregación de una regla de análisis personalizada a una tabla (flujo guiado)](add-analysis-rule.md#add-custom-analysis-rule-wizard).

**Para configurar los umbrales mínimos de agregación**

1. Inicie sesión en Consola de administración de AWS y abra la AWS Clean Rooms consola en [ https://console.aws.amazon.com/cleanrooms](https://console.aws.amazon.com/cleanrooms/home).

1. En el panel de navegación izquierdo, seleccione ** Tablas y**, a continuación, elija la tabla configurada.

1. En la página de detalles de la tabla configurada, seleccione **Configurar regla de análisis**.

1. Para el tipo de regla de ** análisis**, elija ** Personalizado**.

1. Elija ** Revisar cada nuevo análisis ** o ** Permitir cualquier análisis realizado por colaboradores específicos**. Los pasos restantes siguen la ** ruta ** Permitir cualquier análisis por parte de colaboradores específicos.

1. Elija ** Agregar cuenta de AWS ** para configurar qué socios pueden enviar análisis en esta tabla configurada y, a continuación, elija la que Cuenta de AWS desea permitir.

1. En ** Especificar los controles de los resultados del análisis, ¿es opcional**, para ** hacer cumplir los umbrales de agregación? **, seleccione ** Sí**.

1. Configure el umbral mínimo de agregación.

   1. Elige tu columna de identidad. La columna de identidad debe ser del `char` tipo `string``varchar`, o.

   1. Especifique su recuento mínimo de identidades. Los valores admitidos oscilan entre 2 y 100 000.

   1. ****El tipo de agregado está preconfigurado para ** contar de forma distinta**.

1. ¿Para ** permitir expresiones anidadas en funciones agregadas? **, el valor predeterminado es ** No**. La configuración de privacidad mejorada deja esta opción desactivada. Para obtener más información, consulte [Permitir expresiones anidadas en funciones agregadas](#custom-min-agg-nested-expressions).

1. (Opcional) Configure las anulaciones de las columnas de salida.

   1. Seleccione ** Agregar anulación ** de columna.

   1. Elige tu columna de salida en la lista desplegable.

   1. Especifica tu recuento mínimo de identidades. Los valores admitidos son eximir `0` a la columna de la agregación mínima, o entre 2 y 100 000.

   Para obtener más información, consulte [Anular el umbral mínimo de agregación para columnas de salida específicas](#custom-min-agg-output-override).

1. (Recomendado) Configure las columnas permitidas para la comparación.

   1. De forma predeterminada, todas las columnas son aptas para la comparación. La configuración de privacidad mejorada consiste en configurar explícitamente qué columnas están permitidas para la comparación literal y de columna a columna.

   1. Seleccione Lista personalizada. ** **

   1. Elija qué columnas están permitidas para la comparación literal. Por ejemplo, si se permite la `state` columna, el ejecutor de consultas puede ejecutar una consulta con un filtro literal, por ejemplo`WHERE state = 'New York'`.

   1. Elija qué columnas se pueden usar para la comparación entre columnas. Por ejemplo, si se permite la `state` columna, el ejecutor de consultas puede ejecutar una unión entre tablas con una comparación de columnas, por ejemplo. `JOIN my_table t ON t.state = partner_table.state`

   Para obtener más información, consulte [Controles de comparación](custom-comparison-controls.md).

1. Elija **Siguiente**.

1. Elija **Siguiente**. La privacidad diferencial está desactivada y no se admite con umbrales mínimos de agregación o controles de comparación. Para obtener más información, consulte [Limitaciones](custom-considerations.md#custom-limitations).

1. Revise la configuración de sus reglas de análisis personalizadas.

1. Elija **Configurar regla de análisis**.

1. Asocie la tabla configurada a una colaboración. Para obtener más información, consulte [Paso 2: Asociar una tabla configurada](associate-configured-table.md#associate-config-table).

## Consideraciones y limitaciones
<a name="custom-min-agg-considerations"></a>

Hay consideraciones y limitaciones cuando se utilizan umbrales de agregación mínimos. Puede consultar la lista completa e [Consideraciones y limitaciones](custom-considerations.md).