Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.
Connexion d’une sources de données
Après avoir terminé les configurations de votre base de connaissances, vous connectez une source de données prise en charge à la base de connaissances.
Les bases de connaissances gérées par Amazon Bedrock permettent de se connecter à des sources de données non structurées. Sélectionnez une rubrique pour découvrir comment vous connecter à ce type de source de données :
Note
Pour les bases de connaissances gérées, l'CreateDataSourceopération est asynchrone. L'état de la source de données passe du statut CREATING AVAILABLE à la fin de l'opération.
Pour découvrir comment vous connecter à une source de données à l’aide de la console Amazon Bedrock, sélectionnez la rubrique correspondant à votre type de source de données au bas de cette page :
Pour vous connecter à une source de données à l'aide de l'API Amazon Bedrock, envoyez une CreateDataSource demande avec un point de terminaison d'exécution Agents for Amazon Bedrock.
Champs obligatoires :
| Champ | Description |
|---|---|
knowledgeBaseId |
ID de la base de connaissances. |
name |
Nom de la source de données. |
dataSourceConfiguration |
Spécifiez le type de source de données dans le type champ et incluez la configuration correspondante. Pour plus de détails sur les configurations spécifiques aux connecteurs, sélectionnez la rubrique relative au connecteur dans les rubriques situées au bas de cette page. |
Dans dataSourceConfiguration ce champ, vous devez spécifier les éléments suivants :
-
type: doit êtreMANAGED_KNOWLEDGE_BASE_CONNECTOR. -
managedKnowledgeBaseConnectorConfiguration— Configuration du connecteur. Contient les champs suivants :-
connectorParameters(obligatoire) — Contient untypechamp qui spécifie le type de connecteur et unversionchamp obligatoire défini sur1. Les valeurs de type prises en charge sontS3ONEDRIVECONFLUENCESHAREPOINT,,WEB_CRAWLER, etGOOGLE_DRIVE. Les autres champsconnectorParametersvarient selon le type de connecteur. Reportez-vous à la page de chaque connecteur de données pour plus de détails. -
deletionProtectionConfiguration(facultatif) — Protection contre la suppression massive accidentelle du contenu indexé. ContientdeletionProtectionStatus(ENABLEDouDISABLED) et, lorsque cette option est activée, une valeur facultativedeletionProtectionThreshold(0 à 100, par défaut 15). Le seuil est le pourcentage maximum de documents qu'une tâche de synchronisation peut supprimer de votre index. Si une synchronisation supprime plus que ce pourcentage, elle saute sa phase de suppression, laissant vos documents indexés en place. Non pris en charge pour le connecteur personnalisé. -
mediaExtractionConfiguration(facultatif) — Configuration pour l'extraction de contenu multimédia (images, audio, vidéo) à partir de fichiers sources de données. Contient trois sous-configurations que vous pouvez activer indépendamment :-
imageExtractionConfiguration(facultatif) — Traite, extrait et indexe le contenu de fichiers image autonomes (.png, .jpg, .jpeg, .jpe, .tif, .tiff, .gif, .bmp, .webp, .svg, .jp2, .heic) et de visuels intégrés dans des fichiers .pdf, .docx, .ppt, .pptx. -
audioExtractionConfiguration(facultatif) — Traite, extrait et indexe le contenu des fichiers audio pris en charge (.mp3, .wav, .m4a, .flac, .ogg). -
videoExtractionConfiguration(facultatif) — Traite, extrait et indexe le contenu des fichiers vidéo pris en charge (.mp4, .mov, .m4v).
Pour la référence complète des champs, consultez la référence MediaExtractionConfiguration de l'API Amazon Bedrock.
-
-
syncSchedule(facultatif) — Définit un calendrier récurrent selon lequel Amazon Bedrock synchronise automatiquement la source de données. Spécifiez exactement l'une des options suivantes :-
daily— Un objet vide. Synchronise une fois par jour à une heure creuse choisie par le système. -
weekly— Contient undayOfWeekchamp obligatoire, dont la valeur est comprise entreSUNDAYetSATURDAY. -
monthly— Contient undayOfMonthchamp obligatoire, qui contient soit un objet comprisdayNumberentre 1 et 28, soit unlastDayOfMonthobjet vide.
Ne procédez pas
syncScheduleà la synchronisation à la demande uniquement. Pour plus d'informations, voir Définir un calendrier de synchronisation pour une source de données. -
-
Champs facultatifs :
| Champ | Description |
|---|---|
description |
Fournissez une description de la source de données. |
vectorIngestionConfiguration |
Contient des configurations pour personnaliser le processus d’ingestion. Pour de plus amples informations, veuillez consulter Personnalisation de l’ingestion pour une source de données. |
clientToken |
Pour garantir que la demande d’API n’est exécutée qu’une seule fois. Pour plus d’informations, consultez Garantie de l’idempotence. |
L'exemple suivant montre une CreateDataSource demande avec un connecteur S3 :
{ "knowledgeBaseId": "your-knowledge-base-id", "name": "my-s3-data-source", "description": "S3 data source for my managed knowledge base", "dataSourceConfiguration": { "type": "MANAGED_KNOWLEDGE_BASE_CONNECTOR", "managedKnowledgeBaseConnectorConfiguration": { "mediaExtractionConfiguration": { "imageExtractionConfiguration": { "imageExtractionStatus": "ENABLED" } }, "deletionProtectionConfiguration": { "deletionProtectionStatus": "ENABLED", "deletionProtectionThreshold": 15 }, "syncSchedule": { "weekly": { "dayOfWeek": "MONDAY" } }, "connectorParameters": { "type": "S3", "version": "1", "connectionConfiguration": { "bucketName": "my-bucket-name", "bucketOwnerAccountId": "123456789012" }, "filterConfiguration": { "maxFileSizeInMegaBytes": "50" } } } } }
Pour en savoir plus sur un connecteur spécifique et sa configuration, sélectionnez un sujet ci-dessous.
Pour les sources de données tierces qui prennent en charge la configuration gérée par l'utilisateur (3LO), telles que SharePointOneDrive, etConfluence, vous avez besoin d' Gestion des identités et des accès AWS autorisations spécifiques pour vous connecter. Pour de plus amples informations, veuillez consulter Autorisations IAM pour une configuration gérée par l'utilisateur (3LO).