View a markdown version of this page

Connecter une source de données Confluence Data Center - Amazon Bedrock

Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.

Connecter une source de données Confluence Data Center

Après avoir configuré la connectivité VPC et enregistré vos informations d'identification de manière AWS Secrets Manager secrète, créez la source de données Confluence Data Center dans votre base de connaissances. Cette page explique comment créer la source de données à l'aide de l'API Console de gestion AWS ou, suivie d'une référence pour les paramètres de connecteur que vous pouvez configurer.

Note

Terminez d'abord la configuration du VPC et la configuration de l'authentification. Consultez Configurer la connectivité VPC pour une source de données et Configurer l'authentification de base ou PAT pour Confluence Data Center. Vous avez besoin de l'ID de configuration du VPC et de l'ARN secret.

Création de la source de données

Console
Pour connecter Confluence Data Center à votre base de connaissances gérée
  1. Sous Source de données, donnez un nom à votre source de données.

  2. Sélectionnez Confluence Data Center dans la liste déroulante des sources de données.

  3. Dans Configuration VPC, sélectionnez une configuration VPC qui atteint votre instance Confluence Data Center, ou choisissez Ajouter une configuration VPC pour en créer une. Pour en savoir plus, consultez Configurer la connectivité VPC pour une source de données.

  4. (Facultatif) Dans Chemin du contexte de l'application, entrez le chemin du contenu sous lequel l'API REST du Confluence Data Center est diffusée (par exemple,/wiki). Laissez-le vide si l'API REST est diffusée à la racine du site Web.

  5. (Facultatif, HTTPS uniquement) Sous Certificat TLS, indiquez l'URI Amazon S3 du certificat TLS pour votre instance de centre de données Confluence.

  6. Sous Authentification, sélectionnez Authentification de base ou Jeton d'accès personnel, puis sélectionnez le AWS Secrets Manager secret contenant les informations d'identification correspondantes.

  7. (Facultatif) Élargissez le champ de synchronisation pour choisir les types d'entités à analyser (pages, pièces jointes de pages, blogs, pièces jointes de blog, espaces personnels).

  8. (Facultatif) Développez les URL des entités pour utiliser le URL-based filtrage afin de synchroniser des espaces, des pages et des blogs Confluence spécifiques.

  9. (Facultatif) Développez les types MIME pour inclure ou exclure des types MIME spécifiques.

API

Pour créer une source de données Confluence Data Center, envoyez une CreateDataSource demande avec un point de terminaison Agents for Amazon Bedrock build-time. L' AWS Command Line Interface exemple suivant crée une source de données qui utilise l'authentification de base. Pour utiliser un jeton d'accès personnel à la place, passez authType àPERSONAL_TOKEN. Pour une description de chaque champ, reportez-vous à la référence des paramètres du connecteur qui suit.

aws bedrock-agent create-data-source \ --name "Confluence-DataCenter-connector" \ --knowledge-base-id "your-knowledge-base-id" \ --data-source-configuration file://confluence-onprem-connector.json

Le confluence-onprem-connector.json fichier contient les éléments suivants :

{ "type": "MANAGED_KNOWLEDGE_BASE_CONNECTOR", "managedKnowledgeBaseConnectorConfiguration": { "connectorParameters": { "type": "CONFLUENCEONPREM", "version": "1", "aclEnabled": false, "connectionConfiguration": { "authType": "BASIC", "secretArn": "arn:aws:secretsmanager:us-west-2:123456789012:secret:bedrock-confluence-onprem-creds", "contextPath": "/wiki", "vpcConfiguration": { "vpcConfigurationId": "your-vpc-configuration-id" }, "certificateS3Path": { "s3BucketName": "my-cert-bucket", "s3KeyName": "confluence-dc-cert.pem" } }, "dataEntityConfiguration": { "crawlPage": true, "crawlBlog": true, "crawlPageAttachment": true, "crawlBlogAttachment": true }, "filterConfiguration": { "inclusionSpaceUrls": ["https://confluence.example.com/spaces/ENG/"] } } } }

Pour les bases de connaissances gérées, CreateDataSource est asynchrone : l'état de la source de données passe du statut de la source de données CREATING à la AVAILABLE fin de l'opération.

Paramètres du connecteur

La configuration de la source de données utilise les paramètres de connecteur suivants. Pour vous connecter à Confluence Data Center, indiquez CONFLUENCEONPREM le type de connecteur. connectorParameters Pour les champs encapsulés connectorParameters (tels que deletionProtectionConfiguration etmediaExtractionConfiguration), consultezConnexion d’une sources de données.

connectionConfiguration
Champ Obligatoire Description
authType Oui Type d’authentification. Réglez sur BASIC ouPERSONAL_TOKEN. Consultez Méthodes d’authentification.
secretArn Oui L'ARN du AWS Secrets Manager secret contenant vos informations d'identification Confluence Data Center.
vpcConfiguration Oui Le chemin du réseau privé vers votre instance de centre de données Confluence. Contient un vpcConfigurationId champ défini sur l'ID d'une configuration VPC dans votre base de connaissances. Consultez Configurer la connectivité VPC pour une source de données.
contextPath Non Le chemin du contexte de l'application sous lequel l'API REST du centre de données Confluence est diffusée (par exemple,/wiki). Omettez-le si l'API REST est diffusée à la racine du site Web.
certificateS3Path Non Emplacement du certificat TLS de votre instance de centre de données Confluence, utilisé lorsque vous vous connectez via HTTPS. Contient s3BucketName ets3KeyName.
données EntityConfiguration (facultatif)
Champ Obligatoire Description
crawlPage Non S'il faut explorer les pages.
crawlBlog Non S'il faut explorer les articles de blog.
crawlPageAttachment Non S'il faut explorer les pièces jointes des pages. J'ai rampé uniquement quand crawlPage c'est aussi true le cas.
crawlBlogAttachment Non S'il faut explorer les pièces jointes des articles de blog. J'ai rampé uniquement quand crawlBlog c'est aussi true le cas.
crawlPersonalSpace Non Que ce soit pour parcourir les espaces personnels.
Note

Contrairement à Confluence Cloud, Confluence Data Center ne prend pas en charge l'exploration des espaces archivés ou des pages archivées.

Configuration du filtre (facultatif)
Champ Obligatoire Description
inclusionSpaceUrls Non Espacez les URL à inclure.
inclusionPageUrls Non URL des pages à inclure.
inclusionMimeTypes Non Types MIME à inclure.
exclusionMimeTypes Non Types MIME à exclure.
maxFileSizeInMegaBytes Non Taille maximale, en mégaoctets, de tout fichier ingéré par le connecteur. Fournissez-la sous forme de chaîne numérique (par exemple,"50").

Modifier la méthode d'authentification

Vous pouvez modifier la méthode d'authentification d'une source de données (par exemple, de Basic à un jeton d'accès personnel) en mettant à jour la source de données avec la nouvelle méthode authType et un secret contenant les informations d'identification correspondantes, à l'aide de l'UpdateDataSourceopération ou du Console de gestion AWS.

Étapes suivantes

Après avoir créé la source de données, synchronisez-la pour intégrer le contenu dans votre base de connaissances. Pour en savoir plus, consultez Synchronisation d’une source de données.