View a markdown version of this page

Synchronisieren einer Datenquelle - Amazon Bedrock

Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.

Synchronisieren einer Datenquelle

Nachdem Sie Ihre Wissensdatenbank erstellt haben, nehmen Sie Ihre Daten auf oder synchronisieren, damit die Daten abgefragt werden können. Bei der Erfassung werden die Rohdaten in Ihrer Datenquelle in Vektoreinbettungen umgewandelt.

Bevor Sie mit der Aufnahme beginnen, überprüfen Sie, ob Ihre Datenquelle die folgenden Bedingungen erfüllt:

  • Sie haben die Verbindungsinformationen für Ihre Datenquelle konfiguriert. Siehe Eine Datenquelle verbinden. Sie konfigurieren Ihre Datenquelle im Rahmen der Erstellung Ihrer Wissensdatenbank.

  • Sie haben das von Ihnen gewählte Modell für Vektoreinbettungen konfiguriert. Sehen Sie sich die unterstützten Vektor-Einbettungsmodelle an. Sie konfigurieren Ihre Vektoreinbettungen im Rahmen der Erstellung Ihrer Wissensdatenbank.

  • Die Dateien haben unterstützte Formate. Weitere Informationen finden Sie unter Unterstützte Dokumentformate.

  • Die Dateien überschreiten nicht die in der AWS Allgemeinen Referenz unter Dienstkontingente und -kontingente angegebene Dateigröße für den Aufnahmeauftrag.

Jedes Mal, wenn Sie Dateien zu Ihrer Datenquelle hinzufügen, ändern oder daraus entfernen, müssen Sie die Datenquelle synchronisieren, damit sie erneut mit der Wissensdatenbank indexiert wird. Die Synchronisierung erfolgt inkrementell, sodass Amazon Bedrock nur Dokumente verarbeitet, die seit der letzten Synchronisierung hinzugefügt, geändert oder gelöscht wurden.

Wählen Sie die Registerkarte für Ihre bevorzugte Methode aus, um zu erfahren, wie Sie Ihre Daten in Ihre Wissensdatenbank aufnehmen und mit Ihren neuesten Daten synchronisieren, und führen Sie dann die folgenden Schritte aus:

Console
So nehmen Sie Ihre Daten in Ihre Wissensdatenbank auf und synchronisieren sie mit Ihren neuesten Daten
  1. Melden Sie sich bei der an AWS-Managementkonsole und navigieren Sie zu Amazon Bedrock AgentCore > Built-in Tools > Knowledge Base.

  2. Wählen Sie Ihre Wissensdatenbank aus.

  3. Wählen Sie im Abschnitt Datenquelle die Option Synchronisieren aus, um mit der Erfassung oder Synchronisierung Ihrer neuesten Daten zu beginnen. Klicken Sie auf Stopp, um eine laufende Datenquellensynchronisierung zu stoppen. Eine Datenquelle muss gerade synchronisiert werden, um die Synchronisierung zu stoppen. Sie können erneut Synchronisieren auswählen, um den Rest Ihrer Daten aufzunehmen.

  4. Wenn die Datenaufnahme abgeschlossen ist, wird ein grünes Banner angezeigt, wenn sie erfolgreich war.

  5. Sie können eine Datenquelle auswählen, um deren Synchronisierungsverlauf anzuzeigen. Wählen Sie Warnungen anzeigen aus, um zu sehen, warum ein Datenerfassungsauftrag fehlgeschlagen ist.

API

Um Ihre Daten in Ihre Wissensdatenbank aufzunehmen und mit Ihren neuesten Daten zu synchronisieren, senden Sie eine StartIngestionJob Anfrage an einen Build-Time-Endpunkt von Agents for Amazon Bedrock. Geben Sie die knowledgeBaseId und die dataSourceId an. Sie können auch einen Datenerfassungsauftrag beenden, der gerade ausgeführt wird, indem Sie eine Anfrage senden. StopIngestionJob Geben Sie die dataSourceId, ingestionJobId und die knowledgeBaseId an. Ein Datenerfassungsauftrag muss derzeit ausgeführt werden, um die Datenaufnahme zu beenden. Sie können erneut eine StartIngestionJob-Anfrage senden, um den Rest Ihrer Daten aufzunehmen, wenn Sie bereit sind.

Verwenden Sie den Wert, der in der Antwort in einer GetIngestionJob Anfrage mit einem Build-Time-Endpunkt von Agents for Amazon Bedrock ingestionJobId zurückgegeben wurde, um den Status des Datenerfassungsauftrags zu verfolgen. Geben Sie zusätzlich die knowledgeBaseId und die dataSourceId an.

  • Bei Abschluss des Aufnahmeauftrags lautet der status in der Antwort COMPLETE.

  • Das statistics-Objekt in der Antwort liefert Informationen darüber, ob die Aufnahme der Dokumente in der Datenquelle erfolgreich war oder nicht.

Sie können sich auch Informationen zu allen Erfassungsaufträgen für eine Datenquelle anzeigen lassen, indem Sie eine ListIngestionJobs Anfrage an einen Build-Time-Endpunkt für Agents for Amazon Bedrock senden. https://docs.aws.amazon.com/general/latest/gr/bedrock.html#bra-bt Geben Sie die dataSourceId und die knowledgeBaseId der Wissensdatenbank an, in die die Daten aufgenommen werden.

  • Filtern Sie nach Ergebnissen, indem Sie einen Status angeben, nach dem im filters-Objekt gesucht werden soll.

  • Sortieren Sie nach dem Zeitpunkt, zu dem der Auftrag gestartet wurde, oder nach dem Status eines Auftrags, indem Sie das sortBy-Objekt angeben. Sie können in aufsteigender () oder absteigender () Reihenfolge sortieren.

  • Im Feld maxResults können Sie die Höchstzahl der Ergebnisse in einer Antwort bestimmen. Wenn es mehr Ergebnisse als die von Ihnen festgelegte Höchstzahl gibt, gibt die Antwort ein nextToken zurück, das Sie in einer weiteren ListIngestionJobs-Anforderung senden können, um den nächsten Auftragsstapel zu sehen.

Legen Sie einen Synchronisierungszeitplan für eine Datenquelle fest

Anstatt jedes Mal, wenn sich Ihre Inhalte ändern, manuell eine Synchronisierung zu starten, können Sie einen Synchronisierungszeitplan festlegen, sodass Amazon Bedrock eine Datenquelle automatisch in einer wiederkehrenden Häufigkeit synchronisiert. Geplante Synchronisierungen helfen dabei, Ihre Wissensdatenbank ohne manuelles Eingreifen auf dem neuesten Stand zu halten. Sie legen den Synchronisierungszeitplan fest, wenn Sie eine Datenquelle verbinden, und Sie können ihn später ändern, indem Sie die Datenquelle bearbeiten.

Sie können eine der folgenden Frequenzen wählen:

On-demand

Inhalte werden nur synchronisiert, wenn Sie eine Synchronisierung manuell starten. Es findet keine automatische Planung statt. Dies ist die Standardfrequenz.

Täglich

Der Inhalt wird einmal täglich zu einem automatisch geplanten Zeitpunkt synchronisiert, der variieren kann.

Wöchentlich

Der Inhalt wird einmal wöchentlich an einem von Ihnen angegebenen Wochentag zu einer automatisch geplanten Uhrzeit synchronisiert.

Monatlich

Der Inhalt wird einmal monatlich an einem von Ihnen angegebenen Tag des Monats zu einer automatisch geplanten Uhrzeit synchronisiert. Wählen Sie einen bestimmten Tag zwischen 1 und 28 oder das Ende des Monats.

Um einen Synchronisierungszeitplan für eine Datenquelle festzulegen, wählen Sie die Registerkarte für Ihre bevorzugte Methode und folgen Sie dann den Schritten:

Console

Wenn Sie eine Datenquelle verbinden oder eine vorhandene Datenquelle bearbeiten, suchen Sie den Abschnitt Synchronisierungszeitplan und wählen Sie eine Häufigkeit aus:

  • Wenn Sie Wöchentlich wählen, wählen Sie den Wochentag aus, an dem die Synchronisierung ausgeführt wird.

  • Wenn Sie Monatlich wählen, wählen Sie einen bestimmten Tag des Monats (1—28) oder wählen Sie das Ende des Monats aus.

Weitere Informationen zum Verbinden einer Datenquelle finden Sie unter Verbinden einer Datenquelle.

API

Um einen Synchronisierungszeitplan mit der API, einem AWS SDK oder dem festzulegen AWS CLI, fügen Sie ein syncSchedule Objekt in das managedKnowledgeBaseConnectorConfiguration (innerhalbdataSourceConfiguration) ein, wenn Sie eine CreateDataSource oder eine UpdateDataSource Anfrage an einen Build-Time-Endpunkt von Agents for Amazon Bedrock senden. Um die On-Demand-Synchronisierung zu verwenden, lassen Sie das Feld aus. syncSchedule

Geben Sie syncSchedule unter genau eines der folgenden Frequenzfelder an:

  • daily— Ein leeres Objekt ({}). Der Inhalt wird einmal täglich zu einer vom System gewählten Zeit außerhalb der Spitzenzeiten synchronisiert.

  • weekly— Ein Objekt mit einem Pflichtfeld. dayOfWeek Gültige Werte sind: SUNDAY, MONDAY, TUESDAY, WEDNESDAY, THURSDAY, FRIDAY und SATURDAY.

  • monthly— Ein Objekt mit einem dayOfMonth Pflichtfeld. Geben Sie dayOfMonth unter genau eine der folgenden Optionen an:

    • dayNumber— Ein bestimmter Tag des Monats, von 1 bis28.

    • lastDayOfMonth— Ein leeres Objekt ({}), das die Synchronisierung am letzten Kalendertag eines jeden Monats ausführt.

Das folgende Beispiel zeigt einedataSourceConfiguration, die eine wöchentliche Synchronisierung montags plant:

"dataSourceConfiguration": { "type": "MANAGED_KNOWLEDGE_BASE_CONNECTOR", "managedKnowledgeBaseConnectorConfiguration": { "connectorParameters": { "type": "CONNECTOR_TYPE", "version": "1" }, "syncSchedule": { "weekly": { "dayOfWeek": "MONDAY" } } } }

Um am 15. eines jeden Monats zu synchronisieren, ersetzen Sie den syncSchedule Wert durch den folgenden Wert:

"syncSchedule": { "monthly": { "dayOfMonth": { "dayNumber": 15 } } }

Nachdem Sie einen Zeitplan festgelegt haben, führt Amazon Bedrock die Synchronisierungen automatisch in der von Ihnen ausgewählten Häufigkeit durch. Sie können weiterhin jederzeit eine manuelle Synchronisierung starten. Um geplante und manuelle Synchronisierungsaufträge zu verfolgen, sehen Sie sich den Synchronisierungsverlauf auf der Seite mit den Datenquellendetails an. Weitere Informationen finden Sie unter Datenquelleninformationen für Ihre Amazon Bedrock-Wissensdatenbank So zeigen Sie Informationen zur Datenquelle Ihrer Amazon-Bedrock-Wissensdatenbank an anzeigen.