本文為英文版的機器翻譯版本,如內容有任何歧義或不一致之處,概以英文版為準。
原生多模式處理
透過原生多模態處理,受管 Amazon Bedrock 知識庫會將每個檔案直接傳送至多模態內嵌模型。模型接著會從原始映像、音訊和影片內容建立內嵌。
如果沒有原生多模式內嵌模型,知識庫的運作方式會有所不同。首先,它會剖析您的檔案。然後,它會區塊從中擷取的文字。最後,它會將這些區塊嵌入文字內嵌模型。
原生多模式處理會略過剖析和文字擷取。因此,它會保留文字擷取將會遺失的視覺和音訊詳細資訊。
若要啟用原生多模態處理,請在建立知識庫時選擇原生多模態內嵌模型。目前, TwelveLabs Marengo Embed 3.0 (twelvelabs.marengo-embed-3-0-v1:0) 是唯一您可以選擇的模型。如需設定的說明,請參閱 建立受管知識庫。
原生多模式處理的運作方式
當您使用原生多模式內嵌模型設定知識庫時,適用下列條件:
-
僅支援
MULTI_MODAL_EMBEDDINGS剖析策略。您無法將原生多模式內嵌模型與其他剖析策略結合。 -
檔案會直接傳送至內嵌模型。內嵌模型會處理原始檔案,並從其原生內容產生內嵌。
-
不支援文字型區塊化策略。由於您的檔案不會剖析為文字,因此不適用套用至文字的區塊策略,例如預設區塊和固定大小區塊。
-
您可以設定音訊和視訊的分段。您可以選擇知識庫如何將音訊和視訊檔案分割為區段,而不是文字區塊策略。使用
modelConfiguration欄位中的分割設定。如需詳細資訊,請參閱建立受管知識庫。 -
僅支援模型支援的檔案類型。使用原生多模式內嵌模型設定的知識庫只能擷取模型接受的檔案類型。如需 TwelveLabs Marengo Embed 3.0支援的檔案類型和其他設定,請參閱 TwelveLabs Marengo Embed 3.0。
-
您必須提供多模式儲存目的地。為知識庫提供 Amazon S3 位置,以處理和擷取您的內容。Amazon Bedrock 知識庫會在儲存貯體中建立
aws/字首資料夾。使用與資料來源儲存貯體不同的儲存貯體。如需服務角色所需的許可,請參閱 多模式儲存目的地的許可。 -
僅支援 Retrieve API。您可以查詢使用原生多模式內嵌模型搭配 Retrieve操作的知識庫。不支援 RetrieveAndGenerate操作。
-
查詢必須是文字。您可以使用文字查詢多模態內容。不支援映像查詢。
如需 Retrieve操作針對多模態結果傳回的中繼資料,以及如何擷取相符檔案的詳細資訊,請參閱 擷取原生多模式知識庫的回應。
知識庫如何叫用內嵌模型
當您使用原生多模式內嵌模型時,您的知識庫會同時和非同步叫用該模型。當您提交查詢時,它會使用同步調用,並在擷取您的內容時使用非同步調用。您的服務角色需要兩者的許可。如需要連接之政策的詳細資訊,請參閱 存取 Amazon Bedrock 模型的權限。
注意
在某些情況下 AWS 區域,TwelveLabs Marengo Embed 3.0模型僅支援透過推論設定檔進行同步調用。非同步調用仍然使用隨需模型。在這些區域中,請在建立知識庫時指定推論設定檔。知識庫接著會使用推論設定檔和隨需模型來處理您的內容。您的服務角色需要兩者的許可。
若要檢查您使用的 TwelveLabs Marengo Embed 3.0中如何支援 AWS 區域 ,請參閱 TwelveLabs Marengo Embed 3.0。
使用 Amazon S3 生命週期政策管理暫時性資料
當 Amazon Bedrock 知識庫處理您的內容時,它會將暫時性資料存放在您的多模式儲存目的地。當處理完成時,它會嘗試刪除該資料。為了確保資料過期,建議您將生命週期政策套用至暫時性資料路徑。
如需 Amazon S3 生命週期政策的詳細資訊,請參閱《Amazon S3 使用者指南》中的管理物件的生命週期。