Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.
Monitoraggio della capacità dell'indice vettoriale
Per monitorare il consumo di capacità per le operazioni sugli indici vettoriali, imposta il ReturnConsumedCapacity parametro su INDEXES o TOTAL nelle tue SearchVectors richieste o su INDEXES nelle tue richieste API di scrittura.
Le operazioni sugli indici vettoriali sono misurate in due unità, separate dalle unità di capacità di lettura e scrittura utilizzate dalla tabella di base:
-
Ricerca vettoriale (VS): l'unità che misura
SearchVectorsle operazioni. Il consumo di VS viene riportato in base alla dimensione dei dati vettoriali esaminati e restituiti dalla ricerca.VectorSearchRequestBytes -
Scrittura vettoriale (VWR): l'unità che misura le scritture viene replicata in un indice vettoriale. Il consumo di VWR viene riportato
VectorWriteRequestBytese viene scalato in base alla dimensione dei dati replicati nell'indice.
L'esempio seguente mostra i dati ConsumedCapacity restituiti da una richiesta. SearchVectors
{ "ConsumedCapacity": { "VectorSearchRequestBytes": 41714.0 } }
Per le operazioni di scrittura (PutItem,UpdateItem,DeleteItem,BatchWriteItem,TransactWriteItems), la risposta include una VectorIndexes mappa inConsumedCapacity, digitata in base al nome dell'indice. Ogni voce riporta VectorWriteRequestBytes la capacità consumata durante la replica delle modifiche a ciascun indice vettoriale.
{ "ConsumedCapacity": { "TableName": "Products", "CapacityUnits": 5.0, "Table": { "CapacityUnits": 5.0 }, "VectorIndexes": { "ProductEmbeddingIndex": { "VectorWriteRequestBytes": 4125.0 } } } }
La capacità dell'indice vettoriale viene misurata in byte elaborati, riportati separatamente dalla capacità di lettura e scrittura della tabella di base. Usa questi campi per capire cosa determina il costo del tuo indice vettoriale:
-
Il costo di ricerca (
VectorSearchRequestBytes) si adatta principalmente alla dimensione dei vettori che la ricerca deve esaminare, che aumenta con il numero di dimensioni nell'indice e la quantità di dati restituiti. La limitazione della ricerca a un singolo valore di chiave di partizione riduce la quantità di dati esaminati. La restituzione dell'attributo vector nei risultati aumenta ulteriormente i costi perché la risposta include tutti i dati vettoriali. Il costo di ricerca non aumenta in proporzione al numero di elementi nell'indice. Se il numero di dimensioni, ilTopKvalore e la proiezione rimangono invariati, i dati esaminati dalla ricerca crescono logaritmicamente man mano che si aggiungono elementi. Ciò accade perché una ricerca approssimativa del vicino più prossimo attraversa un piccolo sottoinsieme dell'indice anziché leggere tutti i vettori. Raddoppiando il numero di elementi in un indice si aggiunge una piccola quantità costante ai dati esaminati da ciascuna ricerca. -
Il costo di scrittura (
VectorWriteRequestBytes) viene sostenuto ogni volta che si scrive, si aggiorna o si elimina un elemento che modifica un attributo indicizzato vettoriale e viene scalato in base alla dimensione dei dati replicati nell'indice. Le scritture che non modificano un attributo indicizzato non comportano la capacità di scrittura vettoriale.
Higher-dimensional gli incorporamenti aumentano i costi di ricerca e scrittura perché ogni vettore contiene più dati. Per i prezzi attuali, consulta i prezzi di Amazon DynamoDB
DynamoDB pubblica anche la capacità dell'indice vettoriale CloudWatch come VectorWriteRequestBytes metriche VectorSearchRequestBytes e, dimensionate da e. TableName VectorIndexName Usa queste metriche per creare grafici e avvisare sull'utilizzo dell'indice vettoriale nel tempo. Per le definizioni delle metriche, consulta VectorSearchRequestBytes e. VectorWriteRequestBytes
Per-request misurazione minima
DynamoDB misura la capacità dell'indice vettoriale a un minimo di 1 KB per richiesta e fatture per byte superiori a tale minimo. Questo vale per entrambi i tipi di richiesta. Una SearchVectors richiesta che esamina meno di 1 KB di dati vettoriali viene misurata a 1 KB. Anche una richiesta di scrittura che replica meno di 1 KB negli indici vettoriali di una tabella viene misurata a 1 KB.
Il valore minimo si applica per richiesta, non per indice. Una scrittura che aggiorna i vettori in diversi indici vettoriali di una tabella non richiede un minimo separato di 1 KB per ciascuno di essi, anche se ConsumedCapacity vengono generati report per indice. VectorWriteRequestBytes
Di conseguenza, i vettori di piccole dimensioni non sono proporzionalmente inferiori. Un vettore con un numero limitato di dimensioni contiene solo pochi byte di dati in virgola mobile a 32 bit e viene comunque misurato al minimo di 1 KB.
Al di sopra del valore minimo, VectorSearchRequestBytes riflette i dati vettoriali esaminati dalla ricerca all'interno dell'indice, non la dimensione del vettore di interrogazione fornito. Di conseguenza, VectorSearchRequestBytes è più grande del solo vettore di interrogazione.
Il costo di ricerca aumenta logaritmicamente, come spiegato in precedenza, ma tale relazione non è una formula per stimare la fattura. VectorSearchRequestBytesinclude anche i dati restituiti dalla ricerca. Questi dati sono scalabili con TopK e con gli attributi proiettati. La metrica è inoltre limitata al minimo di 1 KB per richiesta. Al massimo TopK con una proiezione completa, i dati restituiti possono superare i dati esaminati.
Non stimate il costo dell'indice vettoriale in base al numero delle dimensioni. Utilizza i VectorWriteRequestBytes valori VectorSearchRequestBytes e restituiti dal tuo carico di lavoro o le CloudWatch metriche corrispondenti. Effettua la convalida rispetto a un set di dati rappresentativo prima di dimensionare un carico di lavoro.