View a markdown version of this page

Preparazione dei dati di addestramento del classificatore - Amazon Comprehend

Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.

Preparazione dei dati di addestramento del classificatore

Per una classificazione personalizzata, è possibile addestrare il modello in modalità multiclasse o multi-etichetta. Multi-class la modalità associa una singola classe a ciascun documento. Multi-label la modalità associa una o più classi a ciascun documento. I formati dei file di input sono diversi per ogni modalità, quindi scegli la modalità da utilizzare prima di creare i dati di allenamento.

Nota

La console Amazon Comprehend si riferisce alla modalità multiclasse come alla modalità a etichetta singola.

La classificazione personalizzata supporta modelli addestrati con documenti di testo normale e modelli addestrati con documenti nativi (come PDF, Word o immagini). Per ulteriori informazioni sui modelli di classificatore e sui tipi di documenti supportati, vedere. Modelli di classificazione della formazione

Per preparare i dati per addestrare un modello di classificatore personalizzato:

  1. Identifica le classi che desideri che questo classificatore analizzi. Decidi quale modalità utilizzare (multiclasse o multi-etichetta).

  2. Decidi il tipo di modello di classificatore, in base al fatto che il modello sia destinato all'analisi di documenti in testo normale o di documenti semistrutturati.

  3. Raccogli esempi di documenti per ciascuna classe. Per i requisiti minimi di formazione, vedereQuote generali per la classificazione dei documenti.

  4. Per un modello in testo normale, scegli il formato del file di formazione da utilizzare (file CSV o file manifesto aumentato). Per addestrare un modello di documento nativo, usi sempre un file CSV.