Microsoft.ML.Transforms.Text Spazio dei nomi

Spazio dei nomi contenente componenti di trasformazione dati di testo.

Classi

Nome Descrizione
CustomStopWordsRemovingEstimator

IEstimator<TTransformer>per .CustomStopWordsRemovingTransformer

CustomStopWordsRemovingEstimator.Options

Usare il remover di parole non significative che consente di rimuovere l'elenco specifico della lingua delle parole non significative (parole più comuni) già definite nel sistema.

CustomStopWordsRemovingTransformer

ITransformer risultante dall'adattamento di un oggetto CustomStopWordsRemovingEstimator.

LatentDirichletAllocationEstimator

La trasformazione LDA implementa LightLDA, un'implementazione all'avanguardia dell'allocazione latente di Dirichlet.

LatentDirichletAllocationTransformer

ITransformer risultante dall'adattamento di un oggetto LatentDirichletAllocationEstimator.

LatentDirichletAllocationTransformer.ModelParameters

Fornire informazioni dettagliate sugli argomenti individuati da LightLDA.

NgramExtractingEstimator

Produce un vettore di conteggi di n-grammi (sequenze di parole consecutive) rilevati nel testo di input.

NgramExtractingTransformer

ITransformer risultante dall'adattamento di un oggetto NgramExtractingEstimator.

NgramHashingEstimator

IEstimator<TTransformer>per .NgramHashingTransformer

NgramHashingTransformer

Spazio dei nomi contenente componenti di trasformazione dati di testo.

StopWordsRemovingEstimator

IEstimator<TTransformer>per .CustomStopWordsRemovingTransformer

StopWordsRemovingEstimator.Options

Usare il remover di parole non significative che consente di rimuovere un elenco specifico della lingua di parole non significative (parole più comuni) già definito nel sistema.

StopWordsRemovingTransformer

ITransformer risultante dall'adattamento di un oggetto StopWordsRemovingEstimator.

TextFeaturizingEstimator

Strumento di stima che trasforma una raccolta di documenti di testo in vettori di funzionalità numerici. I vettori di funzionalità sono conteggi normalizzati di parole e/o caratteri n-grammi (in base alle opzioni fornite).

TextFeaturizingEstimator.Options

Opzioni avanzate per .TextFeaturizingEstimator

TextNormalizingEstimator

IEstimator<TTransformer>per .TextNormalizingTransformer

TextNormalizingTransformer

ITransformer risultante dall'adattamento di un oggetto TextNormalizingEstimator.

TokenizingByCharactersEstimator

IEstimator<TTransformer>per .TokenizingByCharactersTransformer

TokenizingByCharactersTransformer

ITransformer risultante dall'adattamento di un oggetto TokenizingByCharactersEstimator.

WordBagEstimator

IEstimator<TTransformer>per .ITransformer

WordBagEstimator.Options

Opzioni per il modo in cui vengono estratti i n-grammi.

WordEmbeddingEstimator

Funzionalità di testo che converte i vettori di token di testo in un vettore numerico usando un modello di incorporamento con training preliminare.

WordEmbeddingTransformer

ITransformer risultante dall'adattamento di un oggetto WordEmbeddingEstimator.

WordHashBagEstimator

IEstimator<TTransformer>per .ITransformer

WordTokenizingEstimator

Tokenzza il testo di input usando delimitatori specificati.

WordTokenizingTransformer

ITransformer risultante dall'adattamento di un oggetto WordTokenizingEstimator.

Struct

Nome Descrizione
LatentDirichletAllocationTransformer.ModelParameters.ItemScore

Spazio dei nomi contenente componenti di trasformazione dati di testo.

LatentDirichletAllocationTransformer.ModelParameters.WordItemScore

Spazio dei nomi contenente componenti di trasformazione dati di testo.

Interfacce

Nome Descrizione
IStopWordsRemoverOptions

Definisce il diverso tipo di rimozione parole non significative supportato.

Enumerazioni

Nome Descrizione
NgramExtractingEstimator.WeightingCriteria

Misura statistica utilizzata per valutare quanto sia importante una parola per un documento in un corpus. Questa enumerazione viene serializzata.

StopWordsRemovingEstimator.Language

Lingua parole non significative. Questa enumerazione viene serializzata.

TextFeaturizingEstimator.Language

Lingua del testo. Questa enumerazione viene serializzata.

TextFeaturizingEstimator.NormFunction

Tipo di normalizzatore del vettore di testo.

TextNormalizingEstimator.CaseMode

Modalità di normalizzazione maiuscole/minuscole del testo. Questa enumerazione viene serializzata.

WordEmbeddingEstimator.PretrainedModelKind

Specifica le parole da utilizzare.