Microsoft.ML.Transforms.Text Spazio dei nomi
Importante
Alcune informazioni sono relative alla release non definitiva del prodotto, che potrebbe subire modifiche significative prima della release definitiva. Microsoft non riconosce alcuna garanzia, espressa o implicita, in merito alle informazioni qui fornite.
Spazio dei nomi contenente componenti di trasformazione dati di testo.
Classi
| Nome | Descrizione |
|---|---|
| CustomStopWordsRemovingEstimator |
IEstimator<TTransformer>per .CustomStopWordsRemovingTransformer |
| CustomStopWordsRemovingEstimator.Options |
Usare il remover di parole non significative che consente di rimuovere l'elenco specifico della lingua delle parole non significative (parole più comuni) già definite nel sistema. |
| CustomStopWordsRemovingTransformer |
ITransformer risultante dall'adattamento di un oggetto CustomStopWordsRemovingEstimator. |
| LatentDirichletAllocationEstimator |
La trasformazione LDA implementa LightLDA, un'implementazione all'avanguardia dell'allocazione latente di Dirichlet. |
| LatentDirichletAllocationTransformer |
ITransformer risultante dall'adattamento di un oggetto LatentDirichletAllocationEstimator. |
| LatentDirichletAllocationTransformer.ModelParameters |
Fornire informazioni dettagliate sugli argomenti individuati da LightLDA. |
| NgramExtractingEstimator |
Produce un vettore di conteggi di n-grammi (sequenze di parole consecutive) rilevati nel testo di input. |
| NgramExtractingTransformer |
ITransformer risultante dall'adattamento di un oggetto NgramExtractingEstimator. |
| NgramHashingEstimator | |
| NgramHashingTransformer |
Spazio dei nomi contenente componenti di trasformazione dati di testo. |
| StopWordsRemovingEstimator |
IEstimator<TTransformer>per .CustomStopWordsRemovingTransformer |
| StopWordsRemovingEstimator.Options |
Usare il remover di parole non significative che consente di rimuovere un elenco specifico della lingua di parole non significative (parole più comuni) già definito nel sistema. |
| StopWordsRemovingTransformer |
ITransformer risultante dall'adattamento di un oggetto StopWordsRemovingEstimator. |
| TextFeaturizingEstimator |
Strumento di stima che trasforma una raccolta di documenti di testo in vettori di funzionalità numerici. I vettori di funzionalità sono conteggi normalizzati di parole e/o caratteri n-grammi (in base alle opzioni fornite). |
| TextFeaturizingEstimator.Options |
Opzioni avanzate per .TextFeaturizingEstimator |
| TextNormalizingEstimator | |
| TextNormalizingTransformer |
ITransformer risultante dall'adattamento di un oggetto TextNormalizingEstimator. |
| TokenizingByCharactersEstimator |
IEstimator<TTransformer>per .TokenizingByCharactersTransformer |
| TokenizingByCharactersTransformer |
ITransformer risultante dall'adattamento di un oggetto TokenizingByCharactersEstimator. |
| WordBagEstimator | |
| WordBagEstimator.Options |
Opzioni per il modo in cui vengono estratti i n-grammi. |
| WordEmbeddingEstimator |
Funzionalità di testo che converte i vettori di token di testo in un vettore numerico usando un modello di incorporamento con training preliminare. |
| WordEmbeddingTransformer |
ITransformer risultante dall'adattamento di un oggetto WordEmbeddingEstimator. |
| WordHashBagEstimator | |
| WordTokenizingEstimator |
Tokenzza il testo di input usando delimitatori specificati. |
| WordTokenizingTransformer |
ITransformer risultante dall'adattamento di un oggetto WordTokenizingEstimator. |
Struct
| Nome | Descrizione |
|---|---|
| LatentDirichletAllocationTransformer.ModelParameters.ItemScore |
Spazio dei nomi contenente componenti di trasformazione dati di testo. |
| LatentDirichletAllocationTransformer.ModelParameters.WordItemScore |
Spazio dei nomi contenente componenti di trasformazione dati di testo. |
Interfacce
| Nome | Descrizione |
|---|---|
| IStopWordsRemoverOptions |
Definisce il diverso tipo di rimozione parole non significative supportato. |
Enumerazioni
| Nome | Descrizione |
|---|---|
| NgramExtractingEstimator.WeightingCriteria |
Misura statistica utilizzata per valutare quanto sia importante una parola per un documento in un corpus. Questa enumerazione viene serializzata. |
| StopWordsRemovingEstimator.Language |
Lingua parole non significative. Questa enumerazione viene serializzata. |
| TextFeaturizingEstimator.Language |
Lingua del testo. Questa enumerazione viene serializzata. |
| TextFeaturizingEstimator.NormFunction |
Tipo di normalizzatore del vettore di testo. |
| TextNormalizingEstimator.CaseMode |
Modalità di normalizzazione maiuscole/minuscole del testo. Questa enumerazione viene serializzata. |
| WordEmbeddingEstimator.PretrainedModelKind |
Specifica le parole da utilizzare. |