Microsoft.ML.Transforms.Text Espacio de nombres
Importante
Parte de la información hace referencia a la versión preliminar del producto, que puede haberse modificado sustancialmente antes de lanzar la versión definitiva. Microsoft no otorga ninguna garantía, explícita o implícita, con respecto a la información proporcionada aquí.
Espacio de nombres que contiene componentes de transformación de datos de texto.
Clases
| Nombre | Description |
|---|---|
| CustomStopWordsRemovingEstimator |
IEstimator<TTransformer>para .CustomStopWordsRemovingTransformer |
| CustomStopWordsRemovingEstimator.Options |
Use el eliminador de palabras irrelevantes que puede quitar la lista específica del lenguaje de palabras irrelevantes (palabras más comunes) ya definidas en el sistema. |
| CustomStopWordsRemovingTransformer |
ITransformer resultante de ajustar un CustomStopWordsRemovingEstimator. |
| LatentDirichletAllocationEstimator |
La transformación LDA implementa LightLDA, una implementación de última generación de Latent Dirichlet Allocation. |
| LatentDirichletAllocationTransformer |
ITransformer resultante de ajustar un LatentDirichletAllocationEstimator. |
| LatentDirichletAllocationTransformer.ModelParameters |
Proporcione detalles sobre los temas detectados por LightLDA. |
| NgramExtractingEstimator |
Genera un vector de recuentos de n-gramas (secuencias de palabras consecutivas) encontrados en el texto de entrada. |
| NgramExtractingTransformer |
ITransformer resultante de ajustar un NgramExtractingEstimator. |
| NgramHashingEstimator | |
| NgramHashingTransformer |
Espacio de nombres que contiene componentes de transformación de datos de texto. |
| StopWordsRemovingEstimator |
IEstimator<TTransformer>para .CustomStopWordsRemovingTransformer |
| StopWordsRemovingEstimator.Options |
Use palabras irrelevantes que pueden quitar la lista específica del lenguaje de palabras irrelevantes (palabras más comunes) ya definidas en el sistema. |
| StopWordsRemovingTransformer |
ITransformer resultante de ajustar un StopWordsRemovingEstimator. |
| TextFeaturizingEstimator |
Estimador que convierte una colección de documentos de texto en vectores numéricos de características. Los vectores de características son recuentos normalizados de palabras o caracteres n-gramas (según las opciones proporcionadas). |
| TextFeaturizingEstimator.Options |
Opciones avanzadas para .TextFeaturizingEstimator |
| TextNormalizingEstimator | |
| TextNormalizingTransformer |
ITransformer resultante de ajustar un TextNormalizingEstimator. |
| TokenizingByCharactersEstimator |
IEstimator<TTransformer>para .TokenizingByCharactersTransformer |
| TokenizingByCharactersTransformer |
ITransformer resultante de ajustar un TokenizingByCharactersEstimator. |
| WordBagEstimator | |
| WordBagEstimator.Options |
Opciones de cómo se extraen los n-gramas. |
| WordEmbeddingEstimator |
Caracterizador de texto que convierte vectores de tokens de texto en un vector numérico mediante un modelo de incrustaciones previamente entrenados. |
| WordEmbeddingTransformer |
ITransformer resultante de ajustar un WordEmbeddingEstimator. |
| WordHashBagEstimator | |
| WordTokenizingEstimator |
Tokeniza el texto de entrada mediante delimitadores especificados. |
| WordTokenizingTransformer |
ITransformer resultante de ajustar un WordTokenizingEstimator. |
Estructuras
| Nombre | Description |
|---|---|
| LatentDirichletAllocationTransformer.ModelParameters.ItemScore |
Espacio de nombres que contiene componentes de transformación de datos de texto. |
| LatentDirichletAllocationTransformer.ModelParameters.WordItemScore |
Espacio de nombres que contiene componentes de transformación de datos de texto. |
Interfaces
| Nombre | Description |
|---|---|
| IStopWordsRemoverOptions |
Define el tipo diferente de palabras irrelevantes que se admiten. |
Enumeraciones
| Nombre | Description |
|---|---|
| NgramExtractingEstimator.WeightingCriteria |
Una medida estadística utilizada para evaluar la importancia de una palabra en un documento en un corpus. Esta enumeración se serializa. |
| StopWordsRemovingEstimator.Language |
Palabras irrelevantes. Esta enumeración se serializa. |
| TextFeaturizingEstimator.Language |
Idioma de texto. Esta enumeración se serializa. |
| TextFeaturizingEstimator.NormFunction |
Tipo de normalizador de vector de texto. |
| TextNormalizingEstimator.CaseMode |
Modo de normalización de mayúsculas y minúsculas del texto. Esta enumeración se serializa. |
| WordEmbeddingEstimator.PretrainedModelKind |
Especifica qué palabras se van a usar. |