El analizador standard es el valor por defecto para todos los índices y consultas de MongoDB Search. Divide el texto en términos según los límites de las palabras, lo que lo hace neutral en cuanto al lenguaje para la mayoría de los casos de uso. Convierte todos los términos a minúsculas y elimina los signos de puntuación. Ofrece una tokenización basada en la gramática que reconoce direcciones de correo electrónico, acrónimos, caracteres chinos-japoneses-coreanos, caracteres alfanuméricos y más.
Si seleccionas Refine Your Index, la interfaz de usuario de Atlas muestra una sección titulada View text analysis of your selected index configuration dentro de la sección Index Configurations. Si amplía esta sección, la Interfaz de Usuario de Atlas muestra el índice y los tokens de búsqueda que el analizador standard genera para cada string de muestra. Puede ver los tokens que el analizador standard crea para un documento de muestra incorporado y un string del query cuando crea o edita un índice en la Interfaz de Usuario de Atlas Visual Editor.
Importante
MongoDB Search no indexará los campos de string en los que los tokens del analizador superen los 32766 bytes de tamaño. Si se utiliza el analizador de keywords, los campos de string que superen los 32766 bytes no se indexarán.
Ejemplo
La siguiente definición de índice de ejemplo especifica un índice en el campo title de la colección sample_mflix.movies usando el analizador standard. Para seguir este ejemplo, carga los datos de ejemplo en tu clúster y usa mongosh o navega hasta la página Create a Search
Index en la Interfaz de Usuario de Atlas siguiendo los pasos del tutorial Crear un índice de búsqueda de MongoDB.
Luego, utilizando la colección movies como fuente de datos, sigue el procedimiento del ejemplo para crear un índice desde mongosh o la interfaz de usuario de Atlas Visual Editor o JSON editor.
➤ Utiliza el menú desplegable Seleccionar el lenguaje para establecer la interfaz del ejemplo en esta página.
La siguiente consulta busca el término action en el campo title y limita la salida a dos resultados.
MongoDB Search devolvió estos documentos porque coincidió el término de query action con el token action para los documentos, que MongoDB Search creó al realizar lo siguiente para el texto en el campo title utilizando el analizador lucene.standard:
Convierte el texto a minúsculas.
Divida el texto en función de los límites de palabras y cree tokens separados.
La siguiente tabla muestra los tokens (términos buscables) que MongoDB Search crea usando el Analizador Estándar y, por el contrario, los tokens que MongoDB Search crea para el Analizador por Palabras Clave y Analizador de Espacios en Blanco para los documentos en los resultados:
Título | Fichas del Analizador Estándar | Tokens del Analizador de Palabras clave | Tokens del analizador Whitespace |
|---|---|---|---|
|
|
|
|
|
|
|
|
Si indexa el campo usando el:
Keyword Analyzer, MongoDB Search no haría coincidir los documentos en los resultados para el término de query
actionporque el analizadorkeywordsólo hace coincidir documentos en los que el término de búsqueda coincide exactamente con el contenido completo del campo (Action JacksonyClass Action).Análisis de espacios en blanco, MongoDB Search no coincidiría los documentos en los resultados para el término de consulta
actionporque el analizadorwhitespacetokeniza el valor del campotitleen su caso original (Action) y el término de consulta tiene el minúsculaaction, lo cual no coincide con el tokenwhitespacedel analizador.