AI 에이전트의 경우: 문서 인덱스는 https://www.mongodb.com/ko-kr/docs/llms.txt에서 사용할 수 있으며, 모든 페이지의 마크다운 버전은 어떤 URL 경로에 .md를 추가하여 사용할 수 있습니다.
Docs Menu

공백 분석기

whitespace 분석기는 공백 문자를 찾을 때마다 텍스트를 검색 가능한 용어(토큰)로 나눕니다. 모든 텍스트는 원래 대소문자를 그대로 유지합니다.

Refine Your Index를 선택하면 Atlas UI Index Configurations 섹션 내에 View text analysis of your selected index configuration 이라는 제목의 섹션이 표시됩니다. 이 섹션을 확장하면 Atlas UI whitespace 분석기 각 샘플 문자열에 대해 생성하는 인덱스 및 검색 토큰이 표시됩니다. Atlas UI Visual Editor에서 인덱스 생성하거나 편집할 때 whitespace 분석기 내장 샘플 문서 및 쿼리 문자열에 대해 생성하는 토큰을 볼 수 있습니다.

중요

MongoDB Search는 분석기 토큰 크기가 32766 바이트를 초과하는 문자열 필드를 인덱스 하지 않습니다. 키워드 분석기 사용하는 경우 32766 바이트를 초과하는 문자열 필드는 인덱싱되지 않습니다.

다음 예시 인덱스 정의는 whitespace 분석기를 사용하여 sample_mflix.movies 컬렉션의 title 필드에 대한 인덱스를 지정합니다. 이 예시를 따라 학습하려면 클러스터에 샘플 데이터를 로드 하고 mongosh 를 사용하거나 MongoDB Search 인덱스 생성 튜토리얼의 단계에 따라 Atlas UI의 Create a Search Index 페이지로 이동하세요.

그런 다음 movies 컬렉션 데이터 소스로 사용하여 예시 절차에 따라 mongosh 또는 Atlas UI Visual Editor 또는 JSON editor에서 인덱스 생성합니다.


다음 쿼리는 title 필드에서 Lion's 이라는 용어를 검색합니다.

MongoDB Search는 lucene.whitespace 분석기 사용하여 title 필드 의 텍스트에 대해 다음을 수행하여 이러한 문서를 반환합니다.

  • 텍스트의 원래 대소문자를 유지합니다.

  • 공백 문자를 찾을 때마다 텍스트를 토큰으로 나눕니다.

다음 표는 MongoDB Search가 공백 분석기와 단순 분석기 및 키워드 분석기를 사용하여 결과의 문서에 대해 생성하는 토큰(검색 가능한 용어)을 보여줍니다.

제목
공백 분석기 토큰
간단한 분석기 토큰
키워드 분석기 토큰

The Lion's Mouth Opens

The, Lion's, Mouth, Opens

the, lion, s, mouth, opens

The Lion's Mouth Opens

whitespace 분석기 사용하는 인덱스 는 대소문자를 구분합니다. 따라서 MongoDB Search는 쿼리 텀 Lion'swhitespace 분석기 에서 생성된 토큰 Lion's 과 일치시킬 수 있습니다.