世界的に生成されるデータ量が幾何学的に増加していることは周知の事実です。実際、2025年末までに、史上初めて181ゼタバイトのデータが存在することとなると推定されています(ちなみに、1ゼタバイトは10垓バイトに相当します)。そして、その181ゼタバイトのうち80%が非構造化データになると予測されています。

しかし、これはあらゆる種類のデータユーザーにとっての重大な問題も浮き彫りにしています。非構造化データ、具体的には非構造化テキストデータは、従来のリレーショナルデータベースに格納することも、クエリを実行することもできません。さらに、完全なテキスト一致のみを検索する従来のクエリは、ユーザーがテキストデータ内で検索しているトピックや重要なアイデアしか知らないことが多いため、あまり役に立ちません。
この問題を解決するのが全文検索です。全文検索を使用すると、非リレーショナル NoSQL データベースにデータが最適に保存されている間、ユーザーは直感的かつ効率的な方法で非構造化テキストデータにアクセスできます。全文検索とは何か、どのように機能するか、その使用例について、以下で学びましょう。
目次




