定義
グループ内の上位n要素の集計を、指定のソート順序に従って返します。 グループに含まれる要素がn未満の場合、 $topNはグループ内のすべての要素を返します。
注意
$topN のその他の用途
このページでは、アキュムレータとして使用する場合の$topN について説明します。アキュムレータは、入力ドキュメントのグループにわたる集計値を返します。
$topN (window function)また、n を使用することもできます。これは、指定ソート順に従って、特定のウィンドウ内のドキュメントの上位 要素を返します。
構文
{ $topN: { n: <expression>, sortBy: { <field1>: <sort order>, <field2>: <sort order> ... }, output: <expression> } }
フィールド | タイプ | 説明 |
|---|---|---|
| 式 | グループごとに返される結果の最大数を決定します。 |
| ドキュメント |
|
| 式 | グループ内の各要素の出力を指定します。任意の式を指定できます。 |
動作
NULL および欠損値
$topNは、null 値をフィルタリングで除外しません。$topNは、出力に保持される欠落値を null に変換します。
db.aggregate( [ { $documents: [ { playerId: "PlayerA", gameId: "G1", score: 1 }, { playerId: "PlayerB", gameId: "G1", score: 2 }, { playerId: "PlayerC", gameId: "G1", score: 3 }, { playerId: "PlayerD", gameId: "G1"}, { playerId: "PlayerE", gameId: "G1", score: null } ] }, { $group: { _id: "$gameId", playerId: { $topN: { output: [ "$playerId", "$score" ], sortBy: { "score": 1 }, n: 3 } } } } ] )
この例では、次のことが行われます。
$documentsは、プレイヤーのスコアを含むリテラル ドキュメントを作成します。$groupはドキュメントをgameIdでグループ化します。 この例ではgameId、G1は 1 つのみです。PlayerDはスコアが欠落しており、PlayerEには nullscoreがあります。 これらの値は両方とも null と見なされます。playerIdフィールドとscoreフィールドはoutput : ["$playerId"," $score"]として指定され、配列値として返されます。sortBy: { "score" : 1 }により、null 値は返されたplayerId配列の前にソートされます。
[ { _id: 'G1', playerId: [ [ 'PlayerD', null ], [ 'PlayerE', null ], [ 'PlayerA', 1 ] ] } ]
BSON データ型ソート順
異なるタイプをソートする場合、順序を決定するためにBSON データ型の順序が使用されます。 例として、値が string と数値で構成されるコレクションを考えてみましょう。
昇順ソートでは、string 値は数値の後にソートされます。
降順ソートでは、string 値が数値の前にソートされます。
db.aggregate( [ { $documents: [ { playerId: "PlayerA", gameId: "G1", score: 1 }, { playerId: "PlayerB", gameId: "G1", score: "2" }, { playerId: "PlayerC", gameId: "G1", score: "" } ] }, { $group: { _id: "$gameId", playerId: { $topN: { output: ["$playerId","$score"], sortBy: {"score": -1}, n: 3 } } } } ] )
この例では、次のことが行われます。
PlayerAは整数スコアを持ちます。PlayerBは string"2"スコアを持ちます。PlayerCには空のstringスコアがあります。
並べ替えは{ "score" : -1 }の降順であるため、string リテラル値はPlayerAの数値スコアより前にソートされます。
[ { _id: "G1", playerId: [ [ "PlayerB", "2" ], [ "PlayerC", "" ], [ "PlayerA", 1 ] ] } ]
例
このページの例では、 sample_mflix データセット のデータを使用します。このデータセットを自己管理型MongoDBデプロイにロードする 方法の詳細については、「 サンプル データセットをロードする 」を参照してください。サンプルデータベースに変更を加えた場合、このページの例を実行するには、データベースを削除して再作成する必要がある場合があります。
1 つのジャンルで最高評価の映画 3 つを見つける
$topNアキュムレータを使用すると、Short ジャンルで最も評価の高い映画を 3 つ見つけることができます。
db.movies.aggregate( [ { $match: { genres: "Short", "imdb.rating": { $gt: 0 } } }, { $group: { _id: "Short", topRatedMovies: { $topN: { output: [ "$title", "$imdb.rating" ], sortBy: { "imdb.rating": -1, title: 1 }, n: 3 } } } } ] )
サンプル パイプライン:
各ジャンルで最高評価の映画を見つける
$topNアキュムレータを使用して、各ジャンルで最も評価の高い映画を見つけることができます。
db.movies.aggregate( [ { $unwind: "$genres" }, { $match: { "imdb.rating": { $gt: 0 } } }, { $group: { _id: "$genres", topRatedMovies: { $topN: { output: [ "$title", "$imdb.rating" ], sortBy: { "imdb.rating": -1, title: 1 }, n: 3 } } } }, { $sort: { _id: 1 } }, { $limit: 5 } ] )
サンプル パイプライン:
$unwindを使用して各映画のgenres配列を展開します。$matchimdb.ratingを使用して、 値を含むドキュメントのみを保持します。$group結果をジャンル別にグループ化するには、 を使用します。output: [ "$title", "$imdb.rating" ]を使用して$topNによって返されるフィールドを指定します。sortBy: { "imdb.rating": -1, title: 1 }を使用して映画の評価をランク付けし、titleを決定的なタイブレークとして使用します。$topNを使用して、n: 3を持つ各ジャンルの上位 3 つの映画を返します。
グループ キーに基づいて n を動的に設定
nの値は動的に割り当てることができます。次の例では、$cond 式を使用して、コンテンツ評価に基づいてさまざまな数の映画を返します。
db.movies.aggregate( [ { $match: { rated: { $in: [ "G", "PG", "PG-13", "R" ] }, "imdb.rating": { $gt: 0 } } }, { $group: { _id: { rated: "$rated" }, movies: { $topN: { output: { title: "$title", rating: "$imdb.rating" }, n: { $cond: { if: { $eq: [ "$rated", "PG" ] }, then: 3, else: 1 } }, sortBy: { "imdb.rating": -1 } } } } }, { $sort: { "_id.rated": 1 } } ] )
サンプル パイプライン:
$matchGを使用して、 、PG、PG-13、またはRのコンテンツ評価で、imdb.rating値が含まれる映画のみを保持します。$groupを使用して、結果を_id: { rated: "$rated" }のコンテンツ評価でグループ化します。output: { title: "$title", rating: "$imdb.rating" }を使用して$topNによって返されるフィールドを指定します。コンテンツ 評価が
PGの場合、nは 3 です。それ以外の場合、nは 1 です。sortBy: { "imdb.rating": -1 }を使用して、 IMDb スコアに基づいて上位のn映画を検索します。結果をコンテンツ評価でアルファベット順にソートします。