MongoDB에서 상위 N개 행 조회하기
MongoDB에서 상위 N개의 행(문서)을 조회하려면 애그리게이션 프레임워크(aggregate framework)를 사용하는 것이 가장 효과적입니다. 이 글에서는 예제 컬렉션을 생성하고, $sort, $limit, $match 파이프라인 단계를 조합하여 원하는 결과를 얻는 과정을 단계별로 살펴봅니다.
1. 샘플 컬렉션 생성
먼저 학생 이름(StudentName)과 점수(Score)를 담은 문서들로 컬렉션을 생성합니다.
> db.topNRowsDemo.insertOne({"StudentName":"Larry","Score":78});
{
"acknowledged" : true,
"insertedId" : ObjectId("5ca26eee6304881c5ce84b91")
}
> db.topNRowsDemo.insertOne({"StudentName":"Chris","Score":45});
{
"acknowledged" : true,
"insertedId" : ObjectId("5ca26ef66304881c5ce84b92")
}
> db.topNRowsDemo.insertOne({"StudentName":"Mike","Score":65});
{
"acknowledged" : true,
"insertedId" : ObjectId("5ca26efe6304881c5ce84b93")
}
> db.topNRowsDemo.insertOne({"StudentName":"Adam","Score":55});
{
"acknowledged" : true,
"insertedId" : ObjectId("5ca26f066304881c5ce84b94")
}
> db.topNRowsDemo.insertOne({"StudentName":"John","Score":86});
{
"acknowledged" : true,
"insertedId" : ObjectId("5ca26f0f6304881c5ce84b95")
}2. 전체 문서 확인하기
find() 메서드를 사용하면 컬렉션에 저장된 모든 문서를 확인할 수 있습니다.
> db.topNRowsDemo.find().pretty();
위 쿼리를 실행하면 다음과 같은 출력 결과를 얻을 수 있습니다.
{
"_id" : ObjectId("5ca26eee6304881c5ce84b91"),
"StudentName" : "Larry",
"Score" : 78
}
{
"_id" : ObjectId("5ca26ef66304881c5ce84b92"),
"StudentName" : "Chris",
"Score" : 45
}
{
"_id" : ObjectId("5ca26efe6304881c5ce84b93"),
"StudentName" : "Mike",
"Score" : 65
}
{
"_id" : ObjectId("5ca26f066304881c5ce84b94"),
"StudentName" : "Adam",
"Score" : 55
}
{
"_id" : ObjectId("5ca26f0f6304881c5ce84b95"),
"StudentName" : "John",
"Score" : 86
}3. 상위 N개 행 쿼리 실행하기
이제 aggregate() 메서드에 여러 파이프라인 단계를 연결하여 상위 N개 행을 조회해 보겠습니다.
> db.topNRowsDemo.aggregate([
... {$sort: {StudentName: 1}},
... {$limit: 5},
... {$match: {Score: {$gt: 65}}}
... ]).pretty();
위 애그리게이션 쿼리를 실행하면 다음과 같은 결과가 출력됩니다.
{
"_id" : ObjectId("5ca26f0f6304881c5ce84b95"),
"StudentName" : "John",
"Score" : 86
}
{
"_id" : ObjectId("5ca26eee6304881c5ce84b91"),
"StudentName" : "Larry",
"Score" : 78
}파이프라인 단계 상세 설명
- $sort: StudentName 필드를 오름차순(
1)으로 정렬합니다. 내림차순 정렬이 필요하면-1을 지정하면 됩니다. - $limit: 정렬된 결과 중 앞에서 5개의 문서만 남깁니다. 이 값을 조절하여 원하는 개수(N)만큼 결과를 제한할 수 있습니다.
- $match: Score가 65보다 큰(
$gt: 65) 문서만 최종적으로 필터링합니다.
이처럼 애그리게이션 파이프라인에서는 각 단계가 순서대로 실행되며, 앞 단계의 출력이 다음 단계의 입력으로 전달됩니다. 정렬 → 제한 → 필터링의 흐름을 응용하면 '점수 기준 상위 3명 조회'처럼 다양한 형태의 상위 N개 행 쿼리를 손쉽게 작성할 수 있습니다.