MongoDB에서 특정 컬렉션에 어떤 필드들이 존재하는지 확인하고 싶다면 MapReduce 개념을 활용할 수 있습니다. 이 글에서는 MapReduce를 사용해 MongoDB 컬렉션의 모든 필드 이름을 한 번에 추출하는 방법을 단계별로 살펴보겠습니다.
1. 샘플 컬렉션 생성하기
먼저 문서를 포함하는 컬렉션을 생성합니다. 아래 예제에서는 getAllFieldNamesDemo라는 이름의 컬렉션에 학생 정보를 담은 문서를 하나 삽입합니다.
> db.getAllFieldNamesDemo.insertOne({"StudentFirstName":"David","StudentAge":23});
{
"acknowledged" : true,
"insertedId" : ObjectId("5cd998e9b50a6c6dd317ad90")
}2. 저장된 문서 확인하기
find() 메서드를 사용하면 컬렉션에 저장된 모든 문서를 조회할 수 있습니다.
> db.getAllFieldNamesDemo.find();
위 쿼리를 실행하면 다음과 같은 결과가 출력됩니다.
{ "_id" : ObjectId("5cd998e9b50a6c6dd317ad90"), "StudentFirstName" : "David", "StudentAge" : 23 }3. MapReduce로 모든 필드 이름 추출하기
이제 runCommand()를 통해 MapReduce 작업을 실행하여 컬렉션 내의 모든 필드 이름을 가져옵니다. map 함수는 각 문서의 모든 키를 순회하며 emit하고, reduce 함수는 중복 키를 정리한 뒤 결과를 별도의 컬렉션(_k 접미사)에 저장합니다.
> myMapReduce = db.runCommand({
"mapreduce" : "getAllFieldNamesDemo",
"map" : function() {
for (var myKey in this) { emit(myKey, null); }
},
"reduce" : function(myKey, s) { return null; },
"out": "getAllFieldNamesDemo" + "_k"
})
{
"result" : "getAllFieldNamesDemo_k",
"timeMillis" : 1375,
"counts" : {
"input" : 1,
"emit" : 3,
"reduce" : 0,
"output" : 3
},
"ok" : 1
}
> db[myMapReduce.result].distinct("_id");4. 최종 결과 확인
MapReduce 실행 후 distinct("_id")를 호출하면 결과 컬렉션에 저장된 고유한 필드 이름 목록을 얻을 수 있습니다. 실행 결과는 다음과 같습니다.
[ "StudentAge", "StudentFirstName", "_id" ]
정리 및 참고 사항
위 과정을 통해 getAllFieldNamesDemo 컬렉션에는 _id, StudentFirstName, StudentAge 세 개의 필드가 존재함을 확인했습니다.
다만 몇 가지 유의할 점이 있습니다. MongoDB는 스키마리스(schemaless) 데이터베이스이기 때문에 각 문서마다 서로 다른 필드를 가질 수 있습니다. 따라서 위 방법은 컬렉션 전체를 스캔해야 하므로 대용량 컬렉션에서는 실행 시간이 오래 걸릴 수 있습니다.
또한 MongoDB 4.4부터는 MapReduce가 deprecated(사용 중단 권고) 상태이며, 집계 파이프라인(Aggregation Pipeline)의 $objectToArray와 $group 연산자를 조합하는 방식이 더 효율적인 대안으로 권장됩니다. 소규모 데이터나 학습 목적이라면 MapReduce 방식도 충분히 유용하게 활용할 수 있습니다.