Computer >> 컴퓨터 >  >> 프로그래밍 >> MySQL

MySQL에서 중복으로 나타나는 값과 그 개수를 조회하는 쿼리 작성법

테이블에 저장된 데이터 중 여러 번 반복해서 나타나는 값을 찾고, 각 값이 몇 번 등장했는지 개수까지 함께 확인하고 싶다면 GROUP BYHAVING 절을 조합하여 사용하면 됩니다.

이 글에서는 실제 예제 테이블을 만들고, 단계별로 쿼리를 실행하면서 중복 값과 그 발생 횟수를 조회하는 방법을 살펴보겠습니다.

1. 예제 테이블 생성

먼저 실습에 사용할 테이블을 생성합니다.

mysql> create table DemoTable673(
    Id int NOT NULL AUTO_INCREMENT PRIMARY KEY,
    Value int
);
Query OK, 0 rows affected (0.59 sec)

Id 컬럼은 자동 증가(AUTO_INCREMENT) 기본 키로 설정했고, 중복 여부를 확인할 대상은 Value 컬럼입니다.

2. 샘플 데이터 삽입

다음과 같이 INSERT 문을 사용해 여러 개의 레코드를 추가합니다. 의도적으로 같은 값(10, 20)을 반복해서 넣었습니다.

mysql> insert into DemoTable673(Value) values(10);
mysql> insert into DemoTable673(Value) values(20);
mysql> insert into DemoTable673(Value) values(10);
mysql> insert into DemoTable673(Value) values(30);
mysql> insert into DemoTable673(Value) values(20);
mysql> insert into DemoTable673(Value) values(10);
mysql> insert into DemoTable673(Value) values(10);

3. 전체 데이터 확인

SELECT 문으로 테이블의 모든 레코드를 조회해 봅니다.

mysql> select *from DemoTable673;

실행 결과는 다음과 같습니다.

+----+-------+
| Id | Value |
+----+-------+
|  1 |    10 |
|  2 |    20 |
|  3 |    10 |
|  4 |    30 |
|  5 |    20 |
|  6 |    10 |
|  7 |    10 |
+----+-------+
7 rows in set (0.00 sec)

총 7개의 레코드가 있으며, 값 10은 4번, 값 20은 2번, 값 30은 1번 등장한 것을 눈으로 확인할 수 있습니다.

4. 중복 값과 개수 조회하기

이제 핵심인 쿼리입니다. GROUP BY로 값을 그룹화한 뒤, HAVING 절에서 그룹의 개수가 1보다 큰 경우만 필터링하면 두 번 이상 나타난 값만 남게 됩니다.

mysql> select Id,count(*) as myValue from DemoTable673 group by Value having count(*) > 1;

실행 결과는 다음과 같습니다.

+----+---------+
| Id | myValue |
+----+---------+
|  1 |       4 |
|  2 |       2 |
+----+---------+
2 rows in set (0.00 sec)

쿼리 동작 원리 정리

  • GROUP BY Value: 동일한 Value 값을 가진 행들을 하나의 그룹으로 묶습니다.
  • count(*) as myValue: 각 그룹에 속한 행의 개수를 세어 별칭 myValue로 출력합니다.
  • HAVING count(*) > 1: 집계 결과에 조건을 적용해, 한 번만 나타난 값(예: 30)은 제외하고 두 번 이상 반복된 값만 반환합니다.

참고로 WHERE 절은 그룹화 이전의 개별 행에 조건을 걸 때 사용하기 때문에, 집계 함수의 결과를 필터링하려면 반드시 HAVING 절을 사용해야 합니다. 이 차이를 기억해 두면 중복 데이터 분석 시 큰 도움이 됩니다.