데이터베이스 작업을 하다 보면 특정 열에 중복된 값이 여러 개 존재할 때, 실제로 몇 개의 고유한(서로 다른) 값이 있는지 확인해야 하는 경우가 자주 있습니다. MySQL에서는 COUNT(DISTINCT) 함수를 사용하면 이를 간단하게 처리할 수 있습니다.
1. 테이블 생성하기
먼저 예제에 사용할 테이블을 생성하겠습니다.
mysql> create table DemoTable
(
StudentId int,
StudentFirstName varchar(100)
);
Query OK, 0 rows affected (0.88 sec)2. 샘플 데이터 삽입하기
INSERT 명령어를 사용하여 테이블에 레코드를 추가합니다. 이때 'John'과 'Sam'은 의도적으로 중복되도록 입력합니다.
mysql> insert into DemoTable values(100,'John'); Query OK, 1 row affected (0.32 sec) mysql> insert into DemoTable values(101,'Chris'); Query OK, 1 row affected (0.12 sec) mysql> insert into DemoTable values(102,'John'); Query OK, 1 row affected (0.19 sec) mysql> insert into DemoTable values(103,'Sam'); Query OK, 1 row affected (0.14 sec) mysql> insert into DemoTable values(104,'Sam'); Query OK, 1 row affected (0.13 sec)
3. 전체 레코드 조회하기
SELECT 문을 사용하여 테이블의 모든 레코드를 확인해 보겠습니다.
mysql> select *from DemoTable;
위 쿼리는 다음과 같은 결과를 출력합니다.
+-----------+------------------+ | StudentId | StudentFirstName | +-----------+------------------+ | 100 | John | | 101 | Chris | | 102 | John | | 103 | Sam | | 104 | Sam | +-----------+------------------+ 5 rows in set (0.00 sec)
총 5개의 레코드가 있으며, 이름 열에는 'John'이 2번, 'Sam'이 2번 중복되어 있는 것을 확인할 수 있습니다.
4. 고유 레코드 개수 세기
중복 값을 제외한 고유 레코드의 개수를 구하는 쿼리는 다음과 같습니다. COUNT(DISTINCT 열이름) 형태로 작성하면 됩니다.
mysql> select count(distinct StudentFirstName) from DemoTable;
실행 결과는 다음과 같습니다.
+----------------------------------+ | count(distinct StudentFirstName) | +----------------------------------+ | 3 | +----------------------------------+ 1 row in set (0.00 sec)
결과 해석
전체 레코드는 5개지만, StudentFirstName 열의 고유한 값은 'John', 'Chris', 'Sam'으로 총 3개입니다. 즉, COUNT(DISTINCT)를 사용하면 중복된 값을 하나로 묶어 계산하기 때문에 정확한 고유 값의 개수를 손쉽게 얻을 수 있습니다.
이 방법은 회원 목록에서 중복 없는 이메일 수를 세거나, 주문 데이터에서 고유 고객 수를 집계하는 등 실무에서 매우 유용하게 활용됩니다.