MySQL에서 동일한 Id를 가진 여러 행을 하나로 병합하고, 나머지 열들에서는 각각 가장 큰 값을 추출해야 하는 경우가 종종 있습니다. 이럴 때는 집계 함수 MAX()와 GROUP BY 절을 함께 사용하면 간단하게 해결할 수 있습니다.
1. 테이블 생성
먼저 예제에 사용할 테이블을 생성합니다.
mysql> create table DemoTable
(
Id int,
Value1 int,
Value2 int,
Value3 int,
Value4 int
);
Query OK, 0 rows affected (0.61 sec)2. 데이터 삽입
INSERT 명령으로 샘플 레코드를 입력합니다. 의도적으로 같은 Id(100)를 가진 행이 여러 개 존재하도록 구성했습니다.
mysql> insert into DemoTable(Id,Value4) values(100,30); Query OK, 1 row affected (0.14 sec) mysql> insert into DemoTable(Id,Value1,Value2,Value3) values(100,20,60,40); Query OK, 1 row affected (0.14 sec) mysql> insert into DemoTable(Id,Value2,Value3,Value4) values(100,90,100,110); Query OK, 1 row affected (0.10 sec)
3. 전체 데이터 확인
SELECT 문으로 테이블의 모든 레코드를 조회해 보겠습니다.
mysql> select *from DemoTable;
실행 결과는 다음과 같습니다.
+------+--------+--------+--------+--------+ | Id | Value1 | Value2 | Value3 | Value4 | +------+--------+--------+--------+--------+ | 100 | NULL | NULL | NULL | 30 | | 100 | 20 | 60 | 40 | NULL | | 100 | NULL | 90 | 100 | 110 | +------+--------+--------+--------+--------+ 3 rows in set (0.00 sec)
Id가 100으로 동일한 행이 세 개 있으며, 각 행마다 실제 값이 들어 있는 열이 서로 다른 것을 확인할 수 있습니다.
4. 행 병합 및 최댓값 조회 쿼리
다음은 Id가 같은 행들을 하나로 묶고, 각 열에서 가장 큰 값을 표시하는 쿼리입니다.
mysql> select Id,max(Value1) as Value1,max(Value2) as Value2,max(Value3) as Value3,max(Value4) as Value4 from DemoTable group by Id;
실행 결과는 다음과 같습니다.
+------+--------+--------+--------+--------+ | Id | Value1 | Value2 | Value3 | Value4 | +------+--------+--------+--------+--------+ | 100 | 20 | 90 | 100 | 110 | +------+--------+--------+--------+--------+ 1 row in set (0.00 sec)
동작 원리 정리
GROUP BY Id는 동일한 Id 값을 가진 행들을 하나의 그룹으로 묶어 주고, MAX() 함수는 각 그룹 내에서 해당 열의 최댓값을 계산합니다. 참고로 NULL 값은 MAX() 연산 시 자동으로 무시되므로, 각 열에서 실제 값이 존재하는 데이터 중 가장 큰 값이 최종 결과로 반환됩니다. 이처럼 두 기능을 조합하면 분산된 데이터를 손쉽게 통합하여 조회할 수 있습니다.