두 테이블을 비교하여 한쪽에 존재하지 않는 누락된 ID를 찾으려면 서브쿼리(subquery)와 함께 NOT IN 연산자를 사용하면 됩니다. 기본적인 구문은 다음과 같습니다.
SELECT yourFirstTableName.yourIdColumnName FROM yourFirstTableName WHERE yourIdColumnName NOT IN(SELECT yourSecondTableName.yourIdColumnName FROM yourSecondTableName);
위 구문이 실제로 어떻게 동작하는지 이해하기 위해 샘플 데이터가 포함된 테이블을 직접 만들어 보겠습니다.
첫 번째 테이블(First_Table) 생성
먼저 첫 번째 테이블을 생성하는 쿼리입니다.
mysql> create table First_Table
-> (
-> Id int
-> );
Query OK, 0 rows affected (0.88 sec)레코드 삽입
INSERT 명령을 사용하여 테이블에 몇 개의 레코드를 삽입합니다.
mysql> insert into First_Table values(1); Query OK, 1 row affected (0.68 sec) mysql> insert into First_Table values(2); Query OK, 1 row affected (0.29 sec) mysql> insert into First_Table values(3); Query OK, 1 row affected (0.20 sec) mysql> insert into First_Table values(4); Query OK, 1 row affected (0.20 sec)
레코드 조회
SELECT 문으로 테이블의 모든 레코드를 확인합니다.
mysql> select *from First_Table;
실행 결과는 다음과 같습니다.
+------+ | Id | +------+ | 1 | | 2 | | 3 | | 4 | +------+ 4 rows in set (0.00 sec)
두 번째 테이블(Second_Table) 생성
이번에는 비교 대상이 될 두 번째 테이블을 생성합니다.
mysql> create table Second_Table
-> (
-> Id int
-> );
Query OK, 0 rows affected (0.60 sec)레코드 삽입 및 조회
두 번째 테이블에도 INSERT 명령으로 레코드를 삽입한 뒤 전체 레코드를 확인합니다.
mysql> insert into Second_Table values(2); Query OK, 1 row affected (0.19 sec) mysql> insert into Second_Table values(4); Query OK, 1 row affected (0.20 sec) mysql> select *from Second_Table;
실행 결과는 다음과 같습니다.
+------+ | Id | +------+ | 2 | | 4 | +------+ 2 rows in set (0.00 sec)
두 테이블을 비교하여 누락된 ID 반환하기
이제 NOT IN 연산자와 서브쿼리를 활용해 첫 번째 테이블에는 있지만 두 번째 테이블에는 없는 ID를 조회하는 쿼리입니다.
mysql> select First_Table.Id from First_Table where
-> First_Table.Id NOT IN(select Second_Table.Id from Second_Table);실행 결과는 다음과 같습니다.
+------+ | Id | +------+ | 1 | | 3 | +------+ 2 rows in set (0.00 sec)
결과를 보면 First_Table에는 1, 2, 3, 4의 ID가 존재하지만, Second_Table에는 2와 4만 존재합니다. 따라서 위 쿼리는 Second_Table에 없는 1과 3, 즉 누락된 ID를 정확히 반환합니다.
참고: LEFT JOIN을 활용한 대안
대량의 데이터를 다룰 때는 NOT IN보다 LEFT JOIN 방식이 더 나은 성능을 보일 수 있습니다. 동일한 결과를 얻는 쿼리는 다음과 같습니다.
mysql> SELECT f.Id FROM First_Table f
-> LEFT JOIN Second_Table s ON f.Id = s.Id
-> WHERE s.Id IS NULL;두 방식 모두 누락된 ID를 찾는 데 유용하므로, 데이터 크기와 인덱스 상황에 맞게 적절한 방법을 선택하시기 바랍니다.