MySQL에서 특정 텍스트의 발생 횟수 세기
MySQL에서 특정 텍스트가 테이블에 몇 번 나타나는지 확인하려면 COUNT() 집계 함수와 IF() 함수를 함께 사용하면 됩니다. 개념을 쉽게 이해할 수 있도록 예제 테이블을 만들어 단계별로 살펴보겠습니다.
1단계: 테이블 생성
먼저 다음 쿼리로 테이블을 생성합니다.
mysql> create table CountOccurrencesDemo
-> (
-> Id int NOT NULL AUTO_INCREMENT PRIMARY KEY,
-> TechnicalSubject varchar(100)
-> );
Query OK, 0 rows affected (0.68 sec)
2단계: 샘플 데이터 삽입
INSERT 명령을 사용해 테이블에 여러 개의 레코드를 추가합니다.
mysql> insert into CountOccurrencesDemo(TechnicalSubject) values('Java');
Query OK, 1 row affected (0.14 sec)
mysql> insert into CountOccurrencesDemo(TechnicalSubject) values('MongoDB');
Query OK, 1 row affected (0.13 sec)
mysql> insert into CountOccurrencesDemo(TechnicalSubject) values('MySQL');
Query OK, 1 row affected (0.16 sec)
mysql> insert into CountOccurrencesDemo(TechnicalSubject) values('MySQL');
Query OK, 1 row affected (0.10 sec)
mysql> insert into CountOccurrencesDemo(TechnicalSubject) values('MySQL');
Query OK, 1 row affected (0.07 sec)
mysql> insert into CountOccurrencesDemo(TechnicalSubject) values('Java');
Query OK, 1 row affected (0.15 sec)
mysql> insert into CountOccurrencesDemo(TechnicalSubject) values('Java');
Query OK, 1 row affected (0.10 sec)
mysql> insert into CountOccurrencesDemo(TechnicalSubject) values('Java');
Query OK, 1 row affected (0.09 sec)
mysql> insert into CountOccurrencesDemo(TechnicalSubject) values('Java');
Query OK, 1 row affected (0.11 sec)
mysql> insert into CountOccurrencesDemo(TechnicalSubject) values('MongoDB');
Query OK, 1 row affected (0.21 sec)3단계: 전체 레코드 조회
SELECT 문으로 테이블에 저장된 모든 레코드를 확인합니다.
mysql> select *from CountOccurrencesDemo;
실행 결과는 다음과 같습니다.
+----+------------------+
| Id | TechnicalSubject |
+----+------------------+
| 1 | Java |
| 2 | MongoDB |
| 3 | MySQL |
| 4 | MySQL |
| 5 | MySQL |
| 6 | Java |
| 7 | Java |
| 8 | Java |
| 9 | Java |
| 10 | MongoDB |
+----+------------------+
10 rows in set (0.00 sec)
4단계: 텍스트 발생 횟수 카운트 쿼리 실행
이제 COUNT()와 IF()를 조합하여 'Java', 'MySQL', 'MongoDB'가 각각 몇 번 등장하는지 한 번의 쿼리로 확인합니다.
mysql> select count(if(tbl.TechnicalSubject LIKE '%Java%',1,null)) as JavaOccurrence,
-> count(if(tbl.TechnicalSubject LIKE '%MySQL%',1,null)) as MySQLOccurrence,
-> count(if(tbl.TechnicalSubject LIKE '%MongoDB%',1,null)) as MongoDBOccurrence
-> from CountOccurrencesDemo tbl;
실행 결과는 다음과 같습니다.
+----------------+-----------------+-------------------+
| JavaOccurrence | MySQLOccurrence | MongoDBOccurrence |
+----------------+-----------------+-------------------+
| 5 | 3 | 2 |
+----------------+-----------------+-------------------+
1 row in set (0.05 sec)
쿼리 동작 원리
이 쿼리가 작동하는 이유는 다음과 같습니다.
- IF(조건, 1, null): 조건이 참이면 1을 반환하고, 거짓이면 NULL을 반환합니다.
- COUNT(): NULL 값은 무시하고 숫자 값만 세기 때문에, 조건을 만족하는 행의 개수만 정확히 계산됩니다.
참고: CASE 문을 사용한 대체 방법
IF() 대신 CASE 문을 사용해도 동일한 결과를 얻을 수 있으며, 가독성이 더 좋다는 장점이 있습니다.
SELECT
SUM(CASE WHEN TechnicalSubject LIKE '%Java%' THEN 1 ELSE 0 END) AS JavaOccurrence,
SUM(CASE WHEN TechnicalSubject LIKE '%MySQL%' THEN 1 ELSE 0 END) AS MySQLOccurrence,
SUM(CASE WHEN TechnicalSubject LIKE '%MongoDB%' THEN 1 ELSE 0 END) AS MongoDBOccurrence
FROM CountOccurrencesDemo;
이처럼 COUNT() + IF() 또는 SUM() + CASE 조합을 활용하면 여러 텍스트의 발생 횟수를 별도의 쿼리 없이 한 번에 집계할 수 있습니다.