MySQL에서 URL의 일부를 추출하려면 SUBSTRING_INDEX() 함수를 사용하면 됩니다. 이 함수는 구분자를 기준으로 문자열을 나누고, 지정한 위치에 해당하는 부분을 반환합니다.
아래에서 테이블 생성부터 실제 추출까지 단계별로 살펴보겠습니다.
1단계: 테이블 생성
먼저 URL을 저장할 테이블을 생성합니다.
mysql> create table DemoTable
(
Id int NOT NULL AUTO_INCREMENT PRIMARY KEY,
URL text
);
Query OK, 0 rows affected (0.53 sec)
2단계: 샘플 데이터 삽입
INSERT 명령을 사용하여 테이블에 레코드를 추가합니다.
mysql> insert into DemoTable(URL) values('https:\www.example.com\homepage');
Query OK, 1 row affected (0.27 sec)
mysql> insert into DemoTable(URL) values('https:\www.onlinetest.com\welcome\indexpage');
Query OK, 1 row affected (0.12 sec)3단계: 저장된 데이터 확인
SELECT 문으로 테이블의 모든 레코드를 조회합니다.
mysql> select *from DemoTable;
실행 결과는 다음과 같습니다. 여기서 슬래시가 하나만 보이는 이유는 MySQL이 내부적으로 결과에서 슬래시 하나를 제거하기 때문입니다.
+----+---------------------------------------------+
| Id | URL |
+----+---------------------------------------------+
| 1 | https:\www.example.com\homepage |
| 2 | https:\www.onlinetest.com\welcome\indexpage |
+----+---------------------------------------------+
2 rows in set (0.00 sec)
4단계: SUBSTRING_INDEX()로 URL 일부 추출
이제 SUBSTRING_INDEX() 함수를 사용하여 URL에서 마지막 부분(페이지명)을 추출합니다. 세 번째 인자로 -1을 지정하면 구분자를 기준으로 오른쪽 끝에 있는 문자열을 가져옵니다.
mysql> select substring_index(URL,'\',-1) from DemoTable;
실행 결과는 다음과 같습니다.
+------------------------------+
| substring_index(URL,'\',-1) |
+------------------------------+
| homepage |
| indexpage |
+------------------------------+
2 rows in set (0.00 sec)
SUBSTRING_INDEX() 함수 핵심 정리
SUBSTRING_INDEX(str, delim, count) 형태로 사용하며, count 값에 따라 동작이 달라집니다.
- 양수(count > 0): 구분자를 기준으로 왼쪽에서부터 해당 개수만큼 남긴 문자열을 반환합니다.
- 음수(count < 0): 구분자를 기준으로 오른쪽에서부터 해당 개수만큼 남긴 문자열을 반환합니다.
- 구분자를 찾지 못한 경우: 원본 문자열 전체가 그대로 반환됩니다.
예를 들어 도메인만 추출하고 싶다면 substring_index(substring_index(URL,'\',2),'\',-1)처럼 함수를 중첩하여 활용할 수도 있습니다.