Computer >> 컴퓨터 >  >> 프로그래밍 >> 프로그래밍

메모리 기반 추론(MBR)이란? 주요 응용 분야와 장단점

인간은 과거의 경험 속에서 적절한 사례를 떠올리는 능력을 바탕으로 추론합니다. 감염을 진단하는 의사, 보험 사기 청구를 적발하는 심사 담당자, 송로버섯(morel)을 찾아내는 버섯 채집가는 모두 동일한 절차를 따릅니다.

이들은 먼저 경험 속에서 유사한 사례를 인식한 뒤, 그 사례들에 대해 쌓아온 지식을 현재 직면한 문제에 적용합니다. 이것이 바로 메모리 기반 추론(Memory-Based Reasoning, MBR)의 핵심입니다. 즉, 알려진 데이터베이스를 검색하여 새로운 데이터와 유사한 사전 분류된 레코드를 찾아내고, 이렇게 발견된 '이웃(neighbor)'들을 활용해 분류와 계산을 수행하는 것입니다.

메모리 기반 추론의 주요 응용 분야

1. 사기 탐지

새로운 사기 사례는 대부분 이미 알려진 사기 사례와 유사한 양상을 보입니다. MBR은 이러한 유사성을 활용해 새로운 사기 시도를 발견하고, 추가 조사가 필요한 건으로 표시할 수 있습니다.

2. 고객 반응 예측

마케팅 제안에 반응할 가능성이 높은 고객은 과거에 긍정적으로 반응했던 고객과 비슷한 특징을 지니는 경우가 많습니다. MBR을 활용하면 다음으로 반응 가능성이 높은 고객을 손쉽게 식별할 수 있습니다.

3. 의료 처방

특정 환자에게 효과적인 치료법은 아마도 비슷한 환자들에게 가장 좋은 결과를 가져다준 치료법일 것입니다. MBR은 최상의 결과를 만들어낸 치료법을 찾아내는 데 도움을 줍니다.

4. 자유 응답 텍스트 분류

미국 인구조사 설문의 직업·업종 항목 응답이나 고객 불만 사항처럼 자유 형식의 텍스트 응답은 정해진 코드 집합으로 분류되어야 합니다. MBR은 자유 텍스트를 처리하고 적절한 코드를 부여할 수 있습니다.

메모리 기반 추론의 강점

MBR의 첫 번째 강점은 정보 활용 능력입니다. 많은 데이터 마이닝 기법과 달리 MBR은 데이터의 구조에 구애받지 않습니다. 오직 두 가지 연산만 요구할 뿐입니다. 하나는 임의의 두 데이터 간 거리를 계산할 수 있는 거리 함수(distance function)이고, 다른 하나는 여러 이웃들의 결과를 결합하여 하나의 답을 도출하는 결합 함수(combination function)입니다.

이러한 함수들은 지리적 영역, 이미지, 자유 텍스트처럼 다른 분석 기법으로 다루기 어려운 복잡하거나 특수한 데이터 유형을 가진 레코드에 대해서도 정의할 수 있습니다.

두 번째 강점은 적응력입니다. 단순히 새로운 레코드를 과거 데이터베이스에 추가하는 것만으로 MBR은 새로운 요소와 기존 요소의 새로운 정의를 학습할 수 있습니다. 또한 긴 학습 시간을 들이거나 유입되는 데이터를 특정 형식으로 가공하는 작업 없이도 우수한 결과를 만들어냅니다.

메모리 기반 추론의 한계

이러한 장점에는 대가가 따릅니다. MBR은 리소스를 많이 소모하는 경향이 있습니다. 이웃을 찾으려면 방대한 양의 과거 데이터를 상시 사용할 수 있어야 하기 때문입니다. 또한 새로운 데이터를 분류할 때 가장 유사한 이웃을 찾기 위해 전체 과거 데이터를 처리해야 할 수 있는데, 이는 이미 학습된 신경망이나 이미 구축된 결정 트리를 사용하는 것보다 훨씬 느린 과정입니다.

더불어 적절한 거리 함수와 결합 함수를 찾는 일 역시 결코 쉽지 않습니다. 이 과정에는 상당한 시행착오와 직관이 필요합니다.