언어 AI 가이드

최대 한계 관련성

MMR(최대 주변 관련성)은 결과의 관련성과 이미 선택한 결과와의 차이점의 균형을 맞추는 재순위 방법입니다.

2분 읽기마지막 업데이트

개요

It matters because pure relevance ranking often returns near-duplicate passages that waste space in a RAG context window.

심층 분석

검색 시스템이 순전히 쿼리 관련성에 따라 문서의 점수를 매길 때 최상위 결과는 중복되는 경우가 많습니다. 즉, 5개의 구절이 모두 같은 내용을 말하고 있습니다. 1998년 Carbonell과 Goldstein이 도입한 MMR은 한 번에 하나씩 결과를 선택하여 이 문제를 해결합니다. 각 단계에서 가중치 혼합을 최대화하는 후보를 선택합니다. 즉, 람다에 쿼리와의 관련성을 곱하고 이미 선택된 항목과의 최대 유사성을 빼기(1 - 람다)에 곱합니다. 1에 가까운 람다는 순수한 관련성을 선호합니다. 0에 가까울수록 다양성을 선호합니다. 검색 증강 생성에서 MMR은 다양한 청크 세트를 가져오는 데 널리 사용되므로 언어 ​​모델은 동일한 사실이 반복되는 대신 보완적인 증거를 확인하여 컨텍스트를 확대하지 않고 적용 범위를 향상시킵니다.

기술적 통찰력

MMR은 탐욕적이고 반복적인 알고리즘입니다. 관련성과 문서 간 유사성은 일반적으로 임베딩 벡터 간의 코사인 유사성으로 계산됩니다. 채점 공식은 다음과 같습니다. [lambda * sim(doc, query) - (1 -lamda) * max sim(doc, selected) ]의 나머지 문서에 대한 MMR = argmax입니다. 매 라운드마다 증가하는 선택된 세트에 대해 재평가하기 때문에 순서에 따라 다르며 n 후보의 k 선택에 대해 대략 O(k*n) 유사성 비교로 실행됩니다.

전략적 영향

속도와 규모

일관성을 유지하면서 언어 워크플로를 더 빠르게 진행할 수 있습니다.

접근 및 도달

언어와 의사소통 스타일 전반에 걸쳐 접근성을 확장합니다.

더 명확한 결정들

자동화가 반복을 처리하는 동안 팀은 판단에 더 많은 시간을 할애할 수 있습니다.

최대 한계 관련성의 미래

MMR은 LangChain 및 Chroma와 같은 벡터 데이터베이스 클라이언트에서 경량 기본값으로 유지되며 한 줄 검색 모드로 제공됩니다. 미래 시스템은 학습된 다양성 목표, 클러스터 기반 선택, 코사인 거리보다 더 의미론적으로 참신함을 판단하는 크로스 인코더 리랭커와 점점 더 결합됩니다. 컨텍스트 창이 커짐에 따라 공간 절약에서 진정으로 보완적인 증거를 큐레이팅하고 원시 용량이 풍부한 경우에도 MMR과 같은 다양성 인식 선택을 관련성 있게 유지하는 것으로 강조점이 이동합니다.

실제 구현

RAG 챗봇은 MMR 검색을 사용하므로 상위 5개 청크는 동일한 단락의 5개 의역 대신 정책의 다양한 측면을 다룹니다.

연구 요약 도구는 MMR을 적용하여 중복을 최소화하는 구절을 선택하여 더 광범위하고 덜 반복적인 요약을 생성합니다.

뉴스 애그리게이터는 MMR을 사용하여 기사 순위를 매겨 10개의 매체에서 하나의 뉴스를 반복하는 대신 이벤트에 대한 다양한 보도를 표시합니다.

LangChain의 벡터 저장소 검색기는 반환된 문서를 다양화하기 위해 fetch_k 및lambda_mult와 함께 search_type='mmr'을 노출합니다.

위험 및 가드레일

환각 사실은 보고서, 지원 흐름 또는 연구 결과에 조용히 포함될 수 있습니다.

신속한 민감도는 유사한 요청 간에 일관되지 않은 결과를 초래할 수 있습니다.

액세스 제어가 약한 경우 민감한 텍스트 데이터가 노출될 수 있습니다.

구현 로드맵

1

출시 전에 출력 형식, 톤, 품질 표준을 정의하세요.

2

정확성이 중요할 때마다 신뢰할 수 있는 출처를 통해 대응하세요.

3

고위험 결과물에 대한 인적 검토 체크포인트를 유지합니다.

4

실패 패턴을 추적하고 프롬프트나 워크플로를 정기적으로 재교육하세요.

계속 탐색하세요

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Maximum Marginal Relevance quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

퀴즈 시작

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

자주 묻는 질문

What is Maximum Marginal Relevance?

MMR(최대 주변 관련성)은 결과의 관련성과 이미 선택한 결과와의 차이점의 균형을 맞추는 재순위 방법입니다. 순수 관련성 순위는 종종 RAG 컨텍스트 창에서 공간을 낭비하는 거의 중복된 구절을 반환하기 때문에 중요합니다.

MMR이 해결하도록 설계된 주요 문제는 무엇입니까?

MMR은 참신함을 보상함으로써 본질적으로 동일한 많은 결과를 표면화하기 위해 관련성만 순위를 매기는 경향을 다룹니다.

MMR 공식에서 1에 가까운 람다 값은 무엇을 강조합니까?

람다 가중치 관련성 1에 가까울수록 관련성 용어가 지배적이며, 0에 가까울수록 다양성(낮은 유사성) 용어가 지배적입니다.

MMR은 결과를 어떻게 선택합니까?

MMR은 탐욕스러운 반복 방법입니다. 각 선택은 이미 선택한 항목과의 최대 유사성을 뺀 관련성을 최대화합니다.

텍스트 임베딩을 위해 MMR 내에서 가장 일반적으로 사용되는 유사성 측정은 무엇입니까?

임베딩 벡터 간의 코사인 유사성은 MMR의 쿼리 관련성과 문서 간 비교를 위한 표준 선택입니다.

MMR이 RAG(검색 증강 생성)에 특히 유용한 이유는 무엇입니까?

MMR은 검색된 청크를 다양화함으로써 모델이 동일한 사실이 반복되는 대신 다양한 증거를 볼 수 있도록 지원하여 적용 범위를 향상시킵니다.