AI 2026.05.05 · 11 min
Advanced Retrieval Rag Deep Dive · 3
Cross-Encoder, ColBERT, 그리고 검색의 Pareto 경계
Full attention의 정확성과 벡터 인덱싱의 속도를 동시에 가질 수 없다는 근본 제약부터, Late Interaction이 그 경계를 어떻게 밀어내는지 추적한다.
총 1개의 글
Full attention의 정확성과 벡터 인덱싱의 속도를 동시에 가질 수 없다는 근본 제약부터, Late Interaction이 그 경계를 어떻게 밀어내는지 추적한다.