한국어 파인튜닝된 SPLADE 기반 Neural Sparse 모델과 Amazon OpenSearch 하이브리드 검색 벤치마크 | Amazon Web Services
Benchmarking a Korean fine-tuned SPLADE-based Neural Sparse Model and Amazon OpenSearch Hybrid Search | Amazon Web Services

TL;DR AI
1분핵심 요약
AWS가 Amazon OpenSearch Service에서 한국어용 SPLADE v3 스타일 신경 희소 인코더를 벤치마크했다.
이번 연구는 MIRACL-ko 기준에서 BM25, Titan Embeddings V2, 하이브리드 검색을 함께 비교했다.
한국어 질의에서 어휘 기반, 밀집 임베딩, 신경 희소 검색의 성능과 효율성 차이가 드러났다.
실제 OpenSearch 환경에서 인덱싱과 랭킹 전략을 고를 때 참고할 실용적 기준을 제시한다.
