단일 토큰 표현을 활용한 효율적인 거대 언어 모델 기반 문서 재순위화 


52권  5호, pp. 395-403, 5월  2025
10.5626/JOK.2025.52.5.395


PDF

  요약

정보 검색 시스템에서 문서 재순위화는 주어진 문서 후보에서 질의와의 적합도(Relevance)를 평가하여 문서의 순위를 재정렬(Reranking)하는 것을 목표로 한다. 최근 거대 언어 모델(Language language models, LLMs)의 폭넓은 자연어 이해 능력을 활용하여 문서의 재순위화 정확도를 획기적으로 개선하였다. 그러나 거대 언어 모델을 활용한 기존 연구들은 재순위화의 정확도 개선에 주로 초점을 두고 있으며, 입력 길이가 지나치게 길어지거나, 반복적인 추론을 요구함에 따라 발생하는 효율성 저하 문제를 간과하였다. 본 연구에서는 기존 모델의 문제점을 해결하기 위해 ListT5++ 모델을 제안한다. 제안 모델은 효율성 개선을 위해서 질의와 단락 간의 관련성을 단일 토큰 임베딩으로 표현하는 방법을 도입하고, 이를 활용하여 디코딩 과정을 최소화한 단일 단계 디코딩 전략을 활용한다. 이를 통해 거대 언어 모델 기반 문서 재순위화의 효율성을 크게 개선한다. 실험 결과, 제안 모델인 ListT5++는 기존 방식과 동일한 수준의 정확도를 유지하는 반면에 추론 지연 시간을 기존 모델 대비 29.4배 단축하였다. 특히, ListT5++은 디코딩 과정에서 입력 문서의 순서에 영향을 받지 않고 문서와 질의의 적합도를 학습함으로써, 강건한 특성을 보이는 장점이 있다.


  통계
2022년 11월부터 누적 집계
동일한 세션일 때 여러 번 접속해도 한 번만 카운트됩니다. 그래프 위에 마우스를 올리면 자세한 수치를 확인하실 수 있습니다.


  논문 참조

[IEEE Style]

J. Na, J. Kwon, E. Choi, J. Lee, "Efficient Large Language Model Based Passage Re-Ranking Using Single Token Representations," Journal of KIISE, JOK, vol. 52, no. 5, pp. 395-403, 2025. DOI: 10.5626/JOK.2025.52.5.395.


[ACM Style]

Jeongwoo Na, Jun Kwon, Eunseong Choi, and Jongwuk Lee. 2025. Efficient Large Language Model Based Passage Re-Ranking Using Single Token Representations. Journal of KIISE, JOK, 52, 5, (2025), 395-403. DOI: 10.5626/JOK.2025.52.5.395.


[KCI Style]

나정우, 권준, 최은성, 이종욱, "단일 토큰 표현을 활용한 효율적인 거대 언어 모델 기반 문서 재순위화," 한국정보과학회 논문지, 제52권, 제5호, 395~403쪽, 2025. DOI: 10.5626/JOK.2025.52.5.395.


[Endnote/Zotero/Mendeley (RIS)]  Download


[BibTeX]  Download



Search




Journal of KIISE

  • ISSN : 2383-630X(Print)
  • ISSN : 2383-6296(Electronic)
  • KCI Accredited Journal

사무국

  • Tel. +82-2-588-9240
  • Fax. +82-2-521-1352
  • E-mail. chwoo@kiise.or.kr