잠재의미분석 (Latent Semantic Analysis (LSA))

문헌정보학
한 줄 정의: 문헌-용어 행렬에 특이값분해(SVD)와 같은 수학적 차원축소 기법을 적용하여, 용어의 표층적 형태가 달라도 잠재된 의미적 유사성을 포착함으로써 동의어·다의어 문제를 완화하는 정보검색 및 텍스트분석 기법이다.

쉽게 풀면

표면적으로 다른 단어라도 뜻이 비슷하면 서로 연관지어 인식할 수 있도록, 수학적으로 데이터를 압축해서 숨은 의미 관계를 찾아내는 기법이다.

논문에서는 이렇게 쓰입니다

본 연구는 잠재의미분석을 벡터공간모형에 적용하여 동의어 표현의 차이로 인한 검색 누락 문제를 완화하였다.

잠재의미분석이 벡터공간모형의 동의어 문제를 보완하는 데 활용된 실험 사례를 설명하는 문장이다.

주의할 점

잠재의미분석은 대규모 행렬에 대한 특이값분해 연산이 필요해 계산비용이 크므로 매우 큰 문헌집단에는 적용이 제한적일 수 있다.

관련 용어