DevLog

엔지니어링 블로그를 한 곳에서 탐색하고, 최근 발행 흐름을 빠르게 파악할 수 있는 서비스 입니다.

Quick Links

  • Latest Feed
  • Engineering Directory

Support

  • 소개
  • 개인정보처리방침

Contribute

  • 원하는 블로그 추가 (준비 중)
  • Feedback

© 2026 DevLog Inc. All rights reserved.

본 사이트는 공개 RSS 피드를 통해 콘텐츠를 수집하며, 모든 콘텐츠의 저작권은 원저작자에게 있습니다.

Back to Feed
Read Original

Contents

Continue Reading

  • More from 라인
#AI

임베딩 안정화로 검색 리랭킹의 콜드 스타트 문제를 해결하다: LINE Part Time Jobs 적용 사례

임베딩 안정화로 검색 리랭킹의 콜드 스타트 문제를 해결하다: LINE Part Time Jobs 적용 사례
01

Summary

재학습할 때마다 바뀌는 임베딩이 고민이라면? LINE이 매출 6.5%를 올린 '공간 정렬'의 마법

SVD와 직교 Procrustes로 모델 구조 변경 없이 콜드 스타트와 데이터 드리프트를 한 번에 해결한 실전 노하우

매달 공고가 바뀌는 역동적인 채용 서비스에서 검색 품질을 유지하기 위한 LINE 엔지니어들의 고군분투기를 담았습니다. 모델을 새로 학습할 때마다 뒤틀리는 임베딩 공간을 수학적으로 고정하여, 데이터 불일치 문제를 해결하고 검색 리랭킹의 정확도를 극대화한 기술적 여정을 소개합니다.

  • 01모델 구조 수정 없이 후처리만으로 임베딩 공간의 연속성을 확보하는 효율적인 접근법 제시
  • 02직교 Procrustes 변환을 활용해 임베딩 간의 거리와 내적 구조를 보존하며 정렬 성공
  • 03대용량 분산 처리를 위해 QR 분해 대신 숄레스키 분해를 적용한 엔지니어링 최적화
  • 04장기적 사용자 선호를 포착하여 검색 화면을 넘어 서비스 전체 매출 성장에 기여
  • 05학습과 추론 시점의 모델 버전 불일치 문제를 해결하여 운영 안정성 대폭 강화

+RECOMMENDATION

잦은 데이터 갱신으로 콜드 스타트를 겪고 있거나, 주기적인 모델 재학습으로 인한 피처 드리프트 문제를 해결하고 싶은 머신러닝 엔지니어에게 필독을 권합니다.

The Problem

아르바이트 공고가 월 단위로 대량 교체되면서 리랭킹 모델 학습 데이터가 부족해지는 콜드 스타트 문제와 2타워 모델 재학습 시마다 임베딩 공간이 변하는 비정상성(Non-stationarity) 문제가 발생했습니다. 이로 인해 학습과 추론 시점의 데이터 불일치가 발생하여 실시간 검색 정렬 성능이 저하되는 한계가 있었습니다.

The Solution

RecSys '25에서 제안된 '직교 저차원 임베딩 안정화' 기법을 도입하여, 저차원 SVD와 직교 Procrustes 변환을 통해 당일의 임베딩 공간을 전일의 기준 공간에 맞춰 정렬했습니다. 대규모 데이터 처리를 위해 Apache Spark를 활용하고 숄레스키 분해를 통해 계산 효율성을 극대화한 후처리 파이프라인을 구축했습니다.

The Result

임베딩 안정화 도입 후 1개월이 지나도 벡터 유사도가 0.87 수준으로 유지되었으며, 오프라인 평가에서 전환 nDCG가 9.0% 향상되었습니다. 실제 온라인 A/B 테스트 결과, 서비스 전체 KPI 4.7% 및 매출 6.5% 상승이라는 유의미한 비즈니스 성과를 달성했습니다.

Trade-off

임베딩 공간의 연속성을 유지하기 위해 전일의 안정화된 데이터를 순차적으로 참조해야 하는 시간적 의존성이 발생하며, 검색 화면 내의 즉각적인 KPI 개선보다는 서비스 전체의 장기적인 사용자 행동 변화에 더 큰 영향을 미치는 특성을 보입니다.

03

Key Concepts

Concept · 01

2타워 모델(Two-Tower Model)

사용자와 아이템을 각각 독립적인 신경망으로 인코딩하여 임베딩을 생성한 후, 두 벡터의 내적이나 유사도로 점수를 계산하는 아키텍처입니다.

  • LINE Part Time Jobs에서 사용자 선호를 포착하여 초기 리랭킹 점수를 계산하는 기반 모델로 사용되었습니다.
Concept · 02

직교 Procrustes(Orthogonal Procrustes)

두 행렬 사이의 유클리드 거리를 최소화하는 직교 행렬을 찾아 공간을 회전 또는 반전시켜 정렬하는 수학적 기법입니다.

  • 당일 생성된 임베딩 공간을 전일의 공간과 일치시켜 시간의 흐름에 따른 임베딩의 연속성을 보장하는 데 활용되었습니다.
Concept · 03

숄레스키 분해(Cholesky Decomposition)

양의 정식 행렬을 하삼각 행렬과 그 전치 행렬의 곱으로 분해하여 행렬 연산을 단순화하는 수치 해석 방법입니다.

  • Apache Spark 환경에서 저차원 SVD 계산 시 QR 분해보다 효율적으로 상삼각 행렬을 추출하기 위해 도입되었습니다.
Continue reading · same source

라인More from 라인

View all posts from 라인
  • LLM Wiki: 코드 기준으로 자동 최신화되는 도메인 지식 SSOT 만들기

    LLMSSOTGitHub Actions
    2일 전
  • 일본어 상품 검색 정확도 높이기: Elasticsearch + Kuromoji에서 OpenSearch + Sudachi로

    OpenSearchSudachiElasticsearch
    1주 전
  • 보안 업무를 위한 AI 에이전트 플랫폼 「SAGE」 개발기 1편: 판단은 사람에게 남기는 설계

    LLMMulti-AgentRAG
    1주 전
  • 개인 AI 활용의 다음 단계는 무엇인가 - LY Corporation에서 AIDD 워크숍을 통해 살펴본 AIDD 조직 도입의 조건

    AIDDAI AgentDeveloper Productivity
    3주 전
  • Grafana에서 자연어로 장애 원인을 분석하기: LLM 에이전트 기반 SRELens 개발기

    GrafanaLLM AgentObservability
    1개월 전

Source

라인
라인
Engineering Blog

Published · June 26, 2026

Topics

Embedding StabilizationCold Start ProblemTwo-Tower ModelSingular Value DecompositionProcrustes Alignment