pile·
백엔드·다나와다나와·

다나와 검색의 색인 최적화 사례

문제다나와 검색은 에누리 통합으로 10억 건 넘는 상품 데이터를 다루게 되면서 Elasticsearch CPU가 100%에 닿고 힙 부족·색인 요청 거절·정합성 문제가 동시에 터졌다.
접근건 바이 건 색인을 BulkProcessor API로 묶고 0.2초 간격 CPU 모니터링 기반 백프레셔를 추가, Express 프록시로 12대 색인 서버의 중복 조회를 정리하고 데이터 노드와 코디네이터 노드를 분리해 라우팅을 떼어냈다.
결과피크 CPU가 70%에서 30%대로 떨어지고 운영 환경 CPU가 80% 이하로 유지됐으며, 1,000만 건 14분 처리 성능을 유지하면서 연결 끊김 문제까지 해소됐다.
다나와
다나와 블로그
원문은 여기서 이어서 읽을 수 있어요
원문 읽기
읽음 (0)

이 글과 비슷한

  1. 백엔드·twilio-engTwilio Engineering·

    Programmable Messaging에서 Verify API로 마이그레이션하기

    Twilio의 Programmable Messaging API로 자체 OTP 솔루션을 운영하던 서비스가 Verify API로 전환하는 방법을 코드 예시와 함께 설명한다. Verify는 OTP 전송·검증을 위한 전용 API로, 전화번호 구매, 토큰 생성, DB 저장·만료 관리를 내부에서 처리해 개발자가 직접 구현할 코드를 크게 줄인다.

    요약 이어보기
    #authentication#twilio#sms+2
  2. 백엔드·포스타입포스타입·

    포스타입이 개인화 추천을 하는 방법 2부

    포스타입 백엔드 엔지니어가 벡터 기반 개인화 추천 시스템을 실제 운영하며 맞닥뜨린 성능 장애와 용량 문제를 해결한 과정을 담은 2부다. 수백만 개의 벡터 KNN 검색이 피크 시간대에 전체 Elasticsearch 검색 성능을 흔드는 문제부터 클러스터 OOM 사태까지, 쿼리 최적화와 인프라 분리 두 가지 경로로 근본 해결에 이른다.

    요약 이어보기
    #elasticsearch#vector-search#recommendation-system+2
  3. 백엔드·포스타입포스타입·

    포스타입이 개인화 추천을 하는 방법 1부

    포스타입이 태그 기반 추천의 한계를 극복하고 벡터 임베딩 기반 개인화 추천 시스템을 구축한 과정을 담은 1부다. 유사한 콘텐츠가 다른 용어를 쓰거나 동일한 태그가 전혀 다른 톤의 콘텐츠를 가리키는 문제를 임베딩 벡터로 해결하고, OpenSearch의 HNSW ANN 검색으로 수백만 벡터를 실시간 검색하는 시스템을 구축해 구매율 15% 향상을 달성했다.

    요약 이어보기
    #opensearch#vector-search#recommendation-system+2