pile·
AI / ML·네이버 DnA네이버 DnA·

누구나 실험할 수 있도록 — 네이버 검색의 셀프서브 A/B 테스트 플랫폼

문제네이버 검색은 실험 양과 서비스 복잡도가 늘면서 실무자가 직접 설계·분석까지 끌고 가는 셀프서브 체계가 필요했고, 좁은 검색 지면 위에서 공정하고 다각적인 성과 측정이 요구됐다.
접근실험 설계부터 모니터링·분석·재실험까지 한 흐름으로 묶은 ABT Portal과 지표 체계를 표준화한 ABT Metric Store, 질의 단위 심화 분석용 MARS·QIP, 그리고 파트너 데이·세미나·런칭 공유회 같은 교육 프로그램을 묶어 운영했다.
결과실험이 일부 전문가의 작업이 아니라 누구나 쓰는 일상의 도구로 자리잡았고, 질의 단위 개선 효과까지 추적할 수 있는 검색 실험 문화가 조직 안에 정착됐다.
네이버 DnA
네이버 DnA 블로그
원문은 여기서 이어서 읽을 수 있어요
원문 읽기
읽음 (0)

이 글과 비슷한

  1. AI / ML·stackoverflow-blogStack Overflow Blog·

    에이전틱 SDLC를 QA 엔지니어링 마인드셋으로 구축하기

    Motorola Solutions의 테스트 엔지니어링 선임 매니저 Suneet Malhotra가 Stack Overflow 팟캐스트에 출연해 MCP(Model Context Protocol) 기반 에이전틱 SDLC 파이프라인 구축과 LLM-as-judge 평가 방법론을 소개했다. QA 엔지니어링 관점을 소프트웨어 개발 생애 전반에 적용하고, 설계 단계 직후 스펙을 강화해 결함 비용을 줄이는 'QA shift-left' 접근을 다룬다.

    요약 이어보기
    #llm-agent#mcp#test-automation+2
  2. AI / ML·LINE EngineeringLINE Engineering·

    보안 업무를 위한 AI 에이전트 플랫폼 「SAGE」 개발기 1편: 판단은 사람에게 남기는 설계

    LY Corporation Security Development Division이 보안 업무용 AI 에이전트 플랫폼 SAGE의 개발 과정을 공개했다. "완전 자동화"와 "도입 미루기" 양 극단 사이에서 "판단은 사람에게 남기는 설계"를 핵심 원칙으로 삼고, 3단계 점진적 도입 전략(AI 보조→에이전트 협업→자동화)을 채택했다. 현재는 1단계를 중심으로 파일럿·실운영 중이다.

    요약 이어보기
    #llm-app#opensearch#mcp+2