pile·
AI / ML·vercel-blogVercel Blog·

Vercel AI Gateway + Perplexity Search로 모든 모델에 실시간 웹 검색 붙이기

Vercel AI Gateway에서 gateway.tools.perplexitySearch()로 OpenAI·Anthropic·Google 등 어떤 모델 제공자에도 실시간 웹 검색을 붙이는 방법을 설명한다. 네이티브 검색이 없는 모델 보강, 코드 어시스턴트 최신화, 멀티 모델 챗봇 통합, 실시간 모니터링 에이전트 등 네 가지 활용 사례와 함께 1,000 요청당 $5의 비용 구조를 제시한다.

핵심 포인트
  • @ai-sdk/gateway에서 gateway.tools.perplexitySearch()를 임포트해 tools 파라미터로 전달하면 어떤 모델이든 웹 검색을 사용할 수 있다.
  • 모델이 최신 정보가 필요하다고 판단하면 자동으로 웹 검색을 실행하고 결과를 응답에 통합한다.
  • searchDomainFilter로 특정 도메인만, searchRecencyFilter로 최근 N일 결과만 필터링한다.
  • Vercel AI Gateway를 통한 Perplexity 검색 비용은 1,000 요청당 $5, Vercel 추가 마크업 없음.
  • 여러 모델 제공자에 동일한 검색 로직을 적용해 제공자 전환/폴백 시에도 검색 동작이 일관된다.
상세 정리
  • 동작 원리: 모델이 요청을 처리하다 최신 정보가 필요하다고 판단하면 perplexitySearch 툴을 자동 호출하고, 검색 결과를 컨텍스트로 합쳐 응답을 생성한다.
  • 설정: @ai-sdk/gateway에서 gateway 객체의 perplexitySearch()를 generateText나 streamText의 tools 파라미터로 전달한다.
  • searchDomainFilter: 검색 결과를 특정 도메인으로 제한한다. 신뢰할 수 있는 소스에서만 정보를 가져오고 싶을 때 유용하다.
  • searchRecencyFilter: 'day', 'week' 처럼 결과 신선도를 지정한다. 실시간 가격이나 장애 정보 조회에 사용한다.
  • 활용 1 — 네이티브 검색 없는 모델 보강: GLM-4.7처럼 자체 검색이 없는 모델에 웹 검색 능력을 추가한다.
  • 활용 2 — 코드 어시스턴트 최신화: 최신 패키지 버전, 최근 PR, 문서 업데이트를 참조해 구식 권장사항을 방지한다.
  • 활용 3 — 멀티 모델 챗봇: 비용 최적화나 폴백을 위해 여러 모델을 사용하는 조직이 동일한 검색 로직을 모든 제공자에 적용한다.
  • 활용 4 — 실시간 모니터링 에이전트: 가격 변동, 서비스 장애, 공지 추적 시스템에서 최신 웹 정보를 활용한다.
  • 비용: Vercel AI Gateway를 통한 Perplexity 검색은 1,000 요청당 $5. Vercel 추가 마크업 없음.
왜 읽나여러 LLM 제공자를 사용하면서 모든 모델에 실시간 웹 검색을 일관되게 붙이고 싶은 AI/백엔드 개발자에게. 검색 필터 파라미터, 4가지 활용 사례, 비용 구조를 실제 구현 관점에서 볼 수 있다.
vercel-blog
Vercel Blog 블로그
원문은 여기서 이어서 읽을 수 있어요
원문 읽기
읽음 (0)

이 글과 비슷한

  1. AI / ML·LY CorporationLY Corporation·

    Grafana에서 자연어로 장애 원인을 분석하기: LLM 에이전트 기반 SRELens 개발기

    LY Corporation Home SRE 팀이 장애 분석 시 메트릭·로그·트레이스가 각각 다른 화면에 흩어져 있는 문제를 해결하기 위해 Grafana 플러그인 SRELens를 개발했다. SRELens는 LLM 에이전트가 자연어 질의를 받아 실제 관측성 데이터를 조회하고, 근거와 함께 장애 원인 후보를 정리해 주는 도구다. LGTM-P 스택(Loki·Grafana·Tempo·Mimir·Pyroscope)과 FlavaMCP 게이트웨이를 통합해 단일 채팅 인터페이스에서 멀티시그널 분석이 가능하다.

    #llm-app#mcp#observability+2