pile·
AI / ML·vercel-blogVercel Blog·

Vercel AI Gateway에서 OpenResponses API 지원 시작

Vercel AI Gateway가 OpenAI 주도의 오픈소스 표준인 OpenResponses API의 런치 파트너로 참여했다. 텍스트 생성, 스트리밍, 툴 호출, 비전, 추론을 여러 AI 제공자에 걸쳐 단일 인터페이스로 처리할 수 있으며, 제공자 장애 시 자동 폴백도 지원한다.

핵심 포인트
  • OpenResponses API는 멀티 프로바이더 AI 요청을 통합하는 오픈소스 스펙이다 — OpenAI의 Responses API를 개방해 여러 게이트웨이가 지원할 수 있게 한다.
  • Vercel AI Gateway가 이 스펙의 첫 번째 런치 파트너다. 엔드포인트는 ai-gateway.vercel.sh/v1/responses.
  • 모델은 anthropic/claude-sonnet-4.5, zai/glm-4.7 처럼 {provider}/{model} 형식으로 지정한다.
  • 폴백 체인으로 제공자 장애 시 자동 전환이 가능하다.
  • SSE 스트리밍, 구조화된 툴 호출, 이미지 입력, effort 레벨 추론을 모두 지원한다.
상세 정리
  • 배경: OpenResponses는 OpenAI가 자사 Responses API 스펙을 오픈소스로 공개한 표준으로, 게이트웨이들이 동일 인터페이스를 지원하면 LLM 제공자 교체 시 코드 변경이 최소화된다.
  • 통합 위치: Vercel AI Gateway가 런치 파트너로 참여해 ai-gateway.vercel.sh/v1/responses 엔드포인트에서 OpenResponses 스펙을 수용한다.
  • 인증: Vercel AI Gateway 키를 Authorization 헤더에 넣어 인증하고, 모델은 프로바이더 접두사 형식으로 지정한다.
  • 텍스트/스트리밍: SSE(서버-전송 이벤트)로 실시간 토큰 스트리밍을 지원한다.
  • 툴 호출: 구조화된 함수 인수를 포함한 툴 호출 방식을 지원한다. zai/glm-4.7 모델 예제가 제공된다.
  • 비전: 이미지 입력을 통한 멀티모달 요청을 지원한다.
  • 추론: effort 레벨로 추론 깊이를 조정할 수 있다. 고품질 추론이 필요한 복잡한 작업에 유용하다.
  • 폴백 체인: provider_fallback_chains 필드로 모델 우선순위를 지정하면 첫 번째 제공자 장애 시 다음 모델로 자동 전환한다.
  • 코드 예제: 기본 텍스트 생성 요청과 툴 호출 두 가지 예제가 제공된다.
  • 스펙 참조: openresponses.org에서 공식 스펙 전문을 확인할 수 있다.
왜 읽나여러 LLM 제공자를 단일 API로 통합하고 싶은 AI/백엔드 개발자에게. OpenResponses 표준을 통한 멀티 프로바이더 폴백 구현 방법을 코드 예제와 함께 볼 수 있다.
vercel-blog
Vercel Blog 블로그
원문은 여기서 이어서 읽을 수 있어요
원문 읽기
읽음 (0)

이 글과 비슷한

  1. AI / ML·LY CorporationLY Corporation·

    Grafana에서 자연어로 장애 원인을 분석하기: LLM 에이전트 기반 SRELens 개발기

    LY Corporation Home SRE 팀이 장애 분석 시 메트릭·로그·트레이스가 각각 다른 화면에 흩어져 있는 문제를 해결하기 위해 Grafana 플러그인 SRELens를 개발했다. SRELens는 LLM 에이전트가 자연어 질의를 받아 실제 관측성 데이터를 조회하고, 근거와 함께 장애 원인 후보를 정리해 주는 도구다. LGTM-P 스택(Loki·Grafana·Tempo·Mimir·Pyroscope)과 FlavaMCP 게이트웨이를 통합해 단일 채팅 인터페이스에서 멀티시그널 분석이 가능하다.

    #llm-app#mcp#observability+2