pile·
AI / ML·vercel-blogVercel Blog·

Vercel AI Gateway에서 OpenAI 오픈 웨이트 모델 gpt-oss-20b·120b 사용하기

Vercel AI Gateway에 OpenAI의 오픈 웨이트 추론 모델 gpt-oss-20b와 gpt-oss-120b가 추가됐다. AI SDK v5의 streamText에서 모델명만 지정하면 Groq, Baseten, Cerebras, HuggingFace 등 다양한 제공업체를 통해 실행할 수 있다.

핵심 포인트
  • openai/gpt-oss-20b와 openai/gpt-oss-120b 두 오픈 웨이트 추론 모델이 추가됐다.
  • pnpm i ai로 AI SDK v5를 설치하고 streamText에서 모델명을 지정한다.
  • Groq, Baseten, Cerebras, HuggingFace 등 다수 제공업체를 통한 라우팅을 지원한다.
  • BYOK, 관찰성, 자동 재시도·장애 조치가 내장돼 있다.
상세 정리
  • 추가 모델: openai/gpt-oss-20b(20B 파라미터), openai/gpt-oss-120b(120B 파라미터) 오픈 웨이트 추론 모델.
  • 설치: pnpm i ai로 AI SDK v5를 설치한다.
  • 코드 패턴: streamText({ model: 'openai/gpt-oss-120b', prompt: ... }) 형태로 사용한다.
  • 다중 제공업체: Groq, Baseten, Cerebras, HuggingFace 등을 통해 모델을 실행한다.
  • 내장 기능: BYOK, 관찰성, 자동 재시도·장애 조치, 지능형 공급자 라우팅.
  • 리더보드: AI Gateway에서 토큰 처리량 기반 모델 인기도 추적 가능.
왜 읽나Vercel AI SDK에서 OpenAI 오픈 웨이트 추론 모델을 다중 제공업체로 유연하게 실행하려는 개발자에게 모델명과 라우팅 방법을 제공한다.
vercel-blog
Vercel Blog 블로그
원문은 여기서 이어서 읽을 수 있어요
원문 읽기
읽음 (0)

이 글과 비슷한

  1. AI / ML·LY CorporationLY Corporation·

    Grafana에서 자연어로 장애 원인을 분석하기: LLM 에이전트 기반 SRELens 개발기

    LY Corporation Home SRE 팀이 장애 분석 시 메트릭·로그·트레이스가 각각 다른 화면에 흩어져 있는 문제를 해결하기 위해 Grafana 플러그인 SRELens를 개발했다. SRELens는 LLM 에이전트가 자연어 질의를 받아 실제 관측성 데이터를 조회하고, 근거와 함께 장애 원인 후보를 정리해 주는 도구다. LGTM-P 스택(Loki·Grafana·Tempo·Mimir·Pyroscope)과 FlavaMCP 게이트웨이를 통합해 단일 채팅 인터페이스에서 멀티시그널 분석이 가능하다.

    #llm-app#mcp#observability+2