pile·
AI / ML·vercel-blogVercel Blog·

AI SDK 4.1 — 이미지 생성, 스트림 평활화, 도구 호출 개선

Vercel이 오픈소스 AI SDK 버전 4.1을 출시했다. JavaScript/TypeScript 기반 AI 애플리케이션 개발 툴킷으로, 이번 릴리즈에서 이미지 생성, 스트림 평활화, 도구 호출 개선 등 6개 주요 기능이 추가됐다. Next.js, Svelte 등 주요 웹 프레임워크와 통합되며, 신규 AI 프로바이더 8개도 합류했다.

핵심 포인트
  • generateImage 함수 신설 — Replicate, OpenAI, Google Vertex, Fireworks 모델로 이미지 생성 가능, size/aspectRatio/n(다중 생성)/seed 파라미터 지원
  • smoothStream 함수로 텍스트 스트리밍을 문자/단어/라인 단위로 분리해 자연스러운 출력 구현, 콘텐츠 필터링 가드레일 결합 가능
  • createDataStreamResponse로 RAG 컨텍스트/검색 결과를 LLM 응답 전에 논블로킹 스트리밍
  • 도구 호출에 toolCallId/messages/abortSignal 컨텍스트 추가, experimental_toToolCallRepair로 실패한 호출 자동 복구
  • Google Vertex AI 2.0 개선, DeepSeek/Cerebras/Replicate 등 신규 프로바이더 8개 추가
상세 정리
  • 이미지 생성 API: generateImage 함수 도입, base64/uint8Array 형식 반환. `const { image } = await generateImage({ model: replicate.image('black-forest-labs/flux-1.1-pro-ultra'), prompt: '...' })` 형태의 단순 인터페이스.
  • 멀티 이미지 생성: n 파라미터로 한 번에 여러 이미지 생성, seed 파라미터로 재현 가능한 결과 확보.
  • 스트림 평활화: smoothStream으로 모델 토큰 단위 스트리밍을 단어/라인 단위로 변환해 UI 출력이 자연스럽게 표시됨.
  • 변환 배열 결합: 여러 smoothStream 변환기를 배열로 조합 가능, 보안 필터링과 평활화를 동시에 적용.
  • useChat 지속성 간소화: 채팅 ID를 클라이언트에서 서버로, 응답 메시지 ID를 서버에서 클라이언트로 전달. appendResponseMessages 유틸리티 추가로 메시지 히스토리 영속성 구현 단순화.
  • 논블로킹 데이터 스트리밍: createDataStreamResponse로 LLM 응답 전에 RAG 컨텍스트/검색 결과를 먼저 내려보내고, 메시지에 주석/메타데이터 추가 가능.
  • 도구 호출 컨텍스트 강화: toolCallId(특정 실행 추적), messages(전체 대화 기록), abortSignal(장시간 작업 취소) 3가지 컨텍스트를 도구 핸들러에서 접근 가능.
  • 도구 호출 복구: experimental_toToolCallRepair로 스키마 불일치 시 더 강력한 모델로 재시도 또는 구조화 출력 모델로 인수 재생성.
  • 세분화된 오류 타입: NoSuchToolError(정의 안 된 도구), InvalidToolArgumentsError(스키마 검증 실패), ToolExecutionError(런타임 문제), ToolCallRepairError(복구 실패) 4가지로 분리.
  • 구조화 출력과 도구 결합: experimental_output으로 도구 호출과 구조화 출력을 한 번에 실행(현재 OpenAI 모델 한정). NoObjectGeneratedError로 원본 출력/토큰 사용량 접근.
  • 신규 프로바이더: Google Vertex AI 2.0(성능 개선, 검색 기반 지원), OpenAI Compatible(새 전용 프로바이더), Replicate/Fireworks(이미지+언어), Cohere, Together AI, DeepInfra, DeepSeek, Cerebras 합류.
왜 읽나JavaScript/TypeScript로 AI 애플리케이션을 구축하는 개발자에게 이미지 생성/스트리밍/도구 호출의 최신 API 변경 사항과 실전 코드 패턴 레퍼런스.
vercel-blog
Vercel Blog 블로그
원문은 여기서 이어서 읽을 수 있어요
원문 읽기
읽음 (0)

이 글과 비슷한

  1. AI / ML·LY CorporationLY Corporation·

    Grafana에서 자연어로 장애 원인을 분석하기: LLM 에이전트 기반 SRELens 개발기

    LY Corporation Home SRE 팀이 장애 분석 시 메트릭·로그·트레이스가 각각 다른 화면에 흩어져 있는 문제를 해결하기 위해 Grafana 플러그인 SRELens를 개발했다. SRELens는 LLM 에이전트가 자연어 질의를 받아 실제 관측성 데이터를 조회하고, 근거와 함께 장애 원인 후보를 정리해 주는 도구다. LGTM-P 스택(Loki·Grafana·Tempo·Mimir·Pyroscope)과 FlavaMCP 게이트웨이를 통합해 단일 채팅 인터페이스에서 멀티시그널 분석이 가능하다.

    #llm-app#mcp#observability+2