pile·
AI / ML·KT 클라우드KT 클라우드·

[리뷰] 책상 위의 데이터센터, Dell Pro Max GB10 AI 워크스테이션 실사용기

문제70B 급 대형 LLM 을 로컬에서 돌리려면 GPU 가 비싸고 전력/소음이 부담이라 보안 민감 환경에서 데이터센터급 성능을 책상 위에 두기 어렵다.
접근kt cloud AI플랫폼팀이 Dell Pro Max GB10 을 검증. Grace ARM 20코어 + Blackwell GPU 단일 패키지, 128GB LPDDR5x 통합 메모리로 CPU-GPU 간 273GB/s 대역폭, PCIe 병목 제거. Llama-3.3-70B 로 출력 처리량/TTFT/ITL/전력 측정.
결과출력 198 토큰/s, TTFT 661ms, ITL 240ms, 최대 100W 이하(RTX 4090 의 1/5). 대형 LLM 로컬 개발 + 보안 환경 + 다중 모델 추론 파이프라인에 적합. 단 ARM 호환성과 메모리/GPU 개별 업그레이드 불가가 한계.
KT 클라우드
KT 클라우드 블로그
원문은 여기서 이어서 읽을 수 있어요
원문 읽기
읽음 (0)

이 글과 비슷한

  1. AI / ML·stackoverflow-blogStack Overflow Blog·

    에이전틱 SDLC를 QA 엔지니어링 마인드셋으로 구축하기

    Motorola Solutions의 테스트 엔지니어링 선임 매니저 Suneet Malhotra가 Stack Overflow 팟캐스트에 출연해 MCP(Model Context Protocol) 기반 에이전틱 SDLC 파이프라인 구축과 LLM-as-judge 평가 방법론을 소개했다. QA 엔지니어링 관점을 소프트웨어 개발 생애 전반에 적용하고, 설계 단계 직후 스펙을 강화해 결함 비용을 줄이는 'QA shift-left' 접근을 다룬다.

    요약 이어보기
    #llm-agent#mcp#test-automation+2
  2. AI / ML·LINE EngineeringLINE Engineering·

    보안 업무를 위한 AI 에이전트 플랫폼 「SAGE」 개발기 1편: 판단은 사람에게 남기는 설계

    LY Corporation Security Development Division이 보안 업무용 AI 에이전트 플랫폼 SAGE의 개발 과정을 공개했다. "완전 자동화"와 "도입 미루기" 양 극단 사이에서 "판단은 사람에게 남기는 설계"를 핵심 원칙으로 삼고, 3단계 점진적 도입 전략(AI 보조→에이전트 협업→자동화)을 채택했다. 현재는 1단계를 중심으로 파일럿·실운영 중이다.

    요약 이어보기
    #llm-app#opensearch#mcp+2