GIZ ML
외부 클라우드 종속 없는 100% 사내 완결형 온프레미스 GPU 클러스터.
RTX 5090 클러스터, WanGP 런타임, vLLM 슬립/웨이크 동적 VRAM 공유, 4GB 디스크 LRU 캐시 및 Whisper 화자 분리를 서빙합니다.

아키텍처 개념도
제품 화면
설명에 그치지 않고, 화면으로 확인하세요.
각 화면의 촬영 시점과 예시 데이터 여부를 확인하고 이미지를 선택해 확대하세요. 운영 성능·보안 요건·고객 효과는 별도 검수 항목입니다.
Giz 운영 설정과 상태
화면 확대 ↗
Giz 운영 설정과 상태
운영 설정과 상태 항목을 모은 관리 화면입니다. 폐쇄망 운영이나 보안 인증을 증명하는 자료는 아닙니다. 2026-09-13 · 예시 데이터.
관련 기능 살펴보기 →Giz Computer 브라우저 터미널
화면 확대 ↗
Giz Computer 브라우저 터미널
Computer의 터미널 탭과 작업 영역을 보여줍니다. 격리·권한·복구는 별도 실행 검수로 확인합니다. 2026-09-14 · 제품 화면.
관련 기능 살펴보기 →기업의 기밀 데이터와 미디어 파이프라인을 외부 클라우드에 맡길 수는 없습니다
기업의 핵심 설계 도면, 제조 공정 비디오, 미공개 제품 디자인, 임원 회의록 녹음 파일을 외부 상용 AI 클라우드(Runway, Midjourney, OpenAI 등)로 전송하는 것은 심각한 보안 위험을 초래합니다. 또한 사용량 증가에 비례하여 기하급수적으로 폭증하는 외부 API 호출 비용은 기업의 운영 마진을 잠식합니다.
Giz ML은 엔비디아 RTX 5090 기반 온프레미스 GPU 클러스터(ml-dmc1~9, mtl1~4)와 WanGP 분산 워커 아키텍처를 기반으로, 초고화질 비디오 생성부터 실시간 립싱크, 대규모 화자 분리 ASR, 32k 토큰 문서 구조화 OCR을 사내 인프라에서 직접 서빙하는 풀스택 머신러닝 인프라입니다.
엔터프라이즈 GPU 인프라 4대 핵심 기술 사양
| 엔지니어링 영역 | Giz ML 구현 스펙 | 비즈니스 및 운영 가치 |
|---|---|---|
| RTX 5090 WanGP 클러스터 | NVFP4 양자화 백엔드 및 NVIDIA VSR 초해상화, HEVC 하드웨어 인코딩 | 60fps 고화질 비디오 생성을 사내 완결하여 외부 생성 API 비용 0원 달성 |
| vLLM 슬립/웨이크 동적 공유 | /sleep?level=1 및 /wake_up API를 통한 유휴 VRAM 즉시 회수 |
비전 OCR과 비디오 생성 워커가 동일 GPU를 동적 공유하여 하드웨어 효율 극대화 |
| 4GB 디스크 LRU 캐시 | 고속 SQLite 디스크 LRU(embeddings.sqlite3, 4,096 MiB) 임베딩 캐싱 |
반복 프롬프트의 텍스트 인코더 연산 오버헤드를 0ms로 단축하여 즉각 응답 |
| 대규모 음성 화자 분리 (ASR) | faster-whisper large-v3-turbo + pyannote 3.1 결합 파이프라인 |
최대 50명의 회의 참석자 음성을 밀리초 단위로 화자 분리하여 회의록 자동화 |
사내 인프라에서 완결되는 7대 AI 미디어 파이프라인
- 비디오 생성 & 프레임 보간: LTX-Video 24fps 생성 엔진 및 ComfyUI RIFE 60fps 보간 알고리즘.
- 실시간 디지털 휴먼 립싱크: 단일 정면 사진과 오디오 음성을 결합한 MuseTalk 및 SoulX 고속 합성.
- 대규모 화자 분리 회의록: 최대 50인 다자간 토론 녹음 파일의 화자별 발화 분리 및 타임스탬프 전사.
- 32k 토큰 비전 문서 OCR: 복잡한 다단 기술 보고서, 표, LaTeX 수식을 마크다운으로 무손실 추출하는 OvisOCR2.
- 고품질 음성 및 BGM 작곡: 한국어/영어 감정 표현 OmniVoice TTS 및 Stable Audio 3 사운드 합성.
다음 단계
가장 복잡한 업무 하나를 가져오세요.
현재 쓰는 파일과 시스템, 바꾸고 싶은 일을 함께 살펴보겠습니다.
Giz Agent에게 질문하기
제품 자료를 바탕으로 기능과 도입 범위를 정리합니다.