GIZ AI HUMAN
텍스트를 넘어, 눈을 맞추며 실시간으로 대면 대화하는 디지털 휴먼.
WebRTC P2P 화상 통화, 180ms 디바운스 더블 버퍼링 무깜빡임 비디오 스왑 및 온프레미스 MuseTalk 립싱크를 제공합니다.
Giz Models 모델 카탈로그
화면 확대 ↗
Giz Models 모델 카탈로그
모델을 검색하고 카드의 설명과 이용 항목을 비교하는 카탈로그 화면입니다. 2026-09-14 · 제품 화면.
관련 기능 살펴보기 →제품 화면
설명에 그치지 않고, 화면으로 확인하세요.
각 화면의 촬영 시점과 예시 데이터 여부를 확인하고 이미지를 선택해 확대하세요. 운영 성능·보안 요건·고객 효과는 별도 검수 항목입니다.
Giz Models 모델 카탈로그
화면 확대 ↗
Giz Models 모델 카탈로그
모델을 검색하고 카드의 설명과 이용 항목을 비교하는 카탈로그 화면입니다. 2026-09-14 · 제품 화면.
관련 기능 살펴보기 →텍스트 챗봇을 넘어, 표정과 음성으로 실시간 대면 소통합니다
고객 상담 키오스크, 온라인 1:1 교육, VIP 컨시어지 서비스에서 텍스트 기반 챗봇은 인간적인 신뢰감과 교감을 형성하기 어렵습니다. 기존의 아바타 비디오 생성 서비스(HeyGen, D-ID 등)는 사용자의 질문 하나에 수십 초에서 수 분 동안 비디오를 배치 렌더링해야 하므로 진정한 의미의 실시간 대화가 불가능했습니다.
Giz AI Human은 초저지연 WebRTC P2P 화상 통화와 180ms 디바운스 더블 버퍼링 비디오 렌더러, 그리고 온프레미스 MuseTalk 립싱크 워커를 결합하여, 실제 사람과 영상 통화를 하듯 끊김 없는 실시간 대면 인터랙션을 구현하는 디지털 휴먼 플랫폼입니다.
엔터프라이즈 디지털 휴먼 4대 기술 규격
| 엔지니어링 영역 | Giz AI Human 구현 스펙 | 비즈니스 및 운영 가치 |
|---|---|---|
| WebRTC P2P 초저지연 통화 | PeerJS 기반 메시 네트워크 및 결정론적 피어 ID(giz-${user.id}) 할당 |
네트워크 지연 200ms 미만의 자연스러운 양방향 음성·화상 통화 환경 제공 |
| 무깜빡임 더블 버퍼링 렌더러 | useAgentVideoStreams.ts의 180ms 디바운스 백그라운드 프리렌더링 |
비디오 트랙 전환 시 발생하는 검은 화면(Flicker)을 0으로 제거하여 매끄러운 표정 전환 |
| 온프레미스 MuseTalk 립싱크 | 사내 RTX 5090 클러스터 상에서 실시간 랜드마크 입모양 동기화 추론 | 외부 API 호출 비용(분당 수 달러) 0원 및 기업 생체 데이터 100% 사내 완결 |
| 페르소나 & 음성 튜닝 스튜디오 | AgentCharacterEditorDialog.vue 기반 외형, 성격, TTS 억양/피치 미세 조정 |
브랜드 아이덴티티에 최적화된 맞춤형 AI 은행원, 전문 강사, 컨시어지 제작 |
실시간 대면 인터랙션의 3단계 처리 흐름
- 초저지연 VAD 및 스트리밍 STT: 사용자의 마이크 음성을 Web Audio API로 감지(VAD)하는 즉시 사내 Whisper 워커로 실시간 스트리밍 전사합니다.
- LLM 추론 및 오디오 합성: 언어 모델의 첫 번째 토큰이 출력되는 즉시 온프레미스 음성 합성(TTS) 엔진이 발화를 시작합니다.
- 더블 버퍼 립싱크 스왑: MuseTalk 워커가 합성한 비디오 청크를 브라우저 백그라운드 비디오 엘리먼트에 버퍼링한 후, 180ms 디바운스 시점에 즉각 스왑 표출합니다.
다음 단계
가장 복잡한 업무 하나를 가져오세요.
현재 쓰는 파일과 시스템, 바꾸고 싶은 일을 함께 살펴보겠습니다.
Giz Agent에게 질문하기
제품 자료를 바탕으로 기능과 도입 범위를 정리합니다.