Technology

목소리가 공간이 되기까지

음성 인식부터 다면 LED 출력까지, 모든 단계를 자체 파이프라인으로 연결했습니다.

연출 영상
Pipeline

30초 동안 일어나는 일

스크롤하면 단계별 장면이 바뀝니다.

연출 이미지
1 / 6
01

듣기

음성 인식(STT, Speech-to-Text · 음성→문자 변환)으로 관람객의 말을 글로 옮깁니다.

02

이해

경량 언어모델이 요청을 장면 정보로 바꾸고, 안전 필터가 부적절한 요청을 걸러 냅니다.

03

그리기

생성형 AI가 공간 테마에 맞는 장면 이미지를 만듭니다.

04

움직이기

정지 이미지를 살아 움직이는 영상으로 바꿉니다.

05

가속

실시간 추론 최적화로 기다리는 시간을 줄입니다.

06

감싸기

여러 면의 LED에 이음새 없이 동시에 출력합니다.

Core

핵심 기술

생성 파이프라인 오케스트레이션 서버연출 이미지
Core 01

생성 파이프라인 오케스트레이션 서버

음성 인식, 언어모델, 이미지 · 영상 생성, 출력까지 각 AI 모듈을 하나의 흐름으로 묶어 관리합니다.

저작권 C-2026-047235

실시간 렌더링 클라이언트 엔진연출 이미지
Core 02

실시간 렌더링 클라이언트 엔진

생성된 장면을 여러 면의 LED에 이음새 없이 동시에 출력합니다.

저작권 C-2026-047234

캐릭터 자동 애니메이션연출 이미지
Core 03

캐릭터 자동 애니메이션

사진이나 3D 모델에 자동으로 뼈대를 만들고, 걷기 · 뛰기 같은 움직임을 실시간으로 생성합니다.

저작권 C-2026-047236 · 특허 출원 10-2026-0188398

인물 페르소나 엔진연출 이미지
Core 04

인물 페르소나 엔진

인물의 기록을 학습해 근거 기반으로 답하고, 음성 · 표정과 동기화해 응답합니다.

인물 AI

Before / After

말하기 전과 후

가운데 막대를 좌우로 움직여 비교해 보세요.

"바닷속으로 가고 싶어" 말한 뒤
말하기 전
"바닷속으로 가고 싶어" 말한 뒤말하기 전
Safety & Ops

안전 · 운영

온프레미스 GPU 엣지 서버

외부 클라우드 없이 현장에서 생성합니다. 관람객의 음성과 사진은 현장 밖으로 나가지 않습니다.

콘텐츠 안전 필터

허용 표현 기반 필터와 생성 결과 검수로 공공장소 운영 기준을 지킵니다.

원격 무인 운영

원격 모니터링으로 현장 인력 없이도 상태를 확인하고 콘텐츠를 교체합니다.

Roadmap

R&D 로드맵

NOW

상용화

  • 라이브 메타큐브
  • 루미타운
  • 인물 AI
NEXT

고도화

  • 동작 인식 다인원 인터랙션
  • 시즌 테마 확장
  • 생성 속도 단축
LATER

연구

  • 3DGS 기반 실사 공간 재구성
  • 다국어 음성 대화

3DGS: 3D Gaussian Splatting, 실사 사진으로 3차원 공간을 재구성하는 기술

공동 연구 · 기술 협력을 찾고 계신가요?

도입 문의