Voicemod, NPU 기반 온디바이스 AI 음성 변환으로 게임 플레이어 정체성의 미래를 제시
Voicemod가 클라우드 없이 기기에서 직접 동작하는 NPU 기반 AI 음성 변환 기술을 공개하며, 목소리를 게임 정체성의 새 영역으로 제안했어요.
음성 변환 플랫폼 Voicemod가 80 Level과의 인터뷰에서 NPU 기반 온디바이스 AI 음성 변환 기술을 상세히 소개했어요. CEO 하이메 보쉬는 기존 DSP 방식이 목소리 위에 효과를 덧씌우는 수준이었다면, AI는 음성의 음색 자체인 '음성 DNA'를 변환한다고 설명했어요. Qualcomm과의 파트너십을 통해 NPU 추론 워크로드를 분리 처리해 CPU·GPU 부담 없이 실시간 저지연 변환이 가능하며, 클라우드 전송 없이 기기 안에서 완결되기 때문에 개인정보 보호와 응답 속도 두 가지를 모두 잡는다고 해요.
Voicemod는 Elgato Wave Link에 네이티브 VST 이펙트로 통합되면서 별도 앱 없이 기존 오디오 파이프라인 안에서 바로 쓸 수 있게 됐고, 게임 개발사가 직접 통합할 수 있는 SDK도 공개했어요. 하이메 보쉬는 "플레이어가 아바타와 스킨을 고르듯 목소리도 선택하는 시대가 오고 있다"고 강조했는데, 멀티플레이 환경에서 음성이 새로운 정체성 표현 수단이 될 가능성을 보여주는 시도예요. 게임사 입장에서는 SDK 통합을 통해 플레이어 커스터마이징 요소를 목소리 영역으로 확장할 수 있는 실질적인 선택지가 생긴 셈이에요.
원문: 80 Level