효과음·음악·음성·더빙 AI · 키워드: 사운드, 효과음, 음향, 작곡, BGM, 배경음악, 보이스, 음성 합성, 성우, TTS, text-to-speech, 더빙
숀 파커가 스태빌리티 AI를 음악 전문가용 AI 툴 회사로 바꾸고 있어요.
토드 에드워즈가 Suno Studio로 샘플을 만든다며 AI 반대론을 비판했어요.
수노가 음성과 음악을 함께 생성하는 Speech를 베타로 공개했어요.
일레븐랩스가 직원 지분 매각을 통해 기업가치 220억 달러를 인정받았어요.
AI 음성 스타트업 일레븐랩스가 텐더 오퍼로 기업가치 220억 달러를 인정받아 9개월 만에 두 배로 올랐어요.
아티스트 Antrofrog의 AI 애니메이션이 수백만 뷰를 기록한 뒤 기존 작품 캐릭터를 도용했다는 논란이 커지고 있어요.
ElevenLabs가 90개 언어를 지원하고 10초 음성 샘플로 클로닝이 가능한 Eleven v4 모델을 공개했어요.
주술회전·유희왕 성우 츠다 켄지로가 AI로 자신의 바리톤 음성을 복제한 TikTok 계정에 소송을 제기했어요.
AI 음성 기업 ElevenLabs가 22억 달러(약 30조 원) 기업 가치를 인정받았어요.
소니 뮤직이 ARIAM AI 정책 연합에 음악 회사 최초로 합류해 창작자 권리 보호에 적극 나섰어요.
구글이 Gemini 3.8 Flash TTS를 출시해 게임·팟캐스트용 고품질 AI 음성 합성 서비스를 시작했어요.
중국 AI 스타트업 StepFun이 단어 오류율 1.7%로 비스트리밍 음성-텍스트 변환 1위를 차지했어요.
미호요가 원신 임팩트 캐릭터 음성을 AI로 무단 복제한 업체를 상대로 소송을 제기해 중국 법원에서 11만 2천 달러 손해배상 판결을 받았어요.
AI가 TV·영화 제작 현장에서 푸티지 정리·오디오 개선·VFX 자동화 등 실질적 도구로 정착하고 있으며, 배우 동의와 창작 권한 등 윤리 쟁점도 함께 부각되고 있어요.
ElevenLabs가 뮤직 v2.5를 출시해 R&B·힙합·오케스트라 등 장르 품질을 높이고 전 플랜 무손실 다운로드를 도입했어요.
개발자 발레리 미로노프가 주변 소리를 학습해 웨이브테이블을 자동 생성하는 뉴럴 네트워크 신디사이저 Sentient를 출시했어요.
소리만으로 Unity 3D 세계를 자동 생성하는 EchoForge가 SIGGRAPH 2026 학생 연구 대회에서 1위를 차지했어요.
유니버설 뮤직 그룹과 ElevenLabs가 AI 음악 리믹스 플랫폼 공동 개발을 위한 다년 계약을 체결했어요.
GPT Image 2.5와 Seedance 2.5로 프레임 연속성을 유지하며 AI 뮤직비디오를 만드는 실전 워크플로우가 소개됐어요.
유니버설 뮤직 그룹이 ElevenLabs와 파트너십을 맺고 아티스트 목소리 AI 라이선스 구조를 도입해요.
AI 음악 생성 서비스 Suno가 음반 업계와 공식 협력해 개발한 첫 모델 v6를 출시했어요.
Suno가 레이블과의 라이선스 협력으로 v6 모델을 출시하고 기존 모델을 전면 종료해요.
OpenAI가 최신 AI 모델 Astra를 출시했어요. 코딩·보안부터 게임 프로토타입 제작까지 강력한 에이전트 능력을 보이지만 투명성 논란도 제기됐어요.
EDM 프로듀서들이 AI가 생성한 가짜 음악 트랙을 탐지해 공개하는 '탐정 활동'에 나서고 있습니다.
호주 ARIA가 완전 AI 생성 음악을 공식 차트에서 제외하는 정책을 8월 29일부터 시행한다.
애플 뮤직이 AI 생성 음원에 'Made With AI' 라벨을 도입해 스트리밍 업계의 AI 투명성 흐름에 합류해요.
AI 음악 플랫폼의 성장으로 창작자 보상을 둘러싼 법적·경제적 논쟁이 음악 산업 전반으로 확산되고 있어요.
SubmitHub 분석 결과 2026년 7월 출시 음악 중 38.5%에서 AI 관여가 감지됐으며, 산업 전반의 공개 기준 마련이 시급해요.
Stability AI가 Logic Pro·Ableton에서 바로 사용할 수 있는 AI 음악 생성 DAW 플러그인 베타를 출시했다.
Cartesia의 새 스트리밍 TTS 모델 Sonic-3.6이 두 AI 음성 평가 리더보드에서 동시에 1위를 차지했다.
여러 곡을 앨범으로 묶어 발행할 수 있고, 발행하면 팔로워에게 푸시 알림이 가요.
보컬이 들어간 최대 3분 길이의 곡을 만드는 Google Lyria 3.5가 추가됐어요. 길이와 구간을 프롬프트로 조절해요.
ElevenLabs v4와 Google Lyria 3.5, 자율 에이전트형 3D 모델이 Compute에 추가됐어요.
ElevenLabs의 가장 표현력 높은 TTS 모델 v4를 HeyGen Voices에서 고를 수 있게 됐어요. 긴 스크립트에서도 톤과 속도가 일정해요.
말과 그 사운드트랙을 한 번에 만드는 첫 모델 Speech가 베타로 나왔어요. 피아노 위 동화 낭독 같은 콘텐츠를 만들 수 있어요.
MiniMax H3 Max 영상 모델과 Seed Audio 1.0, ElevenLabs v3·Turbo v2.5가 추가돼 영상과 보이스오버·음악·효과음을 만들 수 있어요.
더빙한 영상에 클릭 한 번으로 자막을 입힐 수 있게 됐어요. 소리를 끄고 봐도 현지화 영상을 쉽게 따라갈 수 있어요.
Runway Dev API에서 Eleven v4(eleven_v4) 음성 합성을 쓸 수 있게 됐어요. [laughs] 같은 오디오 태그로 표현력 있는 음성을 만들 수 있어요.
heygen-video-1 모델로 텍스트·첫 프레임·레퍼런스에서 5~15초 영상을 만드는 API를 공개했어요. 이미지 9장, 영상·오디오 각 3개까지 레퍼런스로 쓸 수 있어요.
100개 이상 언어로 감정과 전달을 태그로 조절하는 ElevenLabs v4 음성 모델이 추가됐어요.
기업 고객이 OpenAI 약정 예산으로 Runway Creative를 구매할 수 있도록 OpenAI Marketplace에 입점했어요. 같은 날 웹 앱에 ElevenLabs V4 음성 모델도 추가됐어요.
감정 표현이 더 풍부하고 보이스 클로닝이 강해진 Eleven v4와, 90개 이상 언어 실시간 대화용 v4 Turbo가 ElevenAgents·ElevenCreative·API에 나왔어요.
이미지·영상 생성과 Flows로 만든 템플릿을 API로 실행할 수 있어요. 새 상품마다 크리에이티브를 자동으로 만들 수 있어요.
곡 전체 뮤직비디오, 3D 조명 제어, 2인 대화 오디오 등 에이전트 스킬이 넓어졌어요.
새 학기를 맞아 대학생이 전문가급 ElevenLabs 도구를 쓸 수 있는 학생 전용 플랜이 나왔어요.
30개 음성·24개 언어로 표현력 있는 음성과 2인 대화를 만드는 Gemini 3.8 Flash TTS가 추가됐어요.
OpenAI가 9월 24일 Sora API를 종료하면서 ElevenLabs에서도 Sora 2와 Sora 2 Pro 모델이 제거됐어요.
임상 음성에 맞게 미세조정한 음성 인식 모델 Scribe v2 Medical이 ElevenLabs API에서 정식 출시됐어요.
ElevenLabs Music v2.5, P-Video 2 Pro, GPT-6 Astra 3D, Scenario Vectorize, LTX-2.5 Pro 4K 등이 추가됐어요.
이미지 생성에 gpt-image-2.5-flare·sunburst 모델이 추가됐고, 에이전트가 툴을 병렬로 호출할 수 있어요.
Studio 4.0은 프로젝트 안에서 영상·음성·음악·효과음을 생성하고 편집·자막·내보내기까지 한 번에 할 수 있어요.
Seedance 2.0 Pro·Fast·Mini가 오디오 레퍼런스를 받아 리듬을 따르는 사운드트랙을 만들어요. Flux Pro Image Expand는 범위 밖 이미지를 즉시 거절해요.
Studio에서 MIDI 성능이 좋아져 MIDI 작업이 훨씬 정확하고 창의적으로 바뀌었어요.
영상·이미지·사운드 제작을 한곳에 모은 새 Pika를 공개했어요. 25개 이상의 크리에이티브 앱이 작업에 맞는 최적 모델을 자동으로 골라 줘요.
가사·곡 구조·분위기·장르를 이해해 뮤직비디오 전체를 기획하는 AI Director와 채팅 편집 UI, 장르별 MV Skills, 곡 전체 MV 생성이 나왔어요.
음악 엔드포인트와 SDK가 music_v2_5를 지원해요. 동시 통화 한도에 닿은 에이전트에는 대기열과 대기 음악이 생겼어요.
Claude·ChatGPT·Cursor에서 MCP로 음성·음악·효과음·이미지·영상을 만들고 결과를 ElevenCreative 워크스페이스로 받을 수 있어요.
3D 에셋을 Autodesk Fusion으로 바로 내보낼 수 있고, Canvas에 오디오 업로드와 텍스트로 오디오를 만드는 Audio Node가 생겼어요.
의료·임상 음성에 특화된 배치 음성 인식 모델 Scribe v2 Medical이 정식 제공돼요.
더 풍성하고 자연스러운 악기 소리를 내는 가장 뛰어난 음악 모델 Music v2.5가 나왔어요.