음악·음성 분야 AI 서비스(ElevenLabs, Suno, Mureka, Stable Audio, MiniMax Audio 등)의 공식 업데이트를 최신순으로 정리했어요. · 업데이트 100건
여러 곡을 앨범으로 묶어 발행할 수 있고, 발행하면 팔로워에게 푸시 알림이 가요.
말과 그 사운드트랙을 한 번에 만드는 첫 모델 Speech가 베타로 나왔어요. 피아노 위 동화 낭독 같은 콘텐츠를 만들 수 있어요.
감정 표현이 더 풍부하고 보이스 클로닝이 강해진 Eleven v4와, 90개 이상 언어 실시간 대화용 v4 Turbo가 ElevenAgents·ElevenCreative·API에 나왔어요.
이미지·영상 생성과 Flows로 만든 템플릿을 API로 실행할 수 있어요. 새 상품마다 크리에이티브를 자동으로 만들 수 있어요.
새 학기를 맞아 대학생이 전문가급 ElevenLabs 도구를 쓸 수 있는 학생 전용 플랜이 나왔어요.
OpenAI가 9월 24일 Sora API를 종료하면서 ElevenLabs에서도 Sora 2와 Sora 2 Pro 모델이 제거됐어요.
임상 음성에 맞게 미세조정한 음성 인식 모델 Scribe v2 Medical이 ElevenLabs API에서 정식 출시됐어요.
이미지 생성에 gpt-image-2.5-flare·sunburst 모델이 추가됐고, 에이전트가 툴을 병렬로 호출할 수 있어요.
Studio 4.0은 프로젝트 안에서 영상·음성·음악·효과음을 생성하고 편집·자막·내보내기까지 한 번에 할 수 있어요.
Studio에서 MIDI 성능이 좋아져 MIDI 작업이 훨씬 정확하고 창의적으로 바뀌었어요.
가사·곡 구조·분위기·장르를 이해해 뮤직비디오 전체를 기획하는 AI Director와 채팅 편집 UI, 장르별 MV Skills, 곡 전체 MV 생성이 나왔어요.
음악 엔드포인트와 SDK가 music_v2_5를 지원해요. 동시 통화 한도에 닿은 에이전트에는 대기열과 대기 음악이 생겼어요.
Claude·ChatGPT·Cursor에서 MCP로 음성·음악·효과음·이미지·영상을 만들고 결과를 ElevenCreative 워크스페이스로 받을 수 있어요.
의료·임상 음성에 특화된 배치 음성 인식 모델 Scribe v2 Medical이 정식 제공돼요.
더 풍성하고 자연스러운 악기 소리를 내는 가장 뛰어난 음악 모델 Music v2.5가 나왔어요.
음악 업계와 협력해 만든 v6 모델군이 나왔어요. v6는 모든 장르에서 안정적이고 정교하며, v6-wild는 더 예측 불가하고 다채로운 결과를 내요.
Believe·TuneCore와 제휴해 새 업계 파트너 모델로 만든 곡을 Believe와 TuneCore로 유통할 수 있게 된다고 발표했어요.
접근 가능한 모든 에이전트의 대화 트리아지 티켓을 한 번에 조회하는 엔드포인트가 추가됐어요.
Studio 2.0 이후 업데이트로 채팅 바가 빨라지고 BPM을 인식해 템포에 맞춰 처리해요.
R&B부터 하우스·클래식까지 장르별로 곡·MV·캐릭터·템플릿을 찾는 검색이 강화됐어요.
음악 생성·업로드에서 파형 시각화 데이터를 받을 수 있고, 에이전트가 전화 키패드 입력을 처리해요.
Mureka API에 mureka-9.5 모델의 강화 버전이 공개됐어요.
생성한 모든 곡에 완전한 상업적 권리와 모든 포맷 무제한 다운로드가 주어져요. 스타일 프롬프트를 저장해 다시 쓸 수도 있어요.
가사·곡·프롬프트나 빈 페이지에서 시작해 곡을 구간별로 다듬는 편집기 Composer가 ElevenMusic에 들어왔어요.
모든 ElevenLabs API 기능을 터미널 명령으로 쓰는 CLI v1이 나왔어요. 에이전트 친화적으로 JSON 출력과 드라이런을 지원해요.
로컬 ElevenLabs MCP 서버와 MCP 플레이어가 지원 중단되고, OAuth로 로그인하는 호스팅 MCP 서버를 쓰도록 바뀌었어요.
모바일에서 플레이리스트를 저장해 네트워크 없이도 들을 수 있어요.
템플릿·캐릭터·곡·MV를 둘러보는 Explore가 새로 바뀌었고, 듣고 골라 한 번에 만드는 Templates 기능이 나왔어요.
웹에서 플레이리스트를 셔플로 듣고, 플레이리스트를 라이브러리에 빠르게 추가할 수 있어요.
DAW 안에서 Stable Audio 3.0으로 생성하는 플러그인과, 변형·믹스·멀티트랙·길이 확장을 지원하는 StableAudio.com 고급 생성 화면이 베타로 나왔어요.
영상·이미지·음성 생성을 비동기로 만들고 조회하는 Flows API가 추가됐어요.
Mureka API에 영상 생성 API가 새로 추가됐어요.
브라우저 생성형 DAW Suno Studio가 MIDI, 오디오 이펙트, 내장 신스, 채팅 바를 갖춘 2.0으로 전면 개편됐어요.
멜로디·화성·편곡 흐름이 더 자연스럽고 보컬과 사운드가 풍성해진 V9.5 모델이 나왔어요. 더 다양한 스타일을 소화해요.
콘셉트와 가사만으로 작곡·편곡·연주·프로듀싱까지 한 번에 끝내는 Music 3.0을 오픈 웨이트로 공개했어요.
보컬 찹·드럼 루프·베이스 루프 등을 담은 무료 AI 사운드·루프 라이브러리 Sounds가 ElevenMusic에 나왔어요.
9월 3일부터 새 이용약관과 다운로드 방식이 적용되고, 음악 업계와 만든 새 모델이 나오면 기존 모델은 모두 은퇴한다고 알렸어요.
화자의 목소리와 연기를 유지하며 90개 이상 언어로 옮기는 Dubbing v2를 API로 쓸 수 있어요. 보이스 검색 필터도 늘었어요.
한 번 녹음한 내 목소리를 어떤 곡에든 쓰는 Voices가 iOS·Android에 나왔고 무료 플랜에서도 체험할 수 있어요.
개발자와 기업이 자사 제품과 워크플로에 AI 더빙을 바로 넣을 수 있는 Dubbing API가 나왔어요.
Scribe v2 Realtime에 개체 감지 옵션이 생기고, 보이스를 격리된 데이터 레지던시 환경으로 복제할 수 있어요.
이미지를 올리고 텍스트로 다듬어 곡·플레이리스트·프로필용 커버 이미지나 영상을 만들 수 있어요.
원고 속 등장인물을 찾아 각자에게 맞는 목소리를 제안하고 실제 대사로 미리 들려주는 Character Casting이 나왔어요.
공유 보이스 라이브러리의 억양 목록을 조회하는 엔드포인트가 생기고, Studio 프로젝트에 draft 상태가 추가됐어요.
기존 곡을 올리면 Music v2가 그 스타일과 느낌에 맞는 새 곡을 만들어 주는 References가 나왔어요.
내 목소리나 Vocal Library 목소리로 여러 곡에 일관된 보컬을 입히는 Vocals 기능이 나왔어요. Music Finetunes API도 함께 공개됐어요.
웹 Create 양식에서 Duration 슬라이더로 곡 길이를 정할 수 있어요. v5.5 모델에서 지원해요.
업로드한 오디오로 Music Finetune을 만들고 관리하는 API 다섯 개가 추가됐어요. STT 일회용 토큰 인증도 생겼어요.
새 음악 생성 모델 Music-3.0을 MiniMax API에서 쓸 수 있게 됐어요.
iOS 사용자는 iMessage 키보드에서 곡을 만들어 보내고, 받은 사람은 바로 듣고 노래로 답할 수 있어요.
오디오 파일을 올리거나 YouTube 링크를 붙여 바로 뮤직비디오 제작을 시작할 수 있어요.
플랫폼 설정에 통화 후 감정 분석 옵션이 추가돼 에이전트마다 따로 켤 수 있어요.
가사 편집이 새로 디자인됐고, 내 가사 예시를 Lyricist로 저장해 같은 분위기의 가사를 만들 수 있어요.
음악을 악보로 옮기는 Music Transcription API가 나왔고, 사운드트랙 API에 구간 파라미터가 생겼어요. 가사 생성 모델도 강화됐어요.
모든 채널에서 에이전트 해결률과 만족도를 높이도록 대화를 관찰하고 개선하는 Spotlight가 나왔어요.
곡을 코드가 붙은 악보로 받을 수 있고, Premier 전용이던 데스크톱 DAW 도우미 Mureka Co가 Pro 플랜에도 포함됐어요.
모바일 앱에서 팀에 관한 질문 4개에 답하면 그 팀만을 위한 응원가를 만들어 줘요.
작곡 결과를 SSE로 받는 Stream music with details 엔드포인트와 Studio 자막 스타일 옵션이 추가됐어요.
보컬을 녹음하거나 아이디어를 넣고 완성곡을 새롭게 바꾸는 음악 제작 도구가 ElevenMusic에 추가됐어요.
모든 도구의 튜토리얼을 모은 Get Started 지식 베이스가 생겼고, Mureka Coworker에 오디오·영상·이미지를 올려 리믹스·스템 분리 등에 쓸 수 있어요.
엔터프라이즈용 음성 AI를 싱가포르에서 호스팅해 현지 데이터 요건을 맞출 수 있게 됐어요.
자연어나 기존 SOP 문서로 에이전트가 흔한 상황에서 어떻게 일할지 정의하는 Procedures가 나왔어요.
멀티채널 전사 결과를 하나로 합쳐 받는 옵션이 생기고, 에이전트 브랜치 병합·리베이스 미리보기가 추가됐어요.
스템 API가 보컬+반주 분리 모델을 지원하고, 리릭 비디오 API는 여러 화면비와 레이아웃을, 가사→곡 API는 성별 파라미터를 지원해요.
Voice Clone이 목소리와 아바타를 고정하는 Character로 업그레이드됐고, 음악성과 가창 재현이 좋아진 새 보이스 모델이 나왔어요.
음악 생성에 mp3 48kHz 240·320kbps 포맷이 추가되고, Studio 자막 애니메이션과 더빙 목록 필터가 늘었어요.
광고 계정과 연결해 광고 소재를 50개 이상 언어로 현지화하고 완성본을 다시 플랫폼에 올려 주는 Ads Engine이 나왔어요.
청취 기록을 바탕으로 매주 일요일 개인 맞춤 생성곡 33곡을 만들어 주는 Mixes가 ElevenMusic에 나왔어요.
뮤직비디오에 여러 캐릭터를 넣을 수 있고 생성 품질이 좋아졌어요. 마법봉 버튼으로 스타일 프롬프트를 다듬는 Style Enhance도 생겼어요.
프롬프트만으로 곡을 만드는 API가 추가됐고, 파일 업로드 API의 vocal 파라미터는 제거됐어요.
음악 생성 API에서 model_id를 music_v2로 지정해 Music v2를 쓸 수 있어요. STT 화자 라이브러리 분리도 추가됐어요.
Premier용 Advanced Split으로 100가지 가까운 악기 중 원하는 것만 뽑을 수 있고, 추출 스템이 더 깨끗해졌어요.
사진 한 장과 목소리로 립싱크된 토킹 영상을 몇 초 만에 만드는 Avatars가 ElevenCreative에 추가됐어요.
eleven_monolingual_v1·eleven_multilingual_v1과 scribe_v1이 2026년 7월 9일 제거될 예정이라 새 모델로 옮겨야 해요.
곡마다 쓸 맞춤 목소리와 정체성을 가진 AI 가수 Character를 만들 수 있고, DAW를 제어하는 Mureka Co가 Windows에서도 돼요.
iOS 메모의 가사와 음성 메모 녹음을 Suno로 공유하면 Create 양식에 자동으로 들어가요.
텍스트 프롬프트만으로 오디오·영상 Flows 파이프라인을 만들어 주고 다듬을 수 있는 Flows Agent가 나왔어요.
Exotel이 정식 전화 공급자로 추가됐고, Speech to Text 업로드 한도가 3GB에서 5GB로 늘었어요.
원래 화자의 감정과 연기를 모든 언어로 옮겨 주는 새 더빙 모델 Dubbing v2를 공개했어요.
Stan Lee Universe와 제휴해 Stan Lee의 목소리가 Iconic Marketplace와 ElevenReader에 들어오고, 그에게서 영감받은 음악 Finetune 두 개도 나왔어요.
모든 장르에서 보컬·악기·편곡이 좋아지고 다국어 지원이 강화된 음악 모델 Music v2가 나왔어요.
자체 챗 에이전트나 LLM에 실시간 음성을 붙여 주는 Speech Engine이 나왔어요. 음악 생성에 track·loop·ambience 모드가 생겼어요.
리릭 비디오 생성과 리믹스 생성 API 두 개가 추가됐어요.
ElevenReader에 20만 권 이상의 프리미엄 오디오북·전자책이 추가됐고, Ultra 구독자는 월 11달러에 매달 20시간 이용할 수 있어요.
완전 라이선스 데이터로 학습한 Stable Audio 3.0 모델군이 나왔어요. 최대 6분 가변 길이 생성을 지원하고 Small·Medium은 Hugging Face에 공개됐어요.
리릭 비디오가 더 많은 템플릿과 화면비를 지원하고, Studio 단일 악기 생성 모델이 업그레이드돼 악기 제어와 음질이 좋아졌어요.
특정 에이전트 버전의 메타데이터를 조회하는 엔드포인트가 추가되고, 오디오 분리 기록에 영상 처리 실패 정보가 담겨요.
모바일 앱의 홈·탐색, 생성, 개인 설정 경험이 한꺼번에 개선됐어요.
차량 대시보드에서 Apple CarPlay와 Android Auto로 Suno 곡을 스트리밍할 수 있어요.
text-to-voice create-previews가 지원 중단되고 Design a voice로 옮겨졌어요. Voice Changer는 WAV 출력 포맷을 지원해요.
이미지·영상·음성·음악·효과음용 완성형 크리에이티브 워크플로 템플릿이 나왔어요. 입력만 올리면 결과물이 나와요.
이미지나 영상에 맞는 사운드트랙을 만드는 API가 새로 나왔어요.
ElevenAPI와 ElevenAgents 요금을 내리고 쓴 만큼 내는 Pay as you go 플랜을 도입했어요. 같은 날 Studio 타임라인용 AI 공동 편집자 Studio Agent도 나왔어요.
에이전트가 이미지·파일·음성 메모·연락처·위치·키패드 입력까지 처리해 더 많은 문제를 끝까지 해결할 수 있어요.
대화를 정리하고 필터링하는 태그 기능이 에이전트에 추가됐어요.
립싱크까지 맞춘 역동적인 AI 뮤직비디오를 만들 수 있고, 오디오 업로드를 한곳에서 관리해 Remix·Reference에 쓸 수 있어요.
완전 라이선스된 ElevenLabs 음악 모델 위에 만든 음악 탐색·제작 플랫폼 ElevenMusic이 나왔어요.
Scribe 실시간 웹소켓에 키워드와 verbatim 옵션이 추가되고, 오디오 분리 기록 조회 엔드포인트가 생겼어요.
자주 쓰는 사례를 담은 수십 개 사전 제작 에이전트 템플릿을 바로 고쳐 배포할 수 있어요.
Speech to Text에 화자 역할을 감지하는 옵션이 생기고, 워크플로 시작 노드를 지정해 대화를 시작할 수 있어요.