ElevenLabs의 공식 업데이트(새 모델·기능·API·개발자 변경 기록)를 최신순으로 한국어로 정리했어요. · 업데이트 203건
감정 표현이 더 풍부하고 보이스 클로닝이 강해진 Eleven v4와, 90개 이상 언어 실시간 대화용 v4 Turbo가 ElevenAgents·ElevenCreative·API에 나왔어요.
이미지·영상 생성과 Flows로 만든 템플릿을 API로 실행할 수 있어요. 새 상품마다 크리에이티브를 자동으로 만들 수 있어요.
새 학기를 맞아 대학생이 전문가급 ElevenLabs 도구를 쓸 수 있는 학생 전용 플랜이 나왔어요.
OpenAI가 9월 24일 Sora API를 종료하면서 ElevenLabs에서도 Sora 2와 Sora 2 Pro 모델이 제거됐어요.
임상 음성에 맞게 미세조정한 음성 인식 모델 Scribe v2 Medical이 ElevenLabs API에서 정식 출시됐어요.
이미지 생성에 gpt-image-2.5-flare·sunburst 모델이 추가됐고, 에이전트가 툴을 병렬로 호출할 수 있어요.
Studio 4.0은 프로젝트 안에서 영상·음성·음악·효과음을 생성하고 편집·자막·내보내기까지 한 번에 할 수 있어요.
음악 엔드포인트와 SDK가 music_v2_5를 지원해요. 동시 통화 한도에 닿은 에이전트에는 대기열과 대기 음악이 생겼어요.
Claude·ChatGPT·Cursor에서 MCP로 음성·음악·효과음·이미지·영상을 만들고 결과를 ElevenCreative 워크스페이스로 받을 수 있어요.
의료·임상 음성에 특화된 배치 음성 인식 모델 Scribe v2 Medical이 정식 제공돼요.
더 풍성하고 자연스러운 악기 소리를 내는 가장 뛰어난 음악 모델 Music v2.5가 나왔어요.
접근 가능한 모든 에이전트의 대화 트리아지 티켓을 한 번에 조회하는 엔드포인트가 추가됐어요.
음악 생성·업로드에서 파형 시각화 데이터를 받을 수 있고, 에이전트가 전화 키패드 입력을 처리해요.
가사·곡·프롬프트나 빈 페이지에서 시작해 곡을 구간별로 다듬는 편집기 Composer가 ElevenMusic에 들어왔어요.
모든 ElevenLabs API 기능을 터미널 명령으로 쓰는 CLI v1이 나왔어요. 에이전트 친화적으로 JSON 출력과 드라이런을 지원해요.
로컬 ElevenLabs MCP 서버와 MCP 플레이어가 지원 중단되고, OAuth로 로그인하는 호스팅 MCP 서버를 쓰도록 바뀌었어요.
영상·이미지·음성 생성을 비동기로 만들고 조회하는 Flows API가 추가됐어요.
보컬 찹·드럼 루프·베이스 루프 등을 담은 무료 AI 사운드·루프 라이브러리 Sounds가 ElevenMusic에 나왔어요.
화자의 목소리와 연기를 유지하며 90개 이상 언어로 옮기는 Dubbing v2를 API로 쓸 수 있어요. 보이스 검색 필터도 늘었어요.
개발자와 기업이 자사 제품과 워크플로에 AI 더빙을 바로 넣을 수 있는 Dubbing API가 나왔어요.
Scribe v2 Realtime에 개체 감지 옵션이 생기고, 보이스를 격리된 데이터 레지던시 환경으로 복제할 수 있어요.
원고 속 등장인물을 찾아 각자에게 맞는 목소리를 제안하고 실제 대사로 미리 들려주는 Character Casting이 나왔어요.
공유 보이스 라이브러리의 억양 목록을 조회하는 엔드포인트가 생기고, Studio 프로젝트에 draft 상태가 추가됐어요.
기존 곡을 올리면 Music v2가 그 스타일과 느낌에 맞는 새 곡을 만들어 주는 References가 나왔어요.
내 목소리나 Vocal Library 목소리로 여러 곡에 일관된 보컬을 입히는 Vocals 기능이 나왔어요. Music Finetunes API도 함께 공개됐어요.
업로드한 오디오로 Music Finetune을 만들고 관리하는 API 다섯 개가 추가됐어요. STT 일회용 토큰 인증도 생겼어요.
플랫폼 설정에 통화 후 감정 분석 옵션이 추가돼 에이전트마다 따로 켤 수 있어요.
모든 채널에서 에이전트 해결률과 만족도를 높이도록 대화를 관찰하고 개선하는 Spotlight가 나왔어요.
작곡 결과를 SSE로 받는 Stream music with details 엔드포인트와 Studio 자막 스타일 옵션이 추가됐어요.
보컬을 녹음하거나 아이디어를 넣고 완성곡을 새롭게 바꾸는 음악 제작 도구가 ElevenMusic에 추가됐어요.
엔터프라이즈용 음성 AI를 싱가포르에서 호스팅해 현지 데이터 요건을 맞출 수 있게 됐어요.
자연어나 기존 SOP 문서로 에이전트가 흔한 상황에서 어떻게 일할지 정의하는 Procedures가 나왔어요.
멀티채널 전사 결과를 하나로 합쳐 받는 옵션이 생기고, 에이전트 브랜치 병합·리베이스 미리보기가 추가됐어요.
음악 생성에 mp3 48kHz 240·320kbps 포맷이 추가되고, Studio 자막 애니메이션과 더빙 목록 필터가 늘었어요.
광고 계정과 연결해 광고 소재를 50개 이상 언어로 현지화하고 완성본을 다시 플랫폼에 올려 주는 Ads Engine이 나왔어요.
청취 기록을 바탕으로 매주 일요일 개인 맞춤 생성곡 33곡을 만들어 주는 Mixes가 ElevenMusic에 나왔어요.
음악 생성 API에서 model_id를 music_v2로 지정해 Music v2를 쓸 수 있어요. STT 화자 라이브러리 분리도 추가됐어요.
사진 한 장과 목소리로 립싱크된 토킹 영상을 몇 초 만에 만드는 Avatars가 ElevenCreative에 추가됐어요.
eleven_monolingual_v1·eleven_multilingual_v1과 scribe_v1이 2026년 7월 9일 제거될 예정이라 새 모델로 옮겨야 해요.
텍스트 프롬프트만으로 오디오·영상 Flows 파이프라인을 만들어 주고 다듬을 수 있는 Flows Agent가 나왔어요.
Exotel이 정식 전화 공급자로 추가됐고, Speech to Text 업로드 한도가 3GB에서 5GB로 늘었어요.
원래 화자의 감정과 연기를 모든 언어로 옮겨 주는 새 더빙 모델 Dubbing v2를 공개했어요.
Stan Lee Universe와 제휴해 Stan Lee의 목소리가 Iconic Marketplace와 ElevenReader에 들어오고, 그에게서 영감받은 음악 Finetune 두 개도 나왔어요.
모든 장르에서 보컬·악기·편곡이 좋아지고 다국어 지원이 강화된 음악 모델 Music v2가 나왔어요.
자체 챗 에이전트나 LLM에 실시간 음성을 붙여 주는 Speech Engine이 나왔어요. 음악 생성에 track·loop·ambience 모드가 생겼어요.
ElevenReader에 20만 권 이상의 프리미엄 오디오북·전자책이 추가됐고, Ultra 구독자는 월 11달러에 매달 20시간 이용할 수 있어요.
특정 에이전트 버전의 메타데이터를 조회하는 엔드포인트가 추가되고, 오디오 분리 기록에 영상 처리 실패 정보가 담겨요.
text-to-voice create-previews가 지원 중단되고 Design a voice로 옮겨졌어요. Voice Changer는 WAV 출력 포맷을 지원해요.
이미지·영상·음성·음악·효과음용 완성형 크리에이티브 워크플로 템플릿이 나왔어요. 입력만 올리면 결과물이 나와요.
ElevenAPI와 ElevenAgents 요금을 내리고 쓴 만큼 내는 Pay as you go 플랜을 도입했어요. 같은 날 Studio 타임라인용 AI 공동 편집자 Studio Agent도 나왔어요.
에이전트가 이미지·파일·음성 메모·연락처·위치·키패드 입력까지 처리해 더 많은 문제를 끝까지 해결할 수 있어요.
대화를 정리하고 필터링하는 태그 기능이 에이전트에 추가됐어요.
완전 라이선스된 ElevenLabs 음악 모델 위에 만든 음악 탐색·제작 플랫폼 ElevenMusic이 나왔어요.
Scribe 실시간 웹소켓에 키워드와 verbatim 옵션이 추가되고, 오디오 분리 기록 조회 엔드포인트가 생겼어요.
자주 쓰는 사례를 담은 수십 개 사전 제작 에이전트 템플릿을 바로 고쳐 배포할 수 있어요.
Speech to Text에 화자 역할을 감지하는 옵션이 생기고, 워크플로 시작 노드를 지정해 대화를 시작할 수 있어요.
에이전트 대화의 최신 주제를 돌려주는 엔드포인트와 커뮤니티 외 보이스 필터가 추가됐어요.
STT 응답에 오디오 길이가 포함되고, 보이스 조회에 녹음 품질과 검수 상태가 추가됐어요.
Scribe v2에 개체 자동 가림, 인도어-영어 혼용 전사 개선, No Verbatim 모드가 추가되고 키워드 프롬프트가 1,000개로 늘었어요.
영상 파일에서 배경음악을 만드는 video-to-music 엔드포인트와 URL로 바로 전사하는 STT 옵션이 추가됐어요.
웹과 React Native용 ElevenAgents React SDK의 첫 메이저 버전 1.0이 나왔어요.
워크스페이스에 모든 제품을 쓰는 Full 시트와 ElevenCreative 사용이 제한된 Basic 시트가 생겼어요. 모든 유료 플랜에 Basic 시트 20개가 포함돼요.
음성 에이전트가 브랜드·주제·규정을 벗어나지 않도록 하는 설정형 안전·행동 제어 Guardrails가 나왔어요.
AI 생성 음악 라이선스 마켓플레이스 Music Marketplace 문서와 워크스페이스 환경 변수 API가 추가됐어요.
ElevenCreative에서 만든 곡을 Music Marketplace에 올리고 다른 사람이 쓸 때 수익을 받을 수 있어요.
상세 음악 생성에서 구간 길이를 정확히 지키는 respect_sections_durations 옵션이 생기고, 에이전트 Users 페이지가 정식 공개됐어요.
자신의 음악으로 Finetune을 만들어 고유한 스타일이나 브랜드에 맞는 음악을 생성할 수 있어요.
이미지·영상·음성·음악·효과음 모델을 노드로 연결해 탐색하고 생성하는 캔버스 Flows가 ElevenCreative에 들어왔어요.
말 더듬 등을 정리해 전사하는 no_verbatim 옵션과 iOS·Android 앱 SAML SSO가 추가됐어요. 에이전트는 Claude Sonnet 4.6을 지원해요.
오디오 파일을 올리는 음악 업로드 엔드포인트, 발음 사전 규칙 일괄 설정, 보이스 북마크가 추가됐어요.
만든 곡을 워크스페이스 안에서 공유할 수 있고, 에이전트용 MCP 서버가 OAuth 인증을 지원해요.
Text to Speech API에 다지역 서빙이 적용돼 가까운 서버가 응답하면서 전 세계에서 최대 40% 빨라졌어요.
실제 트래픽과 측정 지표로 에이전트 설정을 안전하게 실험하는 Experiments 기능이 추가됐어요.
기존 지원 문서를 에이전트 행동으로 바꿔 계속 개선되는 고객 지원 에이전트를 만드는 전용 상품이 나왔어요.
발음 사전 조회에 전체 규칙이 포함되고, 대화한 사용자 목록 엔드포인트와 지식 베이스 폴더 삭제가 추가됐어요.
에이전트가 상황에 맞게 어조를 바꿔 진정시키거나 안심시키도록 하는 Expressive Mode가 나왔어요.
ElevenLabs가 ElevenAgents, ElevenCreative, ElevenAPI 제품군으로 재편됐어요. 글로벌 서버 라우팅이 기본이 됐어요.
초안부터 출판까지 오디오북 제작을 한곳에서 하는 Audiobooks 도구가 ElevenCreative에 들어왔어요.
API 키 설정, 에이전트, STT, TTS, 음악, 효과음 6가지 스킬로 AI 코딩 도구가 ElevenLabs 기능을 쉽게 쓰도록 했어요.
Eleven v3가 알파를 벗어나 정식 출시됐어요. 더 안정적이고 정확하며 지연도 줄었어요.
에이전트에 브랜치와 배포를 갖춘 버전 관리 시스템이 들어왔고, 곡 메타데이터에 BPM·박자가 추가됐어요.
오디오 생성 엔드포인트가 WAV 계열 등 더 많은 출력 포맷을 지원하고, 더빙 상태값이 세분화됐어요.
최신 전사 모델 Scribe v2가 나왔고, Speech-to-Text에 개체 감지 옵션과 더빙 전사 포맷 엔드포인트가 추가됐어요.
대용량 배치 전사에 맞춘 최신 음성 인식 모델 Scribe v2가 나왔어요.
Twilio·SIP 웹훅에 conversation_id가 포함되고, 보이스에 소속 컬렉션 ID 필드가 추가됐어요.
Eleven Music에 Explore, 인페인팅 API, 스템 분리, 개선된 가사 생성, 곡 타임스탬프가 추가돼 음악을 탐색·편집·제작하기 쉬워졌어요.
에이전트 설정 변경 이력을 모두 남기고 새 버전을 단계적으로 배포할 수 있는 버전 관리가 추가됐어요.
ElevenLabs 대화형 에이전트를 WhatsApp에서도 운영할 수 있게 됐어요.
Lovable에서 ElevenLabs의 TTS·STT·Agents·Music·SFX를 써서 실시간 오디오 앱을 쉽게 만들 수 있어요.
TTS 품질 프리셋 설명에 high(+20%)·ultra(+50%) 등 크레딧 비용이 표시되고, 엔터프라이즈는 에이전트 대화를 실시간 모니터링할 수 있어요.
음악 생성에 단어 단위 타임스탬프가 생기고, 보이스 엔드포인트에 안정성·유사도·스타일 설정이 추가됐어요.
더빙 리소스에 새 화자를 만들고 구간을 옮길 수 있으며, 음악 프롬프트에 musical directions가 추가됐어요. 에이전트는 Gemini 3 Pro를 지원해요.
설정이나 파일 관리 없이 아이디어를 완성 콘텐츠로 바꿔 주는 템플릿이 Creative Platform에 들어왔어요.
에이전트에서 GPT-5.1과 추론 강도 제어를 쓸 수 있고, TTS 텍스트 정규화 방식과 더빙 JSON 전사 포맷이 추가됐어요.
Veo·Sora·Kling·Wan·Seedance로 이미지·영상을 만들고 ElevenLabs 목소리·음악·효과음과 합칠 수 있는 Image & Video 기능이 나왔어요.
기존 전화번호와 라우팅·인프라를 그대로 쓰면서 안정적이고 안전하게 AI 에이전트를 연결하도록 SIP 기능이 강화됐어요.
가장 빠르고 정확한 실시간 음성 인식 모델 Scribe v2 Realtime이 공식 출시됐어요. 위젯 통화 종료 피드백도 추가됐어요.
가장 빠르고 정확한 실시간 음성 인식 모델 Scribe v2 Realtime을 공개했어요.
음악에서 보컬·드럼·베이스 등을 나누는 스템 분리 엔드포인트와 Text to Dialogue 글자 단위 타임스탬프가 추가됐어요.
오픈소스 LLM을 ElevenLabs 인프라에서 직접 호스팅해 음성 에이전트의 지연과 추론 비용을 줄였어요.
Agents CLI에 --env 플래그가 생겨 여러 환경에 배포한 에이전트를 관리할 수 있어요.
Genesys 사용자가 Genesys 흐름에서 에이전트 설정을 직접 덮어쓸 수 있고, Agents CLI와 React Native SDK가 업데이트됐어요.
대화 도중 에이전트의 LLM을 다른 모델로 덮어쓸 수 있게 됐고 SDK들이 업데이트됐어요.
에이전트 LLM으로 Gemini 2.5 Flash 프리뷰 모델을 쓸 수 있고, History API에 VoiceGeneration 소스가 추가됐어요.
shadcn/ui 기반 컴포넌트 라이브러리 ElevenLabs UI로 멀티모달 에이전트 화면을 더 빨리 만들 수 있어요.
복잡한 상황을 전문 서브에이전트로 넘기고 필요하면 사람 상담원에게 연결하는 Agent Workflows가 나왔어요.
eleven_monolingual_v1과 eleven_multilingual_v1 모델이 사용 중단되고 2025년 12월 15일 제거될 예정이라 새 모델로 옮겨야 해요.
사람이 편집한 자연스러운 콘텐츠를 주문하는 관리형 서비스 Productions가 크리에이터와 미디어 기업을 위해 나왔어요.
WebSocket 연결의 첫 메시지에서 출력 포맷을 정할 수 있고, 에이전트 첫 메시지 끼어들기를 막는 설정이 생겼어요.
사람이 다듬은 더빙·오디오북 등 콘텐츠를 플랫폼에서 바로 주문하는 관리형 서비스 Productions를 선보였어요.
툴 호출·상담원 연결·워크플로·가드레일을 구조화된 시뮬레이션으로 검증하는 에이전트 테스트가 나왔어요. CI/CD에도 연결돼요.
모든 Text to Speech 모델이 언어 코드를 지원하고, Eleven v3·Flash·Turbo에 텍스트 정규화가 켜졌어요.
Conversational AI의 이름이 ElevenLabs Agents로 바뀌었어요. 전화·웹·앱에서 말하고 입력하고 행동하는 에이전트 플랫폼이에요.
HIPAA 준수 대화에 쓸 수 있는 모델 목록에 Gemini 2.5 Flash Lite가 추가되고 SDK·MCP 서버가 업데이트됐어요.
ElevenLabs 에이전트가 자동 응답 전화 메뉴(IVR)를 스스로 탐색할 수 있게 됐어요.
발음 사전을 PATCH로 부분 수정할 수 있게 되는 등 TTS와 에이전트 API가 개선됐어요.
Eleven v3 알파를 API에서 모델 ID eleven_v3로 쓸 수 있고 Text to Dialogue API도 모두에게 열렸어요. Eleven Music API는 유료 사용자 모두에게 제공돼요.
텍스트만 주고받는 대화형 에이전트를 만드는 Chat Mode가 추가됐어요.
음악 생성 모델 Eleven Music을 API로 쓸 수 있게 됐어요. 앱과 서비스에 음악 생성을 바로 넣을 수 있어요.
음성사서함을 자동으로 알아채 처리하는 시스템 툴이 생겨 음성 에이전트 운영이 더 똑똑하고 저렴해졌어요.
자연어 프롬프트로 어떤 스타일이든 스튜디오급 음악을 만드는 음악 생성 모델 Eleven Music이 정식 출시됐어요.
OpenAI GPT-5가 ElevenLabs Conversational AI에 통합돼 복잡한 업무를 처리하는 음성 에이전트를 만들 수 있어요.
자연어 프롬프트로 어떤 스타일이든 스튜디오급 음악을 만드는 Eleven Music이 나왔어요. 상업적으로 쓸 수 있는 음악 생성 모델이에요.
WebRTC 연결용 Conversation Token을 만드는 경로와 펼쳐지는 위젯 등 에이전트 기능이 추가됐어요.
기업이 인도 현지 규제 요건을 충족하는 인프라에서 음성 AI를 구축할 수 있도록 인도 데이터 레지던시를 도입했어요.
채널별 화자가 있는 오디오를 전사하는 use_multi_channel 옵션과 Studio 프로젝트 자막 기능이 추가됐어요.
만든 더빙 전체를 조회하는 엔드포인트가 추가되고 에이전트 기능이 개선됐어요.
ElevenLabs Conversational AI가 WebRTC를 지원해 더 낮은 지연으로 실시간 음성 대화를 할 수 있어요.
생성한 목소리 미리듣기를 실시간 스트리밍하는 엔드포인트가 생겼고, 팟캐스트 생성에 인트로·아웃트로와 스타일 지시를 넣을 수 있어요.
Speech to Text에 seed로 재현 가능한 결과를 얻는 옵션이 생기고, Forced Alignment에 단어별 신뢰도 점수가 추가됐어요.
Eleven v3로 텍스트 설명에서 목소리를 만드는 새 Voice Design이 나왔고, STT 화자 분리 임계값과 PVC 배경 소음 제거가 추가됐어요.
원하는 목소리를 글로 설명하면 세 가지 후보를 만들어 주는 Voice Design v3가 나왔어요. 더 빠르고 쉬워졌어요.
ElevenLabs의 AI 음성 도구를 iOS와 Android에서 바로 쓸 수 있는 공식 모바일 앱이 출시됐어요.
Voice Library에 famous 카테고리가 생겼고, v3에서 v2로 바꾸면 오디오 태그가 자동으로 지워져요. 더빙 CSV 프레임레이트도 지정할 수 있어요.
이름과 목소리를 정하고 MCP로 수백 개 도구에 연결하는 AI 음성 비서 11ai를 선보였어요.
from_content_json으로 구조화된 JSON 내용을 넣어 Studio 프로젝트를 만들 수 있고, 시뮬레이션 대화에 동적 변수가 지원돼요.
가장 표현력 높은 TTS 모델 Eleven v3 알파가 리서치 프리뷰로 출시됐어요.
오디오 태그로 감정·연기를 지시하고 여러 화자 대화를 만드는 가장 표현력 높은 TTS 모델 Eleven v3 알파가 나왔어요. 70개 이상 언어를 지원해요.
ElevenLabs 에이전트가 대화 중에 여러 목소리를 오가며 말할 수 있게 됐어요.
엔터프라이즈 준비와 보안을 강화한 Conversational AI 2.0이 나왔어요. Claude Sonnet 4도 에이전트 LLM으로 추가됐어요.
AI 에이전트가 음성과 텍스트 입력을 동시에 처리해 더 자연스럽고 효율적인 대화를 할 수 있어요.
AI 에이전트로 여러 통화를 한꺼번에 자동으로 거는 Batch Calling 기능이 생겼어요.
공유 보이스 엔드포인트에 실시간 검수 보이스 필터가 생기고, AudioNative 플레이어 접근성이 좋아졌어요.
Speech to Text 응답에 단어 예측 신뢰도를 나타내는 logprob 필드가 추가됐어요.
Studio에서 나뉜 문단을 ZIP 파일로 한꺼번에 내보낼 수 있게 됐어요.
Dubbing Studio UI에서 업로드할 때 보이스 클로닝을 끌 수 있어 API 파라미터와 같은 동작을 해요.
현지 데이터 주권 요건을 지키면서 ElevenLabs 오디오 모델을 쓸 수 있는 유럽 데이터 레지던시를 도입했어요.
Agents Platform 대시보드에 평가 결과를 보여 주는 커스텀 차트를 넣을 수 있고, 사용량 분석이 개선됐어요.
Gemini 2.5 Flash를 ElevenLabs 음성 에이전트의 LLM으로 쓸 수 있어 추론·저지연·툴 호출이 좋아졌어요.
Professional Voice Clone을 코드로 만들고 샘플을 관리하는 API 묶음이 나왔고, STT 결과 내보내기 옵션이 늘었어요.
Professional Voice Clone을 만드는 새 흐름이 나왔고, 더빙 프로젝트의 특정 언어 렌더를 다시 생성하는 엔드포인트가 추가됐어요.
다국어 음성 성능을 높인 Scribe v1 실험 프리뷰가 나왔고, 유럽 전화망용 A-law 포맷이 추가됐어요.
Claude와 Cursor 같은 MCP 클라이언트가 텍스트 프롬프트로 ElevenLabs 오디오 기능 전체를 쓸 수 있는 MCP 서버를 공개했어요.
내 녹음으로 대사 연기를 지시하는 Studio Actor Mode와 48kHz Opus 출력 포맷이 추가됐어요. Twilio 아웃바운드 통화도 지원해요.
더 나은 검색과 필터를 갖춘 Voices V2 엔드포인트가 추가됐고, STT 반복 처리와 Studio 고음질 Reader 내보내기가 개선됐어요.
Scribe 음성 인식 가격이 내려가고 음성 구간 감지가 개선됐어요. Studio에서는 특정 멤버의 퍼블리싱 UI를 막을 수 있어요.
Scribe에 HIPAA를 준수하는 무보존 모드가 생기고 화자 분리 가능 길이가 늘었어요. dubbing_studio 옵션으로 고급 더빙도 만들 수 있어요.
Dubbing Studio가 음성 인식에 Scribe를 기본으로 써 정확도가 올라갔고, 에이전트에 속도 조절이 생겼어요.
ElevenLabs가 매우 정확한 음성 인식(ASR) 모델 Scribe를 내놨어요. 99개 언어 음성을 텍스트로 옮겨요.
99개 언어를 지원하는 Speech to Text API가 나왔고, Text to Speech API에 말하기 속도 조절이 추가됐어요.
무료로 오디오북을 만들어 ElevenReader 앱에 배포할 수 있는 ElevenReader Publishing이 나왔어요.
gpt-4o mini 에이전트의 툴 호출 문제와 Voice Isolator 오류가 고쳐지고 워크스페이스·API가 개선됐어요.
Conversational AI 요금이 분당 10센트부터로 내려가 음성 에이전트를 더 저렴하게 확장할 수 있어요.
Agents Platform 셀프서비스 요금이 내려가고 무료 티어가 넉넉해졌어요. GenFM 팟캐스트 API는 여러 입력 소스를 받을 수 있어요.
크리에이터용 장편 텍스트-오디오 편집기 Studio(구 Projects)를 모두가 쓸 수 있게 됐어요.
Projects가 Studio로 이름을 바꾸고 모두에게 정식 제공돼요. 에이전트 모니터링 대시보드와 Reader 인기 콘텐츠 섹션도 추가됐어요.
에이전트에 동적 변수와 끼어들기 처리 옵션이 생겼고, Projects 자동 재생성이 추가 비용 없이 기본 제공돼요.
에이전트 위젯에 언어 선택이 생기고, 통화를 스스로 끝내는 End Call 툴이 추가됐어요. 새 에이전트 기본 모델은 Flash가 됐어요.
조직 안에서 접근 권한을 더 잘 관리하도록 워크스페이스 그룹 관리 기능이 추가됐어요.
75ms 만에 음성을 만드는 가장 빠른 TTS 모델 Flash를 API 모델 ID eleven_flash_v2·eleven_flash_v2_5로 쓸 수 있어요.
약 75ms 만에 음성을 만드는 가장 빠른 TTS 모델 Flash가 나왔어요. 실시간 대화형 에이전트에 알맞아요.
ElevenReader 앱뿐 아니라 웹사이트에서도 GenFM 팟캐스트 생성을 쓸 수 있게 됐어요.
Studio에서 새 프로젝트를 만들 때 GenFM podcast를 고르면 AI 목소리로 팟캐스트를 자동 생성할 수 있어요.
API 키마다 크레딧 한도와 기능별 접근 권한을 정해 비용을 관리할 수 있고, 워크스페이스 API 키에 읽기·쓰기 권한이 생겼어요.
Agents Platform이 모든 고객에게 정식 제공되고 SDK·API가 나왔어요. ElevenReader에 GenFM이 들어가고 웹 TTS 리디자인이 전체 적용됐어요.
ElevenReader iOS 앱에서 PDF·기사·전자책 등으로 똑똑한 개인 팟캐스트를 만들 수 있어요.
실시간 음성 대화 도구 Conversational AI, 개인 팟캐스트를 만드는 GenFM을 담은 ElevenReader 업그레이드, 다인원 협업 Workspaces를 발표했어요.
지연을 줄이는 TTS 웹소켓 Auto Mode와 Twilio 연동용 u-law 오디오 포맷이 추가됐고, 웹사이트 TTS 리디자인 알파가 시작됐어요.
텍스트 설명으로 새 목소리를 만드는 Voice Design 기능이 베타로 열렸어요.
Turbo v2·v2.5를 중심으로 모든 모델의 오디오 안정성이 좋아지고 첫 바이트 지연이 20~30ms 줄었어요. Agents Platform이 베타로 열렸어요.
WebSocket API가 장편 오디오에서 더 안정적으로 동작하고, 비활성 타임아웃을 직접 설정할 수 있게 됐어요.
첫 생성 결과가 마음에 들지 않으면 Text to Speech와 Speech to Speech에서 두 번까지 무료로 다시 생성할 수 있어요.
베트남어, 노르웨이어, 헝가리어가 추가돼 ElevenLabs에서 32개 언어로 고품질 음성을 만들 수 있어요.
ElevenLabs Reader 앱이 Android에서도 나와 어떤 글이든 고품질 AI 목소리로 들을 수 있어요.
힌디어·프랑스어·스페인어·중국어 등 32개 언어에서 3배 빠른 음성 합성 모델 Turbo v2.5가 나왔어요.
음성·영상에서 배경 소음을 지우고 깨끗한 목소리만 뽑아 주는 Voice Isolator API가 나왔어요.
유족과의 제휴로 주디 갈랜드, 제임스 딘, 버트 레이놀즈, 로런스 올리비에 경의 목소리가 Reader 앱 음성 라이브러리에 추가됐어요.
어떤 글이든 ElevenLabs 목소리로 들을 수 있는 모바일 앱 ElevenLabs Reader가 출시됐어요.
웹사이트에 재생 버튼을 달아 글을 ElevenLabs 목소리로 자동 내레이션해 주는 Audio Native를 선보였어요.
각 글자가 언제 발화되는지 타임스탬프를 함께 주는 Text to Speech 엔드포인트 두 개가 추가됐어요. 자막·립싱크 작업에 유용해요.
음성 변환 Speech-to-Speech API를 누구나 쓸 수 있게 공개했어요.
Voice Library에 공유한 목소리가 쓰이면 성우가 수익을 받는 Voice Actor Payouts 기능이 추가됐어요.
녹음한 목소리를 다른 목소리로 바꿔 주는 음성 변환 도구 Voice Changer를 선보였어요. 연기 톤과 감정을 살린 채 목소리만 바꿀 수 있어요.
약 400ms 지연으로 V1 모델보다 두 배 이상 빠른 음성 합성 모델 Turbo v2가 나왔어요.
Projects(현 Studio)가 오디오북 유통사 기준에 맞춰 자동으로 음량을 정규화해 줘요.
원래 목소리를 유지하며 영상·음성을 다른 언어로 옮기는 AI Dubbing 기능을 공개했어요. 콘텐츠의 언어 장벽을 낮추는 큰 이정표예요.
일반·스트리밍·웹소켓 엔드포인트에 4가지 옵션의 PCM 오디오 출력 포맷이 추가됐어요.
ElevenLabs가 베타를 마치고 약 30개 언어를 지원하는 음성 합성 모델 Eleven Multilingual v2를 내놨어요. 게임·출판·미디어 콘텐츠를 여러 언어로 만들 수 있어요.
Independent Publisher 등급 이상 사용자는 글자 사용량 추이와 추가 지표를 보여 주는 대시보드를 쓸 수 있어요.
몇 분 만에 오디오북 전체를 만드는 제작 도구와 AI 음성 판별 모델을 내놨어요. 1,900만 달러 시리즈 A 투자도 함께 발표했어요.
7개 새 언어를 지원하는 다국어 음성 합성 모델 Eleven Multilingual v1이 나왔어요. 감정과 맥락을 살린 AI 음성을 여러 언어로 만들 수 있어요.
크리에이터와 출판사가 장편 콘텐츠를 실감 나는 AI 목소리로 내레이션할 수 있는 ElevenLabs 베타 플랫폼이 출시됐어요. 200만 달러 프리시드 투자도 발표했어요.
ElevenLabs가 웃음까지 표현하는 감정 풍부하고 맥락을 이해하는 음성 합성 모델을 선보이며 베타를 예고했어요.