일레븐랩스, '일레븐 v4' 공개…TTS 아레나 1위
요약
일레븐랩스가 9월 28일(현지시간) 감정 표현과 음성 복제 성능을 강화하고 실시간 대화용 지연 시간을 줄인 음성 생성 모델 '일레븐 v4'와 경량화 버전 '일레븐 v4 터보'를 공개했다. 두 모델은 아키텍처를 대폭 개편해, 문장을 그대로 읽던 기존 TTS와 달리 대화의 흐름과 앞뒤 맥락에 맞춰 감정과 억양, 말하는 속도를 조절한다. 대본 안에 웃음, 속삭임, 문 닫히는 소리 등 음향 지시를 넣을 수도 있다. 두 모델은 음성 모델 비교 플랫폼인 TTS 아레나에서 1위를 기록했다.
큐레이터 노트
원문에 없는 맥락입니다
다른 매체는 이렇게 썼다
같은 사안을 다룬 다른 곳의 보도입니다
AWS는 Alibaba Cloud Qwen팀이 공개한 텍스트음성변환 모델 Qwen3-TTS-12Hz-1.7B-Base를 Amazon SageMaker JumpStart를 통해 실시간 추론 엔드포인트로 배포하는 방법을 공개했다. 이 모델은 짧은 참조 음성과 그 대본만으로 재훈련 없이 특정…
TechCrunch가 일레븐랩스 CEO와 인터뷰를 진행했다. 일레븐랩스의 AI 음성 기술은 여러 기업의 고객센터 통화에서 상담원 목소리로 쓰이고 있다. CEO는 통화 상대가 AI라는 사실을 기업들이 고객에게 알려야 한다고 말했다. 다만 그는 이러한 고지가 필요한 것은 사람들이 AI 상담…
구글이 9월 23일(현지시간) 텍스트를 음성으로 변환하는 '제미나이 3.8 플래시 TTS'와 '제미나이 3.8 플래시-라이트 TTS' 두 모델을 공개했다. 두 모델 모두 자연어 명령만으로 새로운 목소리를 만들고 대사의 속도와 감정 등을 조절할 수 있다. 이 중 제미나이 3.8 플래시 T…
이 사안의 흐름
같은 주제를 다룬 이 사이트의 기록 — 최신순
- 2026-09-24구글, 음성 직접 설계하는 제미나이 TTS 신모델 공개AI타임스
- 2026-09-24알리바바, 오디오 AI '큐원-오디오-3.1' 공개AI타임스
- 2026-09-21일레븐랩스, MCP로 대화창에 음성·영상 제작 통합AI타임스
- 2026-09-17일레븐랩스-유니버설뮤직, AI 오디오 공동개발 제휴전자신문 SW
- 2026-09-17일레븐랩스, UMG와 손잡고 정식 라이선스 AI 음악 플랫폼 개발AI타임스
이 글에 나온 말
- 지연 시간
- 요청을 보낸 시점부터 응답을 받기까지 걸리는 시간을 말한다.
이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.
같은 분야의 다른 소식
- 알리바바, 대화 타이밍 판단하는 전이중 음성 AI 공개AI타임스 · 2026-09-30
- DJI 오즈모 360 II 리뷰…하와이서 3주 실사용ZDNet Korea · 2026-09-30
- 다이슨 AI 칫솔 '카메라젯' 결함 인정…원인은 내부 누수IT조선 · 2026-09-30
- 현대차, 中 전용 전기차 아이오닉V 2000만원대 출시ZDNet Korea · 2026-09-30
- 콘데나스트, 베드락 기반 멀티모달 영상 검색 구축AWS ML Blog · 2026-09-29
- 클링 4.0 공개, 영상 일관성·제어력 강화AI타임스 · 2026-09-29