일레븐랩스, '일레븐 v4' 공개…TTS 아레나 1위
요약
일레븐랩스가 9월 28일(현지시간) 감정 표현과 음성 복제 성능을 강화하고 실시간 대화용 지연 시간을 줄인 음성 생성 모델 '일레븐 v4'와 경량화 버전 '일레븐 v4 터보'를 공개했다. 두 모델은 아키텍처를 대폭 개편해, 문장을 그대로 읽던 기존 TTS와 달리 대화의 흐름과 앞뒤 맥락에 맞춰 감정과 억양, 말하는 속도를 조절한다. 대본 안에 웃음, 속삭임, 문 닫히는 소리 등 음향 지시를 넣을 수도 있다. 두 모델은 음성 모델 비교 플랫폼인 TTS 아레나에서 1위를 기록했다.
큐레이터 노트
원문에 없는 맥락입니다
다른 매체는 이렇게 썼다
같은 사안을 다룬 다른 곳의 보도입니다
AI 음악 제작 서비스 Suno가 스크립트나 설명 프롬프트를 바탕으로 음성을 생성하는 새 기능 'Speech'를 발표했다. 이 기능은 Suno의 웹과 모바일 플랫폼에서 공개 베타로 제공되며, 음성과 배경음악을 동시에 생성할 수 있다. Suno 최고제품책임자 Jack Brody는 발표문에…
AWS는 Alibaba Cloud Qwen팀이 공개한 텍스트음성변환 모델 Qwen3-TTS-12Hz-1.7B-Base를 Amazon SageMaker JumpStart를 통해 실시간 추론 엔드포인트로 배포하는 방법을 공개했다. 이 모델은 짧은 참조 음성과 그 대본만으로 재훈련 없이 특정…
TechCrunch가 일레븐랩스 CEO와 인터뷰를 진행했다. 일레븐랩스의 AI 음성 기술은 여러 기업의 고객센터 통화에서 상담원 목소리로 쓰이고 있다. CEO는 통화 상대가 AI라는 사실을 기업들이 고객에게 알려야 한다고 말했다. 다만 그는 이러한 고지가 필요한 것은 사람들이 AI 상담…
이 사안의 흐름
같은 주제를 다룬 이 사이트의 기록 — 최신순
- 2026-09-24구글, 음성 직접 설계하는 제미나이 TTS 신모델 공개AI타임스
- 2026-09-24알리바바, 오디오 AI '큐원-오디오-3.1' 공개AI타임스
- 2026-09-24구글, 제미나이 TTS 모델 2종 출시전자신문 SW
- 2026-09-21일레븐랩스, MCP로 대화창에 음성·영상 제작 통합AI타임스
- 2026-09-17일레븐랩스-유니버설뮤직, AI 오디오 공동개발 제휴전자신문 SW
이 글에 나온 말
- 지연 시간
- 요청을 보낸 시점부터 응답을 받기까지 걸리는 시간을 말한다.
이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.
같은 분야의 다른 소식
- 빅테크, 스마트폰 없이 쓰는 AI 기기 확대IT조선 · 2026-10-02
- AI 음악 서비스 수노, 음성 생성 기능 공개The Verge AI · 2026-10-02
- MS, 초저지연 음성인식·합성 모델 3종 공개AI타임스 · 2026-10-02
- 오픈AI, 챗GPT에 옷 가상 착용 쇼핑 기능 추가테크42 · 2026-10-02
- 현대차, 5세대 '디 올 뉴 투싼' 뉴욕서 세계 최초 공개블로터 · 2026-10-01
- 엔비디아, 물리 법칙 반영하는 영상생성 프레임워크 공개AI타임스 · 2026-10-01