모델 803건 · 국산 131 · 가격 645 추적 중
멀티모달

일레븐랩스, '일레븐 v4' 공개…TTS 아레나 1위

AI타임스·2026-09-29

요약

일레븐랩스가 9월 28일(현지시간) 감정 표현과 음성 복제 성능을 강화하고 실시간 대화용 지연 시간을 줄인 음성 생성 모델 '일레븐 v4'와 경량화 버전 '일레븐 v4 터보'를 공개했다. 두 모델은 아키텍처를 대폭 개편해, 문장을 그대로 읽던 기존 TTS와 달리 대화의 흐름과 앞뒤 맥락에 맞춰 감정과 억양, 말하는 속도를 조절한다. 대본 안에 웃음, 속삭임, 문 닫히는 소리 등 음향 지시를 넣을 수도 있다. 두 모델은 음성 모델 비교 플랫폼인 TTS 아레나에서 1위를 기록했다.

큐레이터 노트

원문에 없는 맥락입니다

감정과 맥락을 반영한 음성 생성은 실시간 대화형 AI에서 자연스러운 반응을 만드는 핵심 요소로 꼽힌다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

AWS, SageMaker서 Qwen3-TTS 음성 복제 모델 배포 지원
AWS ML Blog · 2026-09-25

AWS는 Alibaba Cloud Qwen팀이 공개한 텍스트음성변환 모델 Qwen3-TTS-12Hz-1.7B-Base를 Amazon SageMaker JumpStart를 통해 실시간 추론 엔드포인트로 배포하는 방법을 공개했다. 이 모델은 짧은 참조 음성과 그 대본만으로 재훈련 없이 특정…

일레븐랩스 CEO, AI 상담원 고지 필요성 언급
TechCrunch AI · 2026-09-24

TechCrunch가 일레븐랩스 CEO와 인터뷰를 진행했다. 일레븐랩스의 AI 음성 기술은 여러 기업의 고객센터 통화에서 상담원 목소리로 쓰이고 있다. CEO는 통화 상대가 AI라는 사실을 기업들이 고객에게 알려야 한다고 말했다. 다만 그는 이러한 고지가 필요한 것은 사람들이 AI 상담…

구글, 제미나이 TTS 모델 2종 출시
전자신문 SW · 2026-09-24

구글이 9월 23일(현지시간) 텍스트를 음성으로 변환하는 '제미나이 3.8 플래시 TTS'와 '제미나이 3.8 플래시-라이트 TTS' 두 모델을 공개했다. 두 모델 모두 자연어 명령만으로 새로운 목소리를 만들고 대사의 속도와 감정 등을 조절할 수 있다. 이 중 제미나이 3.8 플래시 T…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
지연 시간
요청을 보낸 시점부터 응답을 받기까지 걸리는 시간을 말한다.

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

AI타임스 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →