모델 817건 · 국산 131 · 가격 654 추적 중
멀티모달

일레븐랩스, '일레븐 v4' 공개…TTS 아레나 1위

AI타임스·2026-09-29

요약

일레븐랩스가 9월 28일(현지시간) 감정 표현과 음성 복제 성능을 강화하고 실시간 대화용 지연 시간을 줄인 음성 생성 모델 '일레븐 v4'와 경량화 버전 '일레븐 v4 터보'를 공개했다. 두 모델은 아키텍처를 대폭 개편해, 문장을 그대로 읽던 기존 TTS와 달리 대화의 흐름과 앞뒤 맥락에 맞춰 감정과 억양, 말하는 속도를 조절한다. 대본 안에 웃음, 속삭임, 문 닫히는 소리 등 음향 지시를 넣을 수도 있다. 두 모델은 음성 모델 비교 플랫폼인 TTS 아레나에서 1위를 기록했다.

큐레이터 노트

원문에 없는 맥락입니다

감정과 맥락을 반영한 음성 생성은 실시간 대화형 AI에서 자연스러운 반응을 만드는 핵심 요소로 꼽힌다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

AI 음악 서비스 수노, 음성 생성 기능 공개
The Verge AI · 2026-10-02

AI 음악 제작 서비스 Suno가 스크립트나 설명 프롬프트를 바탕으로 음성을 생성하는 새 기능 'Speech'를 발표했다. 이 기능은 Suno의 웹과 모바일 플랫폼에서 공개 베타로 제공되며, 음성과 배경음악을 동시에 생성할 수 있다. Suno 최고제품책임자 Jack Brody는 발표문에…

AWS, SageMaker서 Qwen3-TTS 음성 복제 모델 배포 지원
AWS ML Blog · 2026-09-25

AWS는 Alibaba Cloud Qwen팀이 공개한 텍스트음성변환 모델 Qwen3-TTS-12Hz-1.7B-Base를 Amazon SageMaker JumpStart를 통해 실시간 추론 엔드포인트로 배포하는 방법을 공개했다. 이 모델은 짧은 참조 음성과 그 대본만으로 재훈련 없이 특정…

일레븐랩스 CEO, AI 상담원 고지 필요성 언급
TechCrunch AI · 2026-09-24

TechCrunch가 일레븐랩스 CEO와 인터뷰를 진행했다. 일레븐랩스의 AI 음성 기술은 여러 기업의 고객센터 통화에서 상담원 목소리로 쓰이고 있다. CEO는 통화 상대가 AI라는 사실을 기업들이 고객에게 알려야 한다고 말했다. 다만 그는 이러한 고지가 필요한 것은 사람들이 AI 상담…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
지연 시간
요청을 보낸 시점부터 응답을 받기까지 걸리는 시간을 말한다.

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

AI타임스 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →