AI 음악 서비스 수노, 음성 생성 기능 공개
요약
AI 음악 제작 서비스 Suno가 스크립트나 설명 프롬프트를 바탕으로 음성을 생성하는 새 기능 'Speech'를 발표했다. 이 기능은 Suno의 웹과 모바일 플랫폼에서 공개 베타로 제공되며, 음성과 배경음악을 동시에 생성할 수 있다. Suno 최고제품책임자 Jack Brody는 발표문에서 음악이 Suno의 핵심이지만 비전은 다른 형태의 인간 표현으로도 확장돼 왔다고 설명했다. 그는 Speech를 음성과 음악을 함께 생성하는 최초의 오디오 모델이라고 소개했다.
큐레이터 노트
원문에 없는 맥락입니다
깊이 읽기
이 기사 한 건이 아니라, 같은 사안을 다룬 이 사이트의 기록을 근거로 정리했습니다
이 일이 어디서 왔나
수노는 2026년 9월 25일 소니뮤직·유니버설뮤직그룹으로부터 신규 모델의 저작권 침해 소지를 두고 또다시 소송을 당한 상태에서 이번 음성 생성 기능을 내놓았다. 같은 시기 일레븐랩스가 9월 28일 감정 표현을 강화한 '일레�레 v4'로 TTS 아레나 1위에 오르는 등 음성 생성 분야 경쟁도 치열해지고 있다. 9월 28일 IT조선 보도에 따르면 AI 음악이 차트에 진입해도 리스너가 이를 구분할 방법은 없는 상황이다.
짚어야 할 점
- 음성과 배경음악을 한 모델로 동시에 생성한다는 점은 ElevenLabs 같은 TTS 전문 서비스와는 다른 결합형 접근이라 할 수 있다.
- 소니·UMG가 수노를 '모델 세탁'이라며 재소송한 지 일주일 만에 나온 발표라, 새 기능의 학습 데이터 출처가 함께 주목받을 수밖에 없다.
- IT조선이 지적한 'AI 음악 구분 불가' 문제는 음성까지 AI로 만들어지면서 더 커질 수 있는 사안이다.
아직 확인되지 않은 것
- Speech 기능이 어떤 데이터로 학습됐는지는 밝혀지지 않았다.
- 생성된 음성·음악에 AI 제작 표시가 붙는지는 확인되지 않았다.
- 소니·UMG 소송이 이번 신기능에도 적용될 수 있는지는 언급되지 않았다.
다른 매체는 이렇게 썼다
같은 사안을 다룬 다른 곳의 보도입니다
노타는 멀티모달 AI 모델의 성능 저하를 최소화하면서 GPU 메모리 사용량을 줄이는 '모달리티 인지 전문가 프루닝' 연구 논문이 NeurIPS 2026 메인트랙에 채택됐다고 밝혔다. 이 기술은 MoE 기반 멀티모달 모델에서 전문가 모듈을 제거할 때 언어와 이미지 이해 능력을 함께 고려해…
알리바바가 23일(현지시간) 차세대 전이중(Full-Duplex) 음성 모델 '큐원-오디오-3.1-리얼타임'을 출시했다. 이 모델은 단순히 듣고 답하는 것을 넘어 언제 생각하고 행동하고 말할지를 판단하도록 훈련됐다. 사용자의 말을 듣는 동시에 주변 음성을 파악해, 대화를 중간에 끊지 않…
박세웅 ETRI 원장이 취임 4개월 기자간담회에서 국가임무 중심 연구기관으로의 전환을 선언했다. 임무형 연구 비중을 현재 22%에서 2030년까지 90% 수준으로 끌어올리고, AI·피지컬 AI·입체통신·공간결합·AI디지털전환(ADX) 5대 분야에 역량을 집중한다. AI 분야에서는 멀티모…
이 사안의 흐름
같은 주제를 다룬 이 사이트의 기록 — 최신순
- 2026-09-29클링 4.0 공개, 영상 일관성·제어력 강화AI타임스
- 2026-09-29일레븐랩스, '일레븐 v4' 공개…TTS 아레나 1위AI타임스
- 2026-09-28리퀴드 AI, 추측적 디코딩으로 VLM 추론 가속AI타임스
- 2026-09-28AI 음악, 차트 진입해도 리스너는 AI 여부 몰라IT조선
- 2026-09-25소니·UMG, 수노 AI 새 모델도 저작권 침해 재소송The Verge AI
이 글에 나온 말
- 프롬프트
- AI 모델에게 원하는 작업을 지시하기 위해 입력하는 텍스트를 말한다.
이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.
같은 분야의 다른 소식
- MS, 초저지연 음성인식·합성 모델 3종 공개AI타임스 · 2026-10-02
- 오픈AI, 챗GPT에 옷 가상 착용 쇼핑 기능 추가테크42 · 2026-10-02
- 현대차, 5세대 '디 올 뉴 투싼' 뉴욕서 세계 최초 공개블로터 · 2026-10-01
- 엔비디아, 물리 법칙 반영하는 영상생성 프레임워크 공개AI타임스 · 2026-10-01
- 인셉션, 확산모델 기반 음성 에이전트 '머큐리 보이스' 출시AI타임스 · 2026-10-01
- 알리바바, 대화 타이밍 판단하는 전이중 음성 AI 공개AI타임스 · 2026-09-30