모델 803건 · 국산 131 · 가격 645 추적 중
AI 연구

노타, 멀티모달 AI 경량화 기술 NeurIPS 채택

ZDNet Korea·2026-10-01

요약

노타는 멀티모달 AI 모델의 성능 저하를 최소화하면서 GPU 메모리 사용량을 줄이는 '모달리티 인지 전문가 프루닝' 연구 논문이 NeurIPS 2026 메인트랙에 채택됐다고 밝혔다. 이 기술은 MoE 기반 멀티모달 모델에서 전문가 모듈을 제거할 때 언어와 이미지 이해 능력을 함께 고려해 성능과 구동 효율을 균형 있게 확보한다. 약 310억 파라미터 규모 모델에서 전문가 모듈을 25% 제거했을 때 원본 성능의 98%를, 50% 제거 시 91%를 유지했으며 GPU 메모리 사용량은 58GB에서 31GB로 약 47% 줄었다. 노타는 이 기술을 자사 AI 최적화 플랫폼 '넷츠프레소'에 반영해 멀티모달·MoE 모델 지원을 확대할 계획이다.

큐레이터 노트

원문에 없는 맥락입니다

구동에 필요한 GPU 메모리를 줄이면 고사양 GPU를 추가하지 않고도 같은 인프라에서 더 큰 모델을 돌리거나 여유 자원을 다른 서비스에 배분할 수 있다는 점이 핵심이다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

알리바바, 대화 타이밍 판단하는 전이중 음성 AI 공개
AI타임스 · 2026-09-30

알리바바가 23일(현지시간) 차세대 전이중(Full-Duplex) 음성 모델 '큐원-오디오-3.1-리얼타임'을 출시했다. 이 모델은 단순히 듣고 답하는 것을 넘어 언제 생각하고 행동하고 말할지를 판단하도록 훈련됐다. 사용자의 말을 듣는 동시에 주변 음성을 파악해, 대화를 중간에 끊지 않…

한양대 연구팀, 조기 종료형 AI 추론 기술 NeurIPS 2026 채택
전자신문 SW · 2026-09-30

김은찬 한양대 교수 연구팀이 AI 모델의 실제 배포 환경을 고려한 추론 효율화 연구를 발표했으며, 이 논문이 AI·머신러닝 학술대회 'NeurIPS 2026'에 최종 채택됐다고 30일 밝혔다. 연구에는 김은찬 교수와 엄빛찬 박사과정 연구원이 참여했다. 논문은 전체 모델을 학습한 뒤 실제…

클링 4.0 공개, 영상 일관성·제어력 강화
AI타임스 · 2026-09-29

중국 콰이쇼우의 AI 자회사 클링이 9월 28일 차세대 동영상 생성 모델 '클링 4.0'을 공개했다. 영상 생성 길이를 최대 30초로 늘리고 여러 이미지와 동영상을 동시에 참조할 수 있게 해 제작 정밀도와 일관성을 높였다. 최대 10개의 키프레임을 설정할 수 있고, 텍스트·이미지·기존 …

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
GPU 메모리
GPU 메모리(VRAM)는 그래픽 처리 장치에 탑재되어 모델 가중치, 활성화 값, 중간 연산 결과 등을 저장하는 고속 전용 메모리를 말한다.
파라미터
모델이 학습 과정에서 값을 스스로 조정해 나가는 내부 수치로, 입력을 출력으로 변환하는 계산 방식을 결정하는 요소를 말한다.
멀티모달
텍스트뿐 아니라 이미지, 음성, 영상 등 여러 종류의 데이터를 함께 이해하거나 생성할 수 있는 AI 모델의 특성을 말한다.

이 분야 브리핑

여러 매체가 함께 다룬 사안을 한 번에

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

ZDNet Korea 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →