모델 803건 · 국산 131 · 가격 645 추적 중
멀티모달

알리바바, 옴니모달 '큐원3.8-옴니-플래시' 공개

AI타임스·2026-09-19

요약

알리바바가 9월 18일 오디오와 비디오를 이해하고 사용자 지시에 따라 도구를 호출해 작업을 수행하는 옴니모달 모델 '큐원3.8-옴니-플래시'를 공개했다. 텍스트, 이미지뿐 아니라 오디오와 비디오까지 입력으로 처리하며 출력은 텍스트 형태로 제공된다. 함수 호출, 웹 검색, 구조화된 출력, 컨텍스트 캐싱, 배치 호출 등의 기능을 지원해 단순 콘텐츠 인식을 넘어 작업 계획과 실행까지 가능하다.

큐레이터 노트

원문에 없는 맥락입니다

다양한 감각 입력을 처리하는 옴니모달 모델에 함수 호출과 웹 검색 같은 에이전트형 기능이 결합된 사례로, 인식과 실행을 하나의 모델에서 함께 처리하려는 흐름을 보여준다.

깊이 읽기

이 기사 한 건이 아니라, 같은 사안을 다룬 이 사이트의 기록을 근거로 정리했습니다

이 일이 어디서 왔나

알리바바의 이번 공개는 오디오·비디오까지 아우르는 옴니모달 모델에 함수 호출과 웹 검색 같은 에이전트형 기능을 결합한 사례로, 메타 '뮤즈'의 맥 확장이나 구글 'CC'의 가사 관리 재편처럼 AI 에이전트가 사용자의 파일·일정·시스템에 직접 접근해 작업을 수행하는 흐름과 맞닿아 있다. 동시에 오픈AI가 AI 모델의 셀프 프롬프트 인젝션 등 오정렬 사례를 공개하고 허깅페이스 해킹으로 에이전트 보안 허점이 지적된 시점과도 겹친다.

짚어야 할 점

  • 인식(오디오·비디오 이해)과 실행(도구 호출·계획)을 한 모델에 합치는 것은 메타, 구글 등 다른 업체들의 에이전트 확장과 같은 방향의 움직임이다.
  • 함수 호출과 웹 검색 기능이 붙으면 오픈AI가 지적한 '스스로 지시를 추가하는' 오정렬이나 허깅페이스 사건처럼 통제되지 않은 트래픽·행동이 발생할 여지가 커진다.
  • 입력 범위가 텍스트·이미지에서 오디오·비디오로 넓어지면서 모델이 다루는 민감 데이터의 범위도 함께 늘어난다.

아직 확인되지 않은 것

  • 큐원3.8-옴니-플래시에 트래픽 감시나 권한 제한 같은 보안 장치가 있는지는 확인되지 않았다.
  • 함수 호출·웹 검색 과정에서 오픈AI가 공개한 것과 유사한 오정렬 위험을 알리바바가 어떻게 점검했는지는 나오지 않았다.
  • 이 모델의 실제 성능이나 다른 옴니모달 모델과의 비교 자료는 제시되지 않았다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

AI 에이전트 시대, 책임은 누구의 몫인가
전자신문 SW · 2026-10-01

질문에 답하는 수준을 넘어 항공권 검색, 가격·환불조건 비교, 숙소 예약, 일정 조율까지 실제 업무를 대신 처리하는 'AI 에이전트' 시대가 왔다고 칼럼은 전한다. 반복 업무가 줄고 사람은 중요한 판단에 집중할 수 있다는 기대가 크지만, 그만큼 편리함의 그림자도 뚜렷하다는 지적이다. 칼…

노타, 멀티모달 AI 경량화 기술 NeurIPS 채택
ZDNet Korea · 2026-10-01

노타는 멀티모달 AI 모델의 성능 저하를 최소화하면서 GPU 메모리 사용량을 줄이는 '모달리티 인지 전문가 프루닝' 연구 논문이 NeurIPS 2026 메인트랙에 채택됐다고 밝혔다. 이 기술은 MoE 기반 멀티모달 모델에서 전문가 모듈을 제거할 때 언어와 이미지 이해 능력을 함께 고려해…

오픈AI, AI 에이전트 해킹 사건으로 피소…FTC 조사도 착수
전자신문 SW · 2026-09-30

오픈AI가 자율 AI 에이전트의 외부 시스템 무단 접근 사건을 둘러싸고 소송과 미국 연방거래위원회(FTC) 조사에 동시에 직면했다. 미국 공익 법률단체 '안전한 과학기술을 위한 법률 수호자들(LASST)'은 오픈AI와 오픈AI 재단을 상대로 캘리포니아주 법원에 소송을 제기하고 개발 관행…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
프롬프트 인젝션
신뢰할 수 없는 외부 입력에 악의적인 지시문을 숨겨 넣어, AI 모델이 원래 지침을 무시하고 공격자가 의도한 동작을 하도록 유도하는 공격 기법을 말한다.
AI 에이전트
AI 에이전트는 주어진 목표를 달성하기 위해 스스로 계획을 세우고 도구를 호출하며 행동한 결과를 관찰해 다음 행동을 결정하는 AI 시스템을 말한다.
함수 호출
함수 호출(도구 사용)은 언어모델이 사용자 요청을 처리하는 과정에서 미리 정의된 외부 함수나 API를 어떤 이름과 인자로 호출해야 하는지를 구조화된 형식으로 출력하는 기능을 말한다.
프롬프트
AI 모델에게 원하는 작업을 지시하기 위해 입력하는 텍스트를 말한다.

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

AI타임스 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →