모델 819건 · 국산 131 · 가격 656 추적 중
AI 안전·정렬·평가

에임인텔리전스, 레드티밍·가드레일로 AI 전주기 안전관리

ZDNet Korea·2026-09-17

요약

AI 보안 기업 에임인텔리전스가 'AI 리스크 컨퍼런스 서울 2026'에서 AI 취약점을 찾는 레드팀과 실시간 통제 플랫폼 '스타포트'를 결합한 안전 전략을 공개했다. 박하언 CTO는 레드팀 테스트 결과 가장 안전하다고 평가된 모델도 10분 안에 탈옥이 가능했다고 밝히며, 국제 표준 기반 평가의 필요성을 강조했다. 스타포트는 경량 가드레일 모델 '가디언'을 통해 프롬프트와 응답을 실시간 검사하고 민감정보 전송을 자동 마스킹·차단하며, AI 모델·에이전트 현황 파악과 권한 통제 기능도 제공한다. 에임인텔리전스는 60개 이상의 AI 모델을 레드팀 테스트했고 해외 20여 개 기업에 솔루션을 공급 중이라고 소개했다.

큐레이터 노트

원문에 없는 맥락입니다

레드팀(공격)과 가드레일(방어)을 하나의 플랫폼으로 묶었다는 점은, AI 안전 관리가 모델 출시 전 점검을 넘어 운영 중 실시간 통제까지 확장되는 흐름을 보여준다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

미스틴랩스·구글클라우드, AI 에이전트 행동 증명 기술 공개
테크42 · 2026-10-07

미스틴랩스가 구글 클라우드와 공동 개발한 '검증 가능한 에이전트 중재자(VAA)'를 공개했다. 프롬프트, 모델 출력, 도구 호출 등 실행 데이터는 고객이 관리하는 구글 클라우드 스토리지에 비공개로 보관하고, 데이터가 변조되지 않았음을 입증하는 암호학적 증명만 데이터 플랫폼 월러스와 블록…

KT '모두의 AI' 12월 정식 출시, 이달 비공개 베타
IT조선 · 2026-10-07

KT가 국내 AI 기업들과 함께 추진하는 '모두의 AI' 서비스를 12월 정식 출시한다고 7일 밝혔다. 이달부터 클로즈 베타를 통해 질문 의도 파악과 답변 기능 등 핵심 기능과 서비스 안정성을 검증한다. 정식 서비스에서는 쇼핑·금융·부동산 등 기존 서비스와 연계하고 예약·신청 기능을 확…

동물병원엔 AI 에이전트, 축사엔 AI 로봇 도입
테크42 · 2026-10-06

경기 성남 판교스타트업캠퍼스에서 열린 반려동물 산업 육성 협의회 제21회 IR 데이에서 벳플럭스와 로봇웨어에이아이가 발표를 진행했다. 벳플럭스는 동물병원 CRM을 AI 에이전트로 확장한 '늘펫N'을 출시해 2개월 만에 지역 거점 병원 40곳이 새로 도입했으며, 기존 서비스 포함 약 20…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
프롬프트
AI 모델에게 원하는 작업을 지시하기 위해 입력하는 텍스트를 말한다.
가드레일
가드레일은 AI 모델이 유해하거나 부적절하거나 정책에 어긋나는 입력과 출력을 만들지 않도록 시스템 차원에서 걸어두는 제약과 점검 장치를 말한다.
레드팀
AI 모델이나 시스템을 실제 공격자의 관점에서 시험해 안전장치를 우회하거나 유해한 결과를 유도할 수 있는 취약점을 체계적으로 찾아내는 활동을 말한다.
평가
AI 모델이나 시스템의 출력이 원하는 기준에 얼마나 부합하는지를 정량적·정성적으로 측정하는 절차를 말한다.

이 분야 브리핑

여러 매체가 함께 다룬 사안을 한 번에

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

ZDNet Korea 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →