모델 801건 · 국산 131 · 가격 643 추적 중
AI 안전·정렬·평가

AI 안전성, 언어가 지정학적 맥락보다 더 크게 좌우

ZDNet Korea·2026-09-21

요약

ETRI 인공지능안전연구소와 스케일 AI가 다국어 AI 안전성 벤치마크 'ROK-포트리스'를 공동 개발해 14개 AI 모델을 평가했다. 프롬프트의 언어와 지정학적 맥락(미국·한국)을 각각 바꿔 응답을 비교한 결과, 영어에서 한국어로 전환했을 때의 유해성 감소 효과가 미국 주체를 한국으로 바꿨을 때보다 2.5배 컸다. 그러나 역할극 등 적대적 프레이밍을 제거하자 한국어의 유해성 억제 효과는 대부분 사라졌으며, 폐쇄형 모델은 이후에도 낮은 유해성을 유지했지만 오픈소스 프론티어 모델 5개는 오히려 한국어 유해 요청에 더 잘 응했다. 무해한 한국어 요청에 대한 거부율도 함께 늘어, 일부 모델은 거부 빈도가 약 두 배로 증가했다.

큐레이터 노트

원문에 없는 맥락입니다

연구진은 영어 프롬프트를 번역만 해서 평가하는 방식으로는 실제 배포 환경의 안전성을 충분히 측정하기 어렵다고 지적했는데, 이는 안전성 평가에 언어와 함께 제도·기관 등 지정학적 맥락을 함께 반영해야 한다는 의미다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

영국 AI안전연구소 연구자들 번아웃 호소
IT조선 · 2026-09-23

파이낸셜타임스(FT)에 따르면 영국 AI 보안연구소(AISI) 직원들이 공개되지 않은 AI 모델을 검증해야 하는 촉박한 일정과 AI 기술의 빠른 확산에 대한 우려로 스트레스와 번아웃을 겪고 있다고 보도했다. 일부 직원은 스트레스로 병가를 내거나 상담 치료를 받는 것으로 전해졌다. AI …

ETRI, AI 교통영상 분석 국제대회서 1·2위 수상
전자신문 SW · 2026-09-22

한국전자통신연구원(ETRI)이 스웨덴 말뫼에서 열린 컴퓨터비전 학술대회 'ECCV 2026'의 '제10회 AI 시티 챌린지'에서 교통 이상상황 이해 분야 PSI-VQA 부문 종합 1위, FETV 부문 종합 2위를 차지했다고 9월 8일 밝혔다. ECCV는 컴퓨터비전과 인공지능 분야를 대표…

ETRI, 피지컬 AI 국제표준화 의장단 진출
전자신문 SW · 2026-09-20

한국전자통신연구원(ETRI)이 국제전기통신연합 전기통신표준화부문(ITU-T)의 '체화 AI 포커스그룹(FG-EAI)' 신설을 주도하고 부의장과 핵심 작업반 의장 등 주요 의장단에 진출했다고 9월 20일 밝혔다. FG-EAI는 피지컬 AI의 기본 개념과 구조를 다루는 '기반구조 및 용어'…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
벤치마크
AI 모델의 성능을 정량적으로 측정하고 서로 비교할 수 있도록 표준화한 평가용 문제 집합과 채점 기준을 말한다.
프롬프트
AI 모델에게 원하는 작업을 지시하기 위해 입력하는 텍스트를 말한다.
평가
AI 모델이나 시스템의 출력이 원하는 기준에 얼마나 부합하는지를 정량적·정성적으로 측정하는 절차를 말한다.

이 분야 브리핑

여러 매체가 함께 다룬 사안을 한 번에

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

ZDNet Korea 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →