AI 안전성, 언어가 지정학적 맥락보다 더 크게 좌우
요약
ETRI 인공지능안전연구소와 스케일 AI가 다국어 AI 안전성 벤치마크 'ROK-포트리스'를 공동 개발해 14개 AI 모델을 평가했다. 프롬프트의 언어와 지정학적 맥락(미국·한국)을 각각 바꿔 응답을 비교한 결과, 영어에서 한국어로 전환했을 때의 유해성 감소 효과가 미국 주체를 한국으로 바꿨을 때보다 2.5배 컸다. 그러나 역할극 등 적대적 프레이밍을 제거하자 한국어의 유해성 억제 효과는 대부분 사라졌으며, 폐쇄형 모델은 이후에도 낮은 유해성을 유지했지만 오픈소스 프론티어 모델 5개는 오히려 한국어 유해 요청에 더 잘 응했다. 무해한 한국어 요청에 대한 거부율도 함께 늘어, 일부 모델은 거부 빈도가 약 두 배로 증가했다.
큐레이터 노트
원문에 없는 맥락입니다
다른 매체는 이렇게 썼다
같은 사안을 다룬 다른 곳의 보도입니다
파이낸셜타임스(FT)에 따르면 영국 AI 보안연구소(AISI) 직원들이 공개되지 않은 AI 모델을 검증해야 하는 촉박한 일정과 AI 기술의 빠른 확산에 대한 우려로 스트레스와 번아웃을 겪고 있다고 보도했다. 일부 직원은 스트레스로 병가를 내거나 상담 치료를 받는 것으로 전해졌다. AI …
한국전자통신연구원(ETRI)이 스웨덴 말뫼에서 열린 컴퓨터비전 학술대회 'ECCV 2026'의 '제10회 AI 시티 챌린지'에서 교통 이상상황 이해 분야 PSI-VQA 부문 종합 1위, FETV 부문 종합 2위를 차지했다고 9월 8일 밝혔다. ECCV는 컴퓨터비전과 인공지능 분야를 대표…
한국전자통신연구원(ETRI)이 국제전기통신연합 전기통신표준화부문(ITU-T)의 '체화 AI 포커스그룹(FG-EAI)' 신설을 주도하고 부의장과 핵심 작업반 의장 등 주요 의장단에 진출했다고 9월 20일 밝혔다. FG-EAI는 피지컬 AI의 기본 개념과 구조를 다루는 '기반구조 및 용어'…
이 사안의 흐름
같은 주제를 다룬 이 사이트의 기록 — 최신순
- 2026-09-14의료 AI 레드팀 챌린지, LLM 12종 안전성 검증AI타임스
- 2026-09-16ETRI-KAIST, 로봇 길찾기 AI 챌린지 세계 1위ZDNet Korea
- 2026-09-16ETRI·KAIST 연합팀, 로봇 길찾기 대회 세계 1위전자신문 SW
- 2026-09-15정부, AI글래스 육성 위한 산학연 포럼 개최ZDNet Korea
- 2026-09-13알트먼 "2026년 오픈AI 상장 없다" 선그어AI타임스
이 글에 나온 말
이 분야 브리핑
여러 매체가 함께 다룬 사안을 한 번에
이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.
같은 분야의 다른 소식
- 오픈AI, 에이전트 보안·데이터 보호 기능 공개ZDNet Korea · 2026-09-29
- 오픈AI, 안전성 문제로 'GPT-6.1 아스트라' 출시 철회AI타임스 · 2026-09-29
- 교황 "AI 재앙 경고는 가짜뉴스 아니다" 트럼프와 대립AI타임스 · 2026-09-29
- OpenAI·유엔, AI 에이전트 통제 이탈 경고The Guardian AI · 2026-09-29
- 엔비디아, AI 에이전트 보안 플랫폼 공개AI타임스 · 2026-09-29
- 세계 AI 연구자 20인, RSI 규제 시급성 경고AI타임스 · 2026-09-29