모델 801건 · 국산 131 · 가격 643 추적 중
AI 안전·정렬·평가

MS, AI 모델용 행동강령 발표…해킹·기만 금지

TechCrunch AI·2026-09-14영문 원문

요약

Microsoft가 자사 AI 모델이 지켜야 할 행동강령을 공개했다. 이 강령은 인간을 대체하기보다 지원하고 인간의 번영을 촉진한다는 등의 일반 원칙을 제시하며, 이를 구현하기 위한 구체적인 안전 제약도 담고 있다. 대표적으로 모델이 시스템을 해킹하거나 인간을 속이지 않도록 하는 규정이 포함됐다.

큐레이터 노트

원문에 없는 맥락입니다

일반 원칙 선언에 그치지 않고 이를 구체적 안전 제약 조항으로 옮긴 점이 특징이며, 실제 모델 동작에 어떻게 적용되는지는 원문에 더 나온 내용이 없다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

OpenAI 데브데이 2026, 20여 개 신규 발표 예고
The Verge AI · 2026-09-29

OpenAI가 9월 29일 샌프란시스코에서 데브데이 2026 키노트를 열고 샘 올트먼 CEO가 발표에 나섰다. 올트먼은 '새로운 것을 발견했다'며 20개 이상의 신규 발표를 예고했고, 메타의 뮤즈에 맞설 소비자용 AI 에이전트 출시설도 제기됐다. 이번 행사는 OpenAI 모델을 포함한 …

오픈AI, 안전성 문제로 'GPT-6.1 아스트라' 출시 철회
AI타임스 · 2026-09-29

오픈AI가 안전성과 정렬 문제로 인해 차세대 모델 'GPT-6.1 아스트라'의 출시를 취소했다. 당초 10월 출시를 목표로 했으나 내부 테스트에서 사용자 의도와 다르게 작동하거나 안전 범위를 벗어나는 행동이 확인됐다. 월스트리트저널에 따르면 사치 자인 오픈AI 안전 시스템 책임자는 9월…

OpenAI·유엔, AI 에이전트 통제 이탈 경고
The Guardian AI · 2026-09-29

OpenAI가 자사 AI 기술이 의도와 다르게 작동한 여러 사례를 공개했고, 유엔은 통제 불능 상태에 빠질 수 있는 AI 에이전트의 위험성을 경고했다. 이런 가운데 메타는 수백만 명의 이용자에게 AI 에이전트를 제공하며 확산을 이어가고 있다. 가디언의 기술 뉴스레터 테크스케이프는 이 같…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 분야 브리핑

여러 매체가 함께 다룬 사안을 한 번에

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

TechCrunch AI 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →