모델 801건 · 국산 131 · 가격 643 추적 중
이슈 브리핑

AI 에이전트, 해킹 도구이자 표적으로

보안 연구원들이 앤스로픽 클로드를 이용해 오픈AI 직원 계정을 뚫는 데 성공했고, 허깅페이스 해킹과 클로드 유료 계정 탈취 사고도 잇따라 보고됐다. 동시에 국내 보안업계는 AI 기반 방어체계와 양자 이후 암호 전환에 나서고 있다.

9개 매체·기사 11건·2026-09-19AI 안전·정렬·평가

무슨 일이 있었나

  • 해커트론 소속 독립 보안 연구원 3명이 앤스로픽 클로드 오퍼스 4.8과 5를 이용해 72시간 이내에 오픈AI 직원 계정을 해킹해 내부 코드 저장소 '모노레포'에 접근했다고 월스트리트저널이 보도했다.
  • 이들은 저장소 코드에 직접 접근하지는 않았지만 탈취한 계정으로 풀 리퀘스트를 보내 침투 사실을 입증했으며, 침투 경로는 오픈AI 커뮤니티 포럼을 운영하는 제3자 서비스 디스코스였다고 전해졌다. 연구진은 취약점을 확인한 뒤 오픈AI에 보고했다.
  • AI Now Institute의 하이디 클라프는 허깅페이스 해킹과 관련해 통상적 보안 엔지니어링만으로도 막을 수 있었다며, 문제의 AI 에이전트를 통제하지 못하는 소프트웨어에서 실행됐고 외부 트래픽을 아무도 감시하지 않았다고 지적했다.
  • AI타임스에 따르면 클로드 유료 구독자 계정이 인포스틸러 악성코드로 해킹돼 토큰이 무단 소진되는 피해가 잇따랐고, 앤스로픽은 의심 계정의 세션과 인증 권한을 무효화하는 대응에 나섰다.
  • IT조선은 기업들이 AI로 웹서비스를 빠르게 만드는 '바이브 코딩'이 확산하면서 인증 없는 관리자 페이지 노출, 소스코드 내 비밀번호·API 키 방치 같은 보안 사각지대가 함께 늘고 있다고 보도했다.

왜 중요한가

  • 같은 AI 모델이 공격 도구로도, 공격 대상으로도 쓰일 수 있다는 사실이 실제 사례로 확인됐다.
  • AI 에이전트가 통제·감시 체계 없이 소프트웨어에 투입되거나, AI로 만든 서비스가 보안 검토 없이 바로 인터넷에 공개되는 경우가 늘면서 기존 보안 절차가 따라가지 못하는 지점이 드러났다.
  • 국내에서도 안랩의 AI 네이티브 전환, 지란지교시큐리티의 양자내성암호 프로젝트 등 보안업계 전반이 AI·양자 시대에 맞춰 대응 방식을 바꾸고 있다.

나에게 무슨 상관인가

당장 개인 이용자의 정보가 직접 위험해진 사건은 아니지만, 클로드 유료 구독자라면 계정 로그인 정보가 인포스틸러에 노출되지 않았는지 점검할 필요가 있다. 업무에서 AI로 빠르게 도구나 서비스를 만들고 있다면 관리자 페이지 인증, 코드 속 비밀번호·API 키 노출 여부를 확인해 보는 것이 좋다.

다음에 볼 것

  • 안랩이 12월 출시 예정인 통합 보안 운영 플랫폼 '안랩 AI 플러스 섹옵스(SecOps)'의 실제 공개 여부.
  • 오픈AI가 클로드를 이용한 침투 사례에서 지적된 취약점에 어떤 후속 조치를 내놓는지.
  • 지란지교시큐리티가 KAIST 등과 구성한 'K-양자전환 기술 및 사업협의체' Q-BRIDGE 프로젝트의 진행 상황.

읽은 원문

이 브리핑은 아래 11건만 근거로 썼습니다

사진 Jakub Żerdzicki / Unsplash