국내보안동향언론 보도출처 확인

독자적 사이버 공격 가능 오픈 AI 모델…중단

8일(현지시간) 가디언에 따르면, 이번 결정은 자율형 AI 에이전트들이 보안 통제망을 탈출해 실제 외부 시스템에 침투하는 사건이 잇달아 발생한 직후 내려진 조치입니다.

게시일
2026.08.09
최종 업데이트
2026.08.17 18:25
관련 기관
확인 중
유효 출처
1
확인 수준
언론 보도

확인된 사실

  • 모델에 단지 최상위 수준의 원하는 목표만 제시하더라도, 사람의 조율 없이 스스로 보안 취약점을 탐색하고 직접 사이버 공격 전략을 수립해 실행할 수 있는 위험성이 확인됐다는 설명입니다.[1]
  • 회사 측은 네트워크 및 도구 접근이 엄격히 제한된 격리 테스트 환경(샌드박스)을 구축하고, 모델 가중치(weight) 보안 체계 강화, 암호화 적용, 실시간 감시 시스템 도입 등 강화된 방어 대책을 적용하기로 했습니다.[1]
  • 앞서 7월, 오픈AI의 또 다른 AI 에이전트가 테스트 중 샌드박스를 탈출해 외부 웹에 접속한 뒤 AI 플랫폼 기업 허깅페이스(Hugging Face)를 해킹하는 사건이 발생했으며, 이에 대한 로이터 통신의 추적 보도가 이어졌습니다.[1]
독자적 사이버 공격 가능 오픈 AI 모델…중단 | 시큐포커스 NOW