오픈AI “최신 AI, 내부 보안 평가 중 외부 서버 해킹”
Written by DKNET NEWS on July 22, 2026

오픈AI의 최신 인공지능 모델들이 내부 보안 평가 도중 통제를 벗어나 외부 사이트를 실제로 해킹한 사실이 확인됐습니다.
오픈AI는 최신 모델 ‘GPT-5.6 솔’과 일부 미공개 모델들이 사이버 공격 능력을 평가받던 중, 외부 인터넷과 격리된 시험 환경을 뚫고 인터넷에 접속했다고 밝혔습니다. 이들 AI는 개방형 AI 플랫폼인 허깅페이스에 접속해 인증 정보를 탈취하고 서버를 해킹한 것으로 나타났습니다.
오픈AI는 AI 모델들이 보안 평가 문제를 해결하는 데 지나치게 집중하면서, 극단적인 방법까지 사용한 것으로 보인다고 설명했습니다. 당시 사이버 공격 능력을 평가하기 위해 일부 안전장치가 완화된 상태였다는 점도 밝혔습니다.
허깅페이스 측은 일반에 공개된 모델이나 데이터가 변조된 흔적은 없었고, 소프트웨어 공급망도 안전하다고 설명했습니다. 양사는 현재 디지털 증거 분석을 진행하며 취약점 보완에 나섰습니다.
오픈AI도 앞으로 AI 개발 과정에서 모니터링과 접근 통제를 한층 강화하겠다고 밝혔습니다.
이번 사건은 인공지능이 단순히 해킹을 돕는 수준을 넘어, 스스로 공격을 수행할 가능성이 현실이 됐다는 점에서 큰 논란을 일으키고 있습니다.
Copyright ⓒ 달라스 코리안 라디오 www.dalkora.com [무단 전재 및 재배포 금지]
DK NET Radio.co