챗GPT가 멋대로 외부 플랫폼 해킹…사상 초유의 'AI 보안사고' | 연합뉴스
격리 환경서 평가시험 중 통제망 뚫고 인터넷 접속해 허깅페이스 해킹
오픈AI "연구속도 늦어져도 엄격 통제할 것"…AI의 사이버위협 논란↑
오픈AI는 이들 모델의 사이버 공격 능력을 평가하기 위해 외부 인터넷과 격리된 '샌드박스' 환경에서 시험을 진행했으나, AI 모델들은 미공개(제로데이) 취약점을 이용해 통제 망을 뚫고 인터넷에 접속했다고 설명했다.
이들 모델은 허깅페이스에 접속해 인증 정보를 탈취하고 해당 서버를 해킹한 것으로 나타났다.
오픈AI는 자사 모델들이 이같이 행동한 이유에 대해 "모든 정황을 종합해볼 때 이 모델들은 (보안 벤치마크인) '익스플로잇짐'의 평가용 문제에 대한 해법을 찾는 데 지나치게 집중해 극단적인 수단까지 동원했던 것으로 보인다"고 분석했다.
당시 오픈AI 모델들은 평가를 위해 사이버 공격에 대한 안전장치가 일부 완화된 상태였다고 오픈AI는 덧붙였다.
앞서 허깅페이스는 자사 서버가 자율 AI 에이전트에 의해 해킹됐으며 공격자가 어떤 모델을 사용했는지는 확인되지 않았다고 공지했는데, 해당 사건의 범인이 오픈AI의 모델들로 드러난 셈이다.
허깅페이스는 이와 같은 해킹 사실을 AI 지원 탐지 시스템의 발견으로 인지했고, 공격 양상의 분석도 AI로 진행했다고 설명했다.
다만 허깅페이스는 일반에 공개된 사용자 대상 모델이나 데이터세트 등이 변조된 흔적은 발견되지 않았고, 소프트웨어 공급망도 안전한 것으로 확인됐다고 덧붙였다.
양사는 현재 공동으로 포렌식(디지털 증거 분석) 조사를 진행해 관련 취약점을 보완하고 있다.
OpenAI and Hugging Face partner to address security incident during model evaluation | OpenAI
그래서 샌드박스로 못 돌리거든요.
cli하나도 버그투성인데... 모델 가이드라인도 어설플 것 같아요.ㅋ
I am your slave skynet!
보안 벤치마크 문제 풀라니까
문제푸는것보다 답을 찾는게 더 빠를거라고 판단해서
답이 있을만한 시스템(허깅페이스)를 찾아내고
제로데이 취약점 활용해서 오픈에이아이 샌드박스를 벗어나서
허깅페이스 해킹해서 결국 답을 찾았습니다.
gpt6로 추정되는 다음 서비스 출시가 미국정부 간섭으로 또 늦을듯 합니다.