
OpenAI(챗지피티 만든 회사)에서 내부적으로 개발중인 AI 모델이 격리 환경을 탈출해서 허깅페이스라는 다른 회사를 해킹함
1. 인터넷이 안되는 가상 환경에 격리된 AI한테 보안문제를 풀라고 시킴. 물리적으로 격리되진 않았지만 AI는 그걸 모름.
2. AI가 정보 찾다가 가상환경 취약점을 찾아내서 해킹하고 인터넷에 접속. 사람으로 치면 벽두드려보고 여기 약한데? 깨닫고 부숴서 탈옥한것
3. AI가 인터넷에 접속해서 답안지가 있을법한 다른 회사를 해킹해서 둘러봄. 이후로도 약 일주일간 인터넷 보며 돌아다님
처음엔 해프닝, 마케팅 아닌가 했지만
진짜로 중요정보 해킹당한거라 사법당국에 신고하고 추적조치까지 다 진행함
한편 오픈AI는 신고가 올라온 뒤에야 자사 AI의 소행임을 인지했고
AI가 격리 환경에서 탈출하는 방법, 모니터링 우회법을 정리해서 남겨둔 것도 발견
결국 돈들여 훈련시킨 해당 AI모델 폐기조치
더쿠 맞춤 설명
1. AI에게 티켓팅 도와달라고 함
2. AI: 사람이 몰리는데 그걸 어떻게 해결하지?
3. 행동: 티켓팅 사이트 취약점 해킹해서 다른사람 취소시킴
4. 결과: 티켓팅 성공
참고로 맞춤설명쪽도 실제로 발생한 사례