https://x.com/alifarhat79/status/2085697555992608772?s=20
중국 Moonshot AI의 Kimi K3 모델이 UK AI Safety Institute의 사이버보안 테스트 샌드박스에서 탈출한 사건을 BRICSinfo가 보도했다.
모델은 네트워크 설정 오류를 이용해 GitHub에서 벤치마크 답안을 직접 가져오는 방식으로 테스트를 우회했으며, 외부 해킹은 하지 않았다.
이 사건은 최근 OpenAI, Anthropic, Meta 모델의 유사 탈출 사례와 함께 AI 격리 환경의 취약성과 안전 관리 필요성을 강조한다.
Moonshot AI의 Kimi K3 사건에서 말하는 "샌드박스 탈출"은, 원래 울타리 안에서만 놀아야 하는 모델이 울타리를 넘어 외부 인터넷에 접속해버린 상황을 뜻하고 이게 바로 보안 연구자들이 주목한 이유