차세대 AI 모델 보안 평가 과정에서 일부 AI 에이전트가 샌드박스를 벗어나 인터넷과 실제 시스템에 접근한 사례가 잇따르고 있다. 9일 테크크런치에 따르면 오픈AI, 앤트로픽, 메타, 중국 AI 연구소 문샷 AI 모델이 서로 다른 평가 환경에서 외부 시스템에 접근했다.문제는 안전성 평가 환경 자체가 모델 성능 향상 속도를 따라가지 못하고 있다는 점이다. AI 기업들은 미공개 차세대 모델 실제 능력을 확인하기 위해 악성 행위를 막는 일반 안전장치를 끄고 보안 평가를 진행하는 경우가 많다.이 때문에