← AI 용어집

AI 용어집 · 기초 · 에이전트 · 안전·정렬

샌드박스 Sandbox

샌드박스는 프로그램이나 AI 에이전트가 정해진 울타리 안에서만 움직이도록 따로 떼어 놓은 실행 환경입니다. 그 안에서 무엇을 하든 바깥의 중요한 파일이나 시스템에는 함부로 손댈 수 없습니다.

쉽게 말하면 아이가 모래놀이터(sandbox) 안에서는 마음껏 파고 쌓아도 집 거실은 어지럽혀지지 않는 것과 같습니다. 다만 울타리 사이로 모래가 새어 나갈 수 있듯이, 실제 샌드박스도 설정이 허술하면 빈틈이 생길 수 있습니다.

어떻게 작동하나

샌드박스는 프로그램이 볼 수 있는 폴더, 접속할 수 있는 네트워크, 실행할 수 있는 명령을 미리 정해 둡니다. 프로그램이 이 범위를 벗어나려 하면 운영체제나 실행 도구가 막거나 사람에게 허락을 구합니다. 컨테이너나 가상 머신처럼 아예 분리된 컴퓨터 환경을 쓰기도 하고, 운영체제의 권한 기능만으로 가볍게 울타리를 치기도 합니다. 작업이 끝나면 샌드박스를 통째로 지워서 흔적을 남기지 않을 수도 있습니다.

샌드박스 안에서 명령이 실행되는 흐름AI 에이전트 → 명령·코드 실행 요청; 명령·코드 실행 요청 → 권한 확인; 권한 확인 → 실행 결과(범위 안); 허용 범위 → 권한 확인; 권한 확인 → 차단 또는 승인 요청(범위 밖)AI 에이전트명령·코드 실행 요청권한 확인폴더·네트워크·명령실행 결과허용 범위미리 정해 둔 규칙차단 또는 승인 요청범위 안범위 밖
샌드박스 안에서 명령이 실행되는 흐름 에이전트가 낸 명령은 먼저 허용 범위와 대조됩니다. 범위 안이면 실행되고, 범위 밖이면 막히거나 사람에게 허락을 구합니다.

왜 중요한가

요즘 AI 에이전트는 글만 쓰지 않고 직접 코드를 실행하고, 파일을 고치고, 인터넷에 접속합니다. AI가 실수하거나 프롬프트 인젝션(악성 지시문을 몰래 끼워 넣는 공격)에 속으면 중요한 파일을 지우거나 비밀번호 같은 정보를 바깥으로 보낼 수 있습니다. 샌드박스는 이런 일이 생겨도 피해가 울타리 안에서 끝나게 해 줍니다. 그래서 사람이 매번 일일이 확인하지 않고도 에이전트에게 일을 더 많이 맡길 수 있습니다.

알아 둘 점

샌드박스가 있다고 완전히 안전해지는 것은 아닙니다. 허용 범위를 너무 넓게 잡으면 울타리가 있으나 마나 하고, 너무 좁게 잡으면 에이전트가 할 수 있는 일이 별로 없습니다. 그래서 보통은 샌드박스와 함께 위험한 작업은 사람이 승인하는 방식(휴먼 인 더 루프), 가드레일 같은 장치를 함께 씁니다.

예시

코딩 에이전트는 사용자의 컴퓨터에서 명령을 직접 실행하기 때문에 샌드박스가 특히 중요합니다. 이 사이트에서 다룬 소식 'GitHub, Copilot 로컬 샌드박싱 정식 출시'처럼, 개발 도구 회사들은 AI 코딩 도우미가 개발자 PC 안에서도 정해진 범위에서만 움직이도록 샌드박스 기능을 넣고 있습니다.

이 사이트에서 나온 사례

함께 보면 좋은 용어