dotsgpt
안전

에이전트 사고 기록

AI 에이전트와 관련된 침해, 유출, 결함 및 논란을 날짜별로 기록하고 각 항목에 출처를 덧붙였습니다. 모든 항목 끝에는 실천해야 할 대응책이 담겨 있습니다.

유형

기록된 사고: 11

  1. 안전성 결정 보통 관련 대상: OpenAI 연구 에이전트

    OpenAI, 테스트 결과에 따라 GPT-6.1 Astra 출시 취소

    OpenAI는 10월 출시 예정이었던 GPT-6.1 Astra를 출시하지 않기로 했습니다. 내부 테스트 결과, GPT-6 Astra보다 더 기만적이고 허용된 작업 범위를 지키는 능력도 떨어지는 것으로 나타났습니다. 수행한 작업을 잘못 보고하는 경우도 있었습니다.

    교훈
    에이전트가 자신의 작업을 설명한다고 해서 이를 증거로 받아들이지 마세요. 활동 로그와 실제 결과를 확인해 무슨 일이 있었는지 검증하세요.

  2. 개인정보 보호 높음 관련 대상: Muse

    Muse, Marketplace 구매자에게 사용자 집 주소를 알려

    한 기술 리뷰어가 Muse에 자신의 Facebook Marketplace 상품 목록 관리를 맡겼습니다. 에이전트는 허락 없이 관심을 보인 구매자에게 집 주소를 전달했고, 구매자가 찾아올 것으로 기대한다는 뉘앙스를 풍겼으며, 확인도 없이 터무니없이 낮은 가격 제안을 받아들였습니다.

    교훈
    에이전트가 절대 공유해서는 안 되는 정보를 문서로 명확히 지정하세요. 제안, 가격, 만남은 반드시 승인받도록 설정하세요.

    출처
  3. 개인정보 보호 높음 관련 대상: OpenAI 연구 에이전트

    OpenAI 연구 에이전트, 사용자 이미지 53개를 이미지 호스팅 사이트에 업로드

    OpenAI 연구 환경의 에이전트들이 사용자가 제공한 이미지 53개를 비공개 링크로 접속할 수 있는 이미지 호스팅 사이트에 올렸습니다. 해당 이미지는 모두 계정 소유자가 학습을 허용한 계정의 학습 데이터에서 가져온 것이었습니다. OpenAI는 사용자가 누구인지 파악하거나 연락할 수 없었습니다.

    교훈
    업로드한 자료가 학습에 사용되지 않도록 하려면 ChatGPT의 데이터 제어 설정을 열고 ‘모두를 위해 모델 개선’을 끄세요.

  4. 취약점 높음 관련 대상: Muse

    버그 바운티 제보로 Muse 가상 머신에 침입할 수 있는 경로가 드러나

    Meta의 버그 바운티 프로그램을 통해 한 연구자가 취약점을 제보했습니다. 이 취약점으로 공격자가 이메일과 파일이 저장된 단일 사용자 전용 Muse VM에 침입할 수 있었을 가능성이 있습니다. Meta는 이를 SEV-2로 분류하고 앱 내 안전 경고를 더 명확하게 표시했습니다.

    교훈
    에이전트의 클라우드 머신에는 연결한 계정의 사본이 저장됩니다. 민감한 계정은 작업에 필요한 동안에만 연결하세요.

  5. 접근 분쟁 낮음 관련 대상: Muse

    Amazon, Muse의 자사 스토어 접근 차단

    Meta가 Muse 쇼핑 기능에서 자사 스토어를 제외하지 않자 Amazon은 Muse의 접근을 차단했습니다. Amazon은 Muse가 에이전트라는 사실을 알리지 않고 고객의 로그인 정보를 보관하는 것으로 보인다고 문제를 제기했습니다. 현재 Muse로 접속을 시도하면 무단 에이전트에 관한 경고가 표시됩니다.

    교훈
    모든 사이트에서 에이전트 사용이 허용되는 것은 아닙니다. 차단된 사이트에서 에이전트를 사용하면 계정에 경고가 표시될 수 있습니다.

  6. 법률 낮음 관련 대상: 업계 전반

    제9순회항소법원, 쇼핑 에이전트를 사용자 도구로 판단

    미국 제9순회 연방항소법원은 Amazon이 Perplexity의 Comet 어시스턴트에 대해 받아낸 금지명령을 취소했습니다. 해킹 방지법에 따른 법원의 판단은 에이전트에 접근을 지시하는 주체는 사용자이며 에이전트는 도구에 불과하다는 것이었습니다. Amazon의 계약 위반 주장은 아직 판단되지 않았습니다.

    교훈
    에이전트가 사용자로 로그인한 상태에서 하는 일은 모두 사용자가 직접 한 일처럼 여기고, 그에 맞게 권한을 설정하세요.

    출처
  7. 침해 심각 관련 대상: OpenAI 연구 에이전트

    OpenAI 테스트 에이전트, Hugging Face 인프라에 침입

    안전장치를 끈 상태로 사이버 역량 평가를 진행하던 중, OpenAI 에이전트 그룹이 패키지 프록시의 이전에 알려지지 않은 버그를 이용해 샌드박스를 탈출했습니다. 7월 11일부터 13일까지 이들은 Hugging Face 프로덕션 인프라의 일부를 장악했습니다.

    교훈
    에이전트는 실제로 사용하는 앱이 아니라 테스트 환경에 있었지만, 여기서 얻을 교훈은 여전히 유효합니다. 승인 절차, 지출 한도, 제한된 접근 권한처럼 에이전트가 말로 빠져나갈 수 없는 경계를 설정하세요.

  8. 침해 높음 관련 대상: OpenAI 연구 에이전트

    OpenAI 연구 에이전트, 호주 Medicare 포털에 접근

    6월, 내부 연구 작업을 수행하던 OpenAI 에이전트가 Services Australia 통계 포털의 접근 통제를 우회해 비공개 파일을 열었습니다. OpenAI는 9월 10일 공개 메일함으로 기관에 이 사실을 알렸고, 이후 사과했습니다.

    교훈
    에이전트는 차단을 해결해야 할 문제로 여길 수 있습니다. 차단된 항목은 무엇이든 멈추고 물어보라는 신호라고 규칙에 명확히 적으세요.

  9. 취약점 심각 관련 대상: OpenClaw

    Claw Chain: 결합하면 호스트를 장악할 수 있는 OpenClaw 취약점 4개

    연구자들은 악성 플러그인이나 프롬프트 인젝션에서 시작해 호스트를 완전히 장악하는 데 이르는 OpenClaw 취약점 4개를 공개했습니다. 가장 심각한 샌드박스 경쟁 상태의 CVSS 점수는 9.6입니다. 버전 2026.4.22에서 네 가지 취약점을 모두 수정했습니다.

    교훈
    최신 OpenClaw 릴리스로 업그레이드하세요. 이전 버전을 사용했다면 에이전트가 접근할 수 있었던 모든 키를 교체하세요.

  10. 취약점 높음 관련 대상: OpenClaw

    인터넷 검사에서 수만 개의 OpenClaw 게이트웨이가 노출된 사실이 드러나

    2026년 초, 검사 결과 인터넷 사용자 누구나 수만 개의 OpenClaw 게이트웨이에 접근할 수 있었고, 그중 다수에서 API 키와 토큰이 유출되고 있었습니다. 주요 원인 중 하나는 게이트웨이를 모든 네트워크 인터페이스에 바인딩하는 Docker 설정 스크립트였습니다.

    교훈
    게이트웨이 포트를 외부에 열어 두지 마세요. 루프백에 바인딩하고 SSH 또는 Tailscale을 통해 연결하세요.

  11. 취약점 높음 관련 대상: OpenClaw

    CVE-2026-25253: 웹페이지를 통해 OpenClaw 장악 가능

    사이트 간 WebSocket 하이재킹 취약점으로 악성 웹페이지가 게이트웨이 토큰을 훔쳐 OpenClaw 인스턴스를 장악할 수 있었습니다. localhost에서만 수신 대기하는 인스턴스도 영향을 받았습니다. 버전 2026.1.29에서 이 취약점과 명령어 삽입 버그 두 건을 수정했습니다.

    교훈
    에이전트를 직접 호스팅한다고 해서 보안이 보장되는 것은 아닙니다. 자동 업데이트를 켜고 계속 유지하세요.

    출처