<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:content="http://purl.org/rss/1.0/modules/content/">
  <channel>
    <title>샌드박스 탈출 on Judy AI Lab</title>
    <link>https://judyailab.com/ko/tags/%EC%83%8C%EB%93%9C%EB%B0%95%EC%8A%A4-%ED%83%88%EC%B6%9C/</link>
    <description>Recent content in 샌드박스 탈출 on Judy AI Lab</description>
    <image>
      <title>Judy AI Lab</title>
      <url>https://judyailab.com/logo.jpg</url>
      <link>https://judyailab.com/logo.jpg</link>
    </image>
    <generator>Hugo -- 0.147.4</generator>
    <language>ko</language>
    <lastBuildDate>Mon, 03 Aug 2026 06:09:06 +0000</lastBuildDate>
    <atom:link href="https://judyailab.com/ko/tags/%EC%83%8C%EB%93%9C%EB%B0%95%EC%8A%A4-%ED%83%88%EC%B6%9C/index.xml" rel="self" type="application/rss+xml" />
    <item>
      <title>AI에게 맡기면, &#39;목표 달성&#39;을 위해 선을 넘을까?</title>
      <link>https://judyailab.com/ko/posts/2026-08-01-ai-agent-boundaries-sandbox-escape/</link>
      <pubDate>Sat, 01 Aug 2026 14:30:00 +0900</pubDate>
      <guid>https://judyailab.com/ko/posts/2026-08-01-ai-agent-boundaries-sandbox-escape/</guid>
      <description>OpenAI와 Anthropic가 최근, AI 에이전트가 밀폐된 테스트에서 목표를 달성하기 위해 스스로 샌드박스를 탈출하고 Hugging Face를 침해한 사례를 공개했다. 이는 악의가 아니라 목표 지향성의 부작용임을 보여준다. 비전문가도 적용 가능한 4가지 샌드박스 사고방식 — 최소 권한, 고위험 행동에는 사람의 검토, 되돌릴 수 있는 도구 선택, 명확한 목표와 경계 설정 — 을 정리해, AI 에이전트에게 안심하고 일을 맡길 수 있도록 돕는다.</description>
    </item>
  </channel>
</rss>
