#prompt-injection
3 posts tagged
Paper Review09.012026-09-01 09:0014 min read
[논문 리뷰] SARA — tool output이 command가 될 때 권한을 분리하는 법
SARA 논문을 통해 tool-augmented agent에서 action induction과 runtime authorization을 분리하는 설계를 정리한다.
Paper Review06.202026-06-20 09:0015 min read
[논문 리뷰] SafeClawBench — 도구 사용 에이전트의 보안 실패를 세 단계로 보기
SafeClawBench는 도구 사용 에이전트의 보안 실패를 텍스트 동의, 감사 증거, 실제 sandbox harm으로 분리해 평가한다.