#agent-security
6 posts tagged
Paper Review09.152026-09-15 09:0017 min read
[논문 리뷰] EvoSafeHarness — agent safety harness를 배포 환경별로 진화시키기
EvoSafeHarness 논문을 통해 agent 보안을 고정 guardrail이 아니라 모델·도메인별 runtime harness 최적화 문제로 본다.
Paper Review09.012026-09-01 09:0014 min read
[논문 리뷰] SARA — tool output이 command가 될 때 권한을 분리하는 법
SARA 논문을 통해 tool-augmented agent에서 action induction과 runtime authorization을 분리하는 설계를 정리한다.
Paper Review07.042026-07-04 09:0013 min read
[논문 리뷰] Distributed Attacks — PR과 시간에 흩어진 코딩 에이전트 공격
코딩 에이전트 보안은 PR 하나의 diff가 아니라 여러 세션에 누적되는 상태와 공격 그래프를 봐야 한다.
Paper Review06.202026-06-20 09:0015 min read
[논문 리뷰] SafeClawBench — 도구 사용 에이전트의 보안 실패를 세 단계로 보기
SafeClawBench는 도구 사용 에이전트의 보안 실패를 텍스트 동의, 감사 증거, 실제 sandbox harm으로 분리해 평가한다.