Concept08.232026-08-23 09:0017 min read
Claude 워터마킹과 AI 텍스트 탐지 — 생성된 글은 어디까지 추적 가능한가
Claude 텍스트 워터마킹과 AI 탐지기 구현 사례를 바탕으로, 생성 텍스트를 통계적으로 식별하는 방식과 실무에서 조심해야 할 지점을 정리한다.
7 posts tagged
Claude 텍스트 워터마킹과 AI 탐지기 구현 사례를 바탕으로, 생성 텍스트를 통계적으로 식별하는 방식과 실무에서 조심해야 할 지점을 정리한다.
AI 시스템 성능을 모델 교체만으로 올리려 하기 전에 데이터 정의, 라벨 품질, 분포, 합성 데이터, 평가셋을 어떻게 설계해야 하는지 정리한다.
Agent skill은 문서가 아니라 precondition·constraint·fallback을 지켜야 하는 실행 계약이다.
K-BrowseComp는 한국 맥락의 웹 브라우징 문제로 에이전트의 검색, 증거 연결, 상태 보존 능력을 평가하는 벤치마크다.
위키·뉴스 데이터에 치우쳐 있던 RAG 벤치마크의 한계를 지적하고, Slack·Gmail·Jira 등 9종 사내 소스를 모사한 50만 문서 규모의 합성 코퍼스와 500개 질문셋을 제안한 논문.