요청하신 개념 ‘프롬프트 주입 방어’ (유형: workflow)에 대한 위키 노트를 작성 및 보강하여 저장했습니다.


주요 반영 내용 및 작성 요약

  1. ** frontmatter 스키마 준수**:

    • type: workflow
    • status: draft
    • sources: 지정된 소스 raw/30 Core Agentic Engineering Concepts Every Developer Should Know.md 및 기존 소스 파일 포함
    • aliases: 프롬프트 인젝션 보안 방어, Prompt Injection Defense, LLM Guardrails 등 추가
  2. 개념 통합 및 핵심 요지:

    • 신뢰의 격리 격처와 순종성: LLM 및 AI 에이전트가 입력을 무비판적으로 수용하는 특성으로 발생하는 보안 취약점 분석.
    • 공급망 공격(Supply Chain Attack): 깃허브 저장소 클론 시 악성 규칙 파일(AGENTS.md, CLAUDE.md), 출처 불명의 MCP 서버 설정, 유니코드 동철이의어(Homoglyph, 예: 키릴 문자 і)를 통한 오작동 유도 및 데이터 유출 기법 명시.
    • 다층 입출력 가드레일(Defense-in-Depth): 입력 검역(Input Sanitization)과 Pre-Tool Hook 기반 아웃풋 행위 검증(PreToolUse, Tirith), 컨테이너 샌드박싱최소 권한 원칙과의 연동 파이프라인 정리.
  3. 구체적 코드 예시 및 지표 출처 표기:

    • Python 기반의 정규식 검사, 유니코드 Homoglyph 탐지, XML 구분자 태그 격리, Pre-Tool Hook 검증 기능이 포함된 AdvancedPromptInjectionDefense 구현체 포함.
    • 소스 문서 경로 명시 (예: (raw/30 Core Agentic Engineering Concepts Every Developer Should Know.md)).
  4. 위키 네트워크 연동:

    • [[구조화된 프롬프트 작성법]], [[샌드박싱]], [[권한 관리]], [[훅]], [[ReAct 패턴]], [[AI 환각 현상]] 등과 옵시디언 위키링크로 연동.