요청하신 개념 ‘프롬프트 인젝션 보안 방어’ (유형: workflow)에 대한 고품질 한국어 위키 노트를 성공적으로 작성하여 위키 저장소에 저장했습니다.
생성된 위키 노트 파일
위키 노트 주요 내용 요약
-
Frontmatter 및 메타데이터 준수
type:workflowstatus:draftcore:falsetags:['llm', 'security', 'prompt-engineering', 'agent']sources:['raw/2026년 실제로 나오는 생성형 AI 면접 질문 40선과 답변.md']created/updated:2026-08-27
-
다층 방어 체계 (Defense-in-Depth) 구조화
- 입력-지시어 구조적 분리: XML 태그 및 특수 구분자를 활용한 입력값 샌드박싱 (
[[구조화된 프롬프트 작성법]]연동). - 입력 가드레일 분류기: Llama Guard 3, DeBERTa v3 등 경량 모델을 통한 사전 인젝션/PII/주제 검증.
- 출력 검증 (Output Validation): 시스템 지시 사항 유출(Leaking) 검사 및 유해성/포맷/
[[AI 환각 현상]]필터링. - 에이전트 권한 최소화:
[[ReAct 패턴]]툴 실행 시[[agent-sandbox]]기반 실행 환경 격리.
- 입력-지시어 구조적 분리: XML 태그 및 특수 구분자를 활용한 입력값 샌드박싱 (
-
실무 예시 및 코드 수록
- Python 기반의
PromptInjectionDefensePipeline파이프라인 구현체 및 Llama Guard 3, Claude 3.5 Sonnet, GPT-4o 등 구체적 모델 적용 시나리오 작성.
- Python 기반의
-
Trade-off 및 충돌 분석
- 검증 레이어 추가에 따른 지연 시간(Latency) 및 토큰 비용 증가 간의 트레이드오프 설명.
- 과도하게 엄격한 가드레일 규칙 적용 시 정상 사용자 요청에 대한 False Positive(가짜 양성) 유발 및 UX 저해 위험성 분석.
-
상호 연동 위키 링크 (
[[개념명]]) 구성[[구조화된 프롬프트 작성법]],[[AI 환각 현상]],[[ReAct 패턴]],[[agent-sandbox]]등 지식 그래프 연동.