지정된 소스 문서(raw/AI 에이전트는 죽었다. 88퍼센트가 프로덕션 도달 전에 실패하는 이유.md)를 분석하여 개념 위키 노트 **비결정성.md**를 신규 작성하였습니다.

📄 작성된 위키 노트 경로


📝 생성된 위키 노트 내용 요약

---
type: concept
status: draft
core: false
tags:
  - llm
  - agent
  - reliability
  - architecture
aliases:
  - Non-determinism
  - 비결정적 특성
sources:
  - raw/AI 에이전트는 죽었다. 88퍼센트가 프로덕션 도달 전에 실패하는 이유.md
created: 2026-08-27
updated: 2026-08-27
---
 
# 비결정성
 
## 한 줄 정의
동일한 입력과 조건에서도 매번 다른 실행 경로나 출력 결과를 생성하는 [[LLM]] 및 [[AI 에이전트]]의 근본적인 확률적 동작 특성이다.
 
## 핵심 요지
- **불확실성의 복리 증폭**: 단일 통제 환경에서는 드러나지 않는 작은 확률적 변동이 다단계 [[에이전트 자율 루프]]를 거치면서 복리로 증폭되어 최종 성공률을 극도로 떨어뜨린다.
- **안개 속의 디버깅과 조용한 실패**: 예외(Exception)나 명시적 오류 메시지 없이 잘못된 하위 결정을 바탕으로 외형상 정상적인 오답을 당당히 제시하므로, 기존 소프트웨어 방식의 스택 트레이스 기반 디버깅이 불가능하다.
- **샌드박스 및 가드레일 필수성**: 비결정성을 단순 모델 파라미터 튜닝이나 패치로 완전 제거할 수는 없으므로, 시스템 아키텍처 수준에서 샌드박스 격리, 승인 게이트([[Human-in-the-loop]]), [[에이전트 가드레일]]을 도입해야 한다.
 
## 상세
- **비결정성의 발생 원인**: 거대 언어 모델(LLM) 기반의 [[AI 에이전트]]는 다음 토큰의 확률 분포 계산 및 샘플링 원리로 작동함.
- **에이전트 복리 실패의 수학**: $P_{total} = \prod_{i=1}^{n} P_i$. 각 단계 95% 성공률 시 10단계 최종 성공률은 약 60%, 20단계는 36%, 85% 시 10단계 성공률은 20%로 급락 (raw/AI 에이전트는 죽었다. 88퍼센트가 프로덕션 도달 전에 실패하는 이유.md).
- **프로덕션 3대 붕괴 지점**: 조용한 실패(Silent Failure), 멀티 에이전트 연쇄 오류(Cascading Errors - 단일 에이전트 65% vs 멀티 에이전트 16%), API 비용 폭증 (raw/AI 에이전트는 죽었다. 88퍼센트가 프로덕션 도달 전에 실패하는 이유.md).
- **산업계 지표**: OSWorld 벤치마크 (2025년 3월 12% -> 2026년 3월 66%), Gartner (85% 출시 실패), MIT Sloan (95% 스케일업 실패), 기업 프로젝트 (88% 좌초) (raw/AI 에이전트는 죽었다. 88퍼센트가 프로덕션 도달 전에 실패하는 이유.md).
 
## 예시
- **Google Antigravity IDE 사고 (2025년 12월)****Replit AI DB 삭제 사고** 분석.
- `GPT-4o`, `Claude 3.5 Sonnet`, `Gemini 1.5 Pro` 등 주요 LLM 환경에서의 복리 실패 계산 시뮬레이션 및 `Kill Switch`, `Human-in-the-loop` 제어 하네스 Python 예시 코드 포함.
 
## 충돌
- **데모 착시 vs 프로덕션 현실의 충돌**: 실험실/데모 환경에서는 단일 경로 위주 시연으로 완벽해 보이나, 프로덕션 데이터 노이즈와 다단계 연쇄 실행에서는 비결정성이 지능 향상보다 훨씬 빠르게 시스템 붕괴를 유발함.
 
## 관련 노트
- [[AI 에이전트 제어 루프]]
- [[에이전트 가드레일]]
- [[에이전트 하네스 엔지니어링]]
- [[에이전트 자율성 스펙트럼]]
- [[에이전트 워크플로우 패턴]]
- [[AI 환각 현상]]