요청하신 개념 **‘네이티브 양방향 모델’**에 대한 위키 노트를 지정된 템플릿과 작성 원칙에 따라 성공적으로 작성 완료하였습니다.
노트는 scratch/llm-wiki/wiki/네이티브 양방향 모델.md 경로에 저장되었습니다.
📝 생성된 위키 노트 요약
- Frontmatter 및 메타데이터:
type: concept,status: draft,sources,tags,aliases,created/updated날짜(2026-08-28) 규격을 준수하였습니다.
- 핵심 내용 요약 및 상세:
- 기존 직렬 파이프라인(STT LLM TTS)의 불도저형/과민반응형 말 끼어들기 오작동 원인을 분석했습니다.
- 단일 세션 기반 네이티브 양방향 모델(예:
gemini-3.1-flash-live-preview)의 오디오 입출력 스트리밍, 서버 측 VAD, 그리고interrupted신호를 받아 클라이언트 재생 큐를 비우는 메커니즘을 기술했습니다. - 오디오 PCM 규격(
16 kHz입력,24 kHz출력), 지터 버퍼, 필러 워드, 세션 복원 키(SessionResumptionConfig.handle), telephony transport 이관 등 검증 가능한 지표 및 기술적 요소를 출처 파일 경로(raw/Build a Real-Time Voice Agent in 30 Minutes (With Interruption Handling)-ko.md)와 함께 명시했습니다.
- 구체적 코드 예시:
- Python의
google-genaiSDK 기반 Live 연결 설정 및 이벤트 디멀티플렉싱/버퍼 비우기 비동기 수신 코드 예시를 포함했습니다.
- Python의
- 관련 노트 연동:
[[음성 활동 감지 (VAD)]],[[음성 인식 (STT)]],[[음성 합성 (TTS)]],[[LLM 도구 호출]],[[WebRTC]]등 타 기술 지식 노트와의 연동 지점을 설정했습니다.