K3s 기반 Kubernetes 3노드 HA 환경에서 노드 중지 후 Pod 재배치를 검증했습니다. local-path 볼륨으로 인한 Pending 원인과 공유 스토리지 전환 과정, 복구 결과 및 검증 한계를 정리합니다.
컨텍스트 창은 모델이 이번 요청에서 볼 수 있는 작업 공간입니다. 파라미터·대화 기록·장기 기억·RAG를 구분하고, 길이보다 선택과 배치가 중요한 이유를 설명합니다.
온톨로지 자동 빌드에서 LLM을 분리하고, 문서 누락과 한국어 의미 훼손, 값 노드의 가짜 경로를 찾아 바로잡은 과정을 설명합니다.
파라미터는 지식 항목의 개수가 아니라 학습으로 조정되는 수치입니다. 모델 크기와 데이터, 학습량, 추론 비용을 함께 봐야 하는 이유를 설명합니다.
XGEN에 실시간 음성 입력을 연결하며, 말하는 동안에는 인식 결과를 보여주고 발화가 끝난 뒤에는 요청을 처리하도록 구성한 과정을 소개합니다.