AI 아키텍처 기술 블로그

  • 홈
  • 태그
  • 방명록
  • 소개
  • 개인정보처리방침

Content Hash 1

RAG 운영 설계: 멱등 인덱싱 (Idempotent Indexing)과 중복 Chunk 방지

검색 증강 생성 (Retrieval-Augmented Generation, RAG) 데모에서는 문서를 읽고 검색 단위 조각 (Chunk)으로 나눈 뒤 벡터 표현 (Embedding)을 저장하면 작업이 끝난 것처럼 보입니다.운영 환경에서는 같은 수집 작업이 반복됩니다.Worker가 Vector 저장 뒤 응답을 받기 전에 종료됩니다.Scheduler와 사용자의 수동 재처리가 동시에 실행됩니다.원본 문서가 수정됩니다.문서 해석기 (Parser) 또는 문서 분할기 (Chunker) 설정이 바뀝니다.Embedding 모델이 교체됩니다.삭제된 문서의 예전 Chunk가 검색됩니다.같은 파일이 다른 이름이나 경로로 다시 들어옵니다.이 상황에서 매 실행마다 새 UUID를 만들고 Vector Database에 insert..

RAG · LLM 시스템 2026.07.29
이전
1
다음
더보기
프로필사진

AI 아키텍처 기술 블로그

수년간 개발 경험으로 전하는 AI 에이전트, RAG, MCP와 시스템 아키텍처 실전 기록

  • 분류 전체보기 (69) N
    • AI Agent · MCP (8) N
    • RAG · LLM 시스템 (5) N
    • 엔터프라이즈 아키텍처 (14) N
    • 프로젝트 문제 해결 (6)
    • 개발 도구 · 자동화 (11)
    • 기술 인사이트 (6) N
    • 보안 (19)

Tag

mcp, java, Spring Security, 기업 AI Agent, embedding, Rag, tool calling, faster-whisper, SDK 설계, ai agent, Production Readiness, owasp top 10, AI Agent 보안, Private API, 엔터프라이즈 아키텍처, MCP 보안, ai 도입, STT, Secure coding, spring boot,

최근글과 인기글

  • 최근글
  • 인기글

최근댓글

공지사항

페이스북 트위터 플러그인

  • Facebook
  • Twitter

Archives

Calendar

«   2026/08   »
일 월 화 수 목 금 토
1
2 3 4 5 6 7 8
9 10 11 12 13 14 15
16 17 18 19 20 21 22
23 24 25 26 27 28 29
30 31

방문자수Total

  • Today :
  • Yesterday :

Copyright © Daum Corp. All rights reserved.

티스토리툴바