사내 문서를 생성형 AI와 연결하면 우리 회사만의 지식검색과 AI 서비스가 가능해집니다. 하지만 단순히 문서를 Vector DB에 넣는 것만으로 제대로 된 RAG가 완성되지는 않습니다. 흩어진 비정형 문서의 수집과 정제, 청킹과 임베딩, 메타데이터 관리, 검색 품질은 물론 원본 문서의 접근 권한과 출처까지 함께 고려해야 합니다. 실제 기업 환경을 기준으로 신뢰할 수 있고 안전한 RAG를 구축하기 위해 필요한 데이터 파이프라인과 핵심 고려사항을 알아봅니다.