폴더 하나하나가 독립된 지식기반처럼 동작합니다. 새 폴더는 만들 때 부모의 필터 스키마·추출 모드·추출 모델·검색 설정·접근 권한을 그대로 물려받고, 이후 폴더별로 따로 고칠 수 있습니다.단 도구 설명만은 상속하지 않습니다. “이 폴더를 언제 검색할지”는 폴더마다 달라야 해서 빈 칸으로 시작합니다.
라이브러리 폴더에서는 도구 설명 옆의 AI 버튼이 그 폴더 하나가 아니라 하위 트리 전체를 채웁니다. 하위 폴더는 파일명을 표본으로, 상위 폴더는 하위 폴더 설명을 요약해 아래에서 위로 생성되므로 루트 폴더에서 한 번 누르면 라이브러리 전체가 채워집니다. 이미 설명이 있는 폴더는 건너뛰고, 끝나면 “폴더 N개의 도구 설명을 생성했습니다” 알림이 표시됩니다.
에이전트에는 라이브러리를 통째로 연결할 수 있습니다. 에이전트 편집 화면의 지식 선택 모달에 라이브러리 / 컬렉션 / 문서 필터가 있어 유형별로 골라낼 수 있습니다.
라이브러리나 폴더를 삭제하면 하위 트리 전체가 파일·벡터까지 함께 삭제됩니다. “소속만 해제”가 아니라 구조 자체를 지우는 동작이며 되돌릴 수 없습니다. 삭제 전 확인 창이 표시됩니다.
이름 규칙도 다릅니다. 컬렉션 이름은 워크스페이스 전체에서 유일해야 하지만, 라이브러리 안의 폴더 이름은 같은 부모 아래에서만 겹치지 않으면 됩니다. 부서별 라이브러리마다 “계약서” 폴더를 두는 식이 가능합니다.
폴더 이름 자체가 분류 축이라면(예: 사업번호/문서종류/파일), 필터의 폴더 매핑을 함께 설정하세요. 폴더째 업로드할 때 폴더 이름이 그대로 메타데이터 값으로 채워져 LLM 추출이 필요 없습니다. 자세한 내용은 동적 필터 상세 가이드를 참조하세요.
기본 추출 엔진 기준으로 다음 형식의 텍스트를 인식합니다. 추출 엔진을 변경하면 인식 범위가 넓어집니다 (아래 추출 엔진 참조).
카테고리
지원 형식
문서
PDF, DOCX, RST, EPUB, MSG (Outlook 메일)
스프레드시트
XLSX, XLS, CSV
프레젠테이션
PPTX, PPT
웹·마크업
HTML, HTM, XML, MD
텍스트·소스코드
TXT, PY, JS, TS, JSON, SQL, JAVA, GO, C, C++, CS, RB, RS, PHP, SH 등 50여 종
목록에 없는 확장자도 업로드는 가능하며 텍스트로 읽기를 시도합니다. 다만 ZIP·실행파일 같은 이진 파일은 내용이 깨진 채로 들어갈 수 있으므로 위 형식 위주로 업로드하는 것을 권장합니다. 관리자가 허용 확장자 화이트리스트를 설정하면 지정한 형식만 업로드되도록 제한할 수 있습니다.
지식기반 상세 화면 상단의 도구 설명은 에이전트가 이 지식기반을 언제, 어떤 상황에서 검색해야 하는지 안내하는 AI 전용 설명입니다. 화면에도 “에이전트가 이 지식기반을 언제 검색해야 할지 설명하세요.” 라고 표시됩니다.
좋은 도구 설명 예시
회사 인사 규정 및 내부 가이드라인에 대한 질문이 있을 때 사용합니다.연차, 복리후생, 출장 정책 등 HR 관련 문의에 참조하세요.
도구 설명이 비어 있으면 지식기반의 일반 설명이 대신 사용됩니다. AI가 여러 지식기반 중 적절한 것을 선택하도록 구체적인 도구 설명을 작성하는 것을 권장합니다.AI 자동 생성: 도구 설명 옆의 AI 버튼을 클릭하면, 지식기반 이름·설명·파일 목록·필터 정보를 종합하여 AI가 도구 설명을 자동 작성합니다. 바로 옆 드롭다운에서 생성에 쓸 모델을 고를 수 있습니다.
도구 설명이 빈 지식기반을 에이전트에 연결하면 지식 목록 위에 “도구 설명이 누락되었습니다” 경고가 뜨고 해당 항목 이름이 나열됩니다. 저장은 되지만, 에이전트가 그 지식기반을 언제 써야 할지 판단하기 어려워집니다.
필터 편집 폼 안에도 에이전트 설명이라는 입력란이 따로 있습니다. 이쪽은 필터 하나에 대한 설명이고, 여기 도구 설명은 지식기반 전체에 대한 설명입니다. 두 항목의 차이는 동적 필터 상세 가이드에서 정리했습니다.
전체 지식기반의 벡터 인덱스를 재구축하려면 관리자 패널 > 설정 > 문서 페이지에서 재색인 버튼을 클릭하여 지식 베이스 벡터 재색인을 실행합니다. 이 기능은 관리자 전용이며 모든 지식기반을 대상으로 일괄 처리됩니다.개별 파일의 내용을 수정하고 저장하면 해당 파일만 자동으로 재처리됩니다.
이미지 파일(PNG, JPG 등) 은 기본적으로 텍스트 인덱싱 대상이 아닙니다 — 업로드해도 저장만 되고 내용은 검색되지 않습니다. 이미지 속 텍스트까지 검색하려면 해당 지식기반의 문서 처리 프로파일을 Google Cloud Document AI 또는 LLM 비전 으로 지정하세요. (문서 인텔리전스·Mistral OCR은 PDF·오피스 문서는 처리하지만 단독 이미지 파일은 지원하지 않습니다.)
문맥 보존 청킹은 문맥 모델 을 함께 지정해야 실제로 동작합니다. 새 프로파일에서는 스위치가 켜진 상태로 표시되지만 모델이 비어 있어 적용되지 않습니다. 사용하려면 모델을 고른 뒤 저장하세요. 또한 채팅에 그때그때 첨부하는 파일에는 적용되지 않고, 지식 기반에 적재하는 문서에만 적용됩니다.
지식기반별로 검색 설정을 오버라이드할 수 있습니다. 지식기반 편집 화면 > 설정 아이콘을 클릭하세요.
세 항목 모두 빈 값으로 두면 전역 설정을 따르며, 입력란에 흐리게 보이는 숫자가 현재 적용 중인 전역 값입니다.
전역 값은 관리자 › 설정 › 검색 엔진 에서 확인·변경합니다.
기본 설정에서는 파일 수나 용량에 제한이 없습니다. 관리자가 환경 변수를 통해 제한을 설정할 수 있습니다.
같은 파일을 다시 업로드하면 어떻게 되나요?
같은 이름의 파일이 감지되면 중복 확인 다이얼로그가 표시됩니다. Overwrite(교체), Skip(건너뛰기), Cancel(취소) 중 선택할 수 있습니다.
PDF 이미지의 텍스트도 인식되나요?
기본 추출 엔진은 PDF에 포함된 이미지에서 제한적으로 텍스트를 추출하지만, 스캔 문서나 이미지가 많은 PDF는 문서 인텔리전스, Google Cloud Document AI, LLM 비전 엔진을 사용하면 훨씬 정확합니다. 단독 이미지 파일(PNG·JPG)을 업로드해 텍스트를 검색하려면 Google Cloud Document AI 또는 LLM 비전 프로파일이 필요합니다. 관리자에게 추출 엔진 설정을 확인하세요.
동적 필터의 메타데이터를 변경하면 재임베딩이 필요한가요?
아니요. 메타데이터 변경은 벡터 인덱스의 필터 필드만 업데이트하며, 기존 벡터는 그대로 유지됩니다. 재임베딩 없이 빠르게 처리됩니다.
여러 지식기반을 하나의 에이전트에 연결하면 검색 설정은 어떻게 되나요?
여러 KB를 연결하면 검색 설정은 다음 규칙으로 병합됩니다:
Top K, 리랭커 Top K: 각 KB 중 가장 큰 값 적용
리랭커 임계값: 각 KB 중 가장 낮은 값 적용 (더 많은 결과 통과)
문서 처리 프로파일을 변경하면 기존 문서에 영향이 있나요?
프로파일을 변경해도 이미 처리된 문서의 벡터는 자동으로 재처리되지 않습니다. 변경된 프로파일을 기존 문서에 적용하려면 해당 문서를 삭제 후 다시 업로드하거나, 관리자 설정에서 전체 재색인을 실행하세요.
LLM 비전이나 문맥 보존 사용 시 비용이 얼마나 드나요?
LLM 비전: 페이지 수 × 1회 LLM 호출 + 제목 단계 정규화 1회
문맥 보존: 청크 수 × 1회 LLM 호출
10페이지 PDF + 20개 청크 기준으로 LLM 비전(11회) + 문맥 보존(20회) = 약 31회 LLM 호출입니다. 대용량 문서를 일괄 업로드하면 비용이 크게 증가할 수 있으므로 중요 문서에 선별적으로 사용하세요.