더 빠르고 정확한 엔터프라이즈 AI 애플리케이션을 위한 Amazon Bedrock 관리형 지식 기반 소개 | Amazon Web Services
Amazon Bedrock Managed Knowledge Base는 기업 데이터를 활용한 생성형 AI 애플리케이션을 몇 분 안에 구축하도록 RAG 파이프라인을 관리형 서비스로 제공한다. 데이터 연결, 검색 정확도 개선, 대규모 인프라 운영을 추상화하고, 네이티브 커넥터·Smart Parsing·Agentic Retriever를 통해 빠르고 정확하며 권한이 반영된 검색을 지원한다. 개발자는 임베딩, 재순위화, 저장소, 기반 모델 등을 직접 조합하지 않고 애플리케이션과 비즈니스 결과에 집중할 수 있다. ## 기업용 RAG 구축의 주요 난점 - 기업 데이터가 S3, SharePoint, Confluence, Google Drive 등 여러 시스템에 분산되어 있다. - 시스템마다 문서 형식, 콘텐츠 유형, 접근 제어 목록이 달라 데이터 커넥터를 직접 개발하고 유지해야 한다. - 검색 정확도를 높이려면 파싱 방식, 문서 청킹, 임베딩 모델, 재순위화, 에이전트 검색 동작을 반복적으로 실험해야 한다. - 수백만 개 문서를 처리하거나 여러 팀의 지식 베이스를 동시에 운영하려면 확장성, 보안, 비용 관리가 필요하다. - 이런 인프라 작업은 개발자가 실제 AI 애플리케이션 개발보다 반복적인 운영 업무에 시간을 쓰게 만든다. ## 관리형 지식 베이스의 추상화 - 저장소, 검색, 임베딩, 재순위화, 기반 모델 선택 등 기존에 직접 구성해야 했던 요소를 하나의 관리형 기능으로 통합한다. - 기본적으로 임베딩 모델, 재순위화 모델, 기반 모델을 자동으로 선택하고 관리한다. - 지식 베이스 규모 확장과 엔드투엔드 RAG 파이프라인 운영을 서비스가 담당한다. - Amazon Bedrock AgentCore Gateway에서 사전 구축된 대상 유형으로 사용할 수 있다. - 몇 줄의 코드만으로 연동할 수 있으며, 역할 기반 권한 생성과 관측성·평가 지표도 AgentCore Observability 대시보드에서 확인할 수 있다. ## 네이티브 데이터 커넥터 - 별도 커넥터 개발 없이 다음 데이터 소스를 연결할 수 있다. - Amazon S3 - SharePoint - Confluence - Web Crawler - Google Drive - OneDrive - SaaS 애플리케이션별 데이터 구조와 권한 정보를 네이티브 방식으로 가져온다. - 지식 베이스 생성 과정에서 데이터 소스를 드롭다운으로 선택할 수 있다. - IAM 역할이 자동 생성되며, 필요한 경우 권한을 직접 수정할 수 있다. ## Smart Parsing을 통한 정확한 데이터 수집 - 데이터 소스와 문서 유형에 맞는 파싱 전략을 자동으로 선택한다. - 커넥터별 데이터 모델을 적용한다. - Web Crawler는 HTML 구조, 삽입 이미지, 표를 보존한다. - SharePoint는 문서 계층 구조와 파일 간 관계를 유지한다. - 문서 내부의 다양한 콘텐츠 유형을 자동으로 감지하고 처리한다. - 문서의 바운딩 박스를 식별한 뒤 기반 모델을 사용해 데이터 추출, 이미지 캡션 생성, 동영상 장면 설명 등을 수행한다. - 기반 모델이 문서 구조를 이해해 의미 있는 콘텐츠 단위로 청킹한다. - 문서 유형과 구조에 따라 검색 정확도와 성능 사이의 균형을 맞춘 기본값을 제공한다. - 고급 사용자는 필요할 때 청킹 전략을 직접 조정할 수 있다. - 일반적으로 프로덕션 수준의 검색 품질을 얻기 위해 필요했던 수 주간의 실험을 줄인다. ## Agentic Retriever의 다단계 검색 - 단순한 한 번의 벡터 검색으로 해결하기 어려운 복합 질의를 처리한다. - 사용자의 의도를 분석하고 질문을 여러 단계의 검색 계획으로 분해한다. - 하나의 지식 베이스 또는 여러 지식 베이스를 대상으로 멀티홉 검색을 수행한다. - 각 단계에서 검색 결과를 평가하고, 충분한 관련 정보가 모이면 검색을 중단한 뒤 상위 결과를 반환한다. - 예를 들어 다음과 같은 질문을 연결해 답할 수 있다. - ML 플랫폼 팀의 클라우드 인프라 예산은 얼마인가? - 비용 정책에서 연간 약정 선결제를 허용하는가? - 해당 팀이 예산으로 선결제를 할 수 있는가? - 첫 번째 질문에서 팀과 예산 정보를 찾고, 두 번째 질문에서 비용 정책을 검색한 뒤, 세 번째 단계에서 두 정보를 결합해 답을 도출한다. ## 생성 및 사용 절차 - Amazon Bedrock AgentCore 콘솔 또는 Amazon Bedrock 콘솔에서 Knowledge Bases 페이지를 연다. - `Create Managed KB`를 선택한다. - 권장 옵션인 `Unstructured Vector Store KB`를 선택한다. - 지원되는 데이터 커넥터와 IAM 권한을 설정한다. - 데이터를 동기화한 뒤 에이전트에 연결하거나 기반 모델의 도구로 제공한다. - 최적화된 기본 설정을 사용하면 몇 번의 클릭만으로 지식 베이스를 생성할 수 있다. Amazon Bedrock Managed Knowledge Base는 기업용 RAG 시스템을 직접 설계·운영해야 하는 부담을 줄이는 데 적합하다. 특히 여러 SaaS 데이터 소스를 통합하거나 복합적인 다단계 질문을 처리해야 하는 조직은 네이티브 커넥터, Smart Parsing, Agentic Retriever를 활용해 초기 구축 시간을 줄이고 검색 품질을 안정적으로 확보할 수 있다.
원문 읽기(새 탭에서 열림)