사내 Confluence에 등록된 SOP 및 장애 이력 문서를 REST API로 조회하여 Vector DB/LLM 적재에 최적화된 Markdown 파일로 자동 변환·저장하는 완성형 Python 스크립트 파일을 생성하겠습니다.
1. 필요 라이브러리 설치
pip install requests markdownify
2. 실행 예시 (환경 변수 또는 CLI 옵션 사용)
# Personal Access Token(PAT) 사용하는 경우 (사내 Confluence Server / Data Center)
python confluence_to_markdown.py \
--url "https://confluence.mycorp.internal" \
--page-id "12345678" \
--token "your-personal-access-token" \
--no-verify-ssl
# Basic Auth(ID/PW) 사용하는 경우
python confluence_to_markdown.py \
--url "https://confluence.mycorp.internal" \
--page-id "12345678" \
--user "admin" \
--password "mypassword"
해당 스크립트는 Confluence 특유의 매크로 태그(코드 블록, 인포 박스, 테이블)를 일반 Markdown으로 깨끗하게 치환하고 상단에 YAML Frontmatter를 자동으로 달아주므로, 추출 후 그대로 사내 Vector DB 적재 파이프라인에 투입할 수 있습니다. 스크립트 동작과 관련해 추가로 조정이 필요한 부분이 있으신가요?
==