26S26c

QK·2026년 9월 27일

사내 Confluence에 등록된 SOP 및 장애 이력 문서를 REST API로 조회하여 Vector DB/LLM 적재에 최적화된 Markdown 파일로 자동 변환·저장하는 완성형 Python 스크립트 파일을 생성하겠습니다.

실행 방법 및 의존성 안내

1. 필요 라이브러리 설치

pip install requests markdownify

2. 실행 예시 (환경 변수 또는 CLI 옵션 사용)

# Personal Access Token(PAT) 사용하는 경우 (사내 Confluence Server / Data Center)
python confluence_to_markdown.py \
  --url "https://confluence.mycorp.internal" \
  --page-id "12345678" \
  --token "your-personal-access-token" \
  --no-verify-ssl

# Basic Auth(ID/PW) 사용하는 경우
python confluence_to_markdown.py \
  --url "https://confluence.mycorp.internal" \
  --page-id "12345678" \
  --user "admin" \
  --password "mypassword"

해당 스크립트는 Confluence 특유의 매크로 태그(코드 블록, 인포 박스, 테이블)를 일반 Markdown으로 깨끗하게 치환하고 상단에 YAML Frontmatter를 자동으로 달아주므로, 추출 후 그대로 사내 Vector DB 적재 파이프라인에 투입할 수 있습니다. 스크립트 동작과 관련해 추가로 조정이 필요한 부분이 있으신가요?

==

profile
engineer

0개의 댓글