merchant_keyword(업체↔키워드 연결)와 generation_run(생성 감사 로그)이
빠져 있었다. 시트 2개를 추가해 DB 7개 테이블을 모두 담는다.
시트별 행수를 DB 와 대조해 전부 일치 확인:
키워드 7,093 / 지역 70 / 업종 9 / 업체 4 /
업체키워드 11 / QA 20 / 생성이력 4
Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com>
엑셀이 DB 와 일치하지 않았다. 기존 엑셀은 전국 JSON 에서만 뽑아
군산 상세 데이터셋 850건이 빠져 있었다 (DB 7,093 vs 엑셀 6,243).
- scripts/export-db-xlsx.py — DB 를 기준으로 뽑는다 (JSON 아님)
시트 6개: 키워드 7,093 / 지역 70 / 업종 9 / 업체 4 / QA 20 / 배포가이드
임베딩은 담지 않는다 (384 float × 7천 행). 같은 모델로 재생성하면 복원된다
- scripts/db-dump.sh — 임베딩 포함 pg_dump (13MB, .gitignore)
- npm run db:export-xlsx / db:dump
복원 검증 완료: 6개 테이블 행수 일치, 임베딩 7,093/7,093 보존,
HNSW 인덱스 재생성, 복원본에서 벡터 검색 동작 확인.
Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com>