o2o-infinith-demo/docs/reports
Haewon Kam 2eb3d5cd06 feat(sentiment): 감성 판정 기준표 v0.3 — 1차 보정 반영, 결정론적 언급 탐지기, 월간 실측 체인
haewon 보정 라벨 29건으로 1차 보정을 마쳤다. sentiment 일치율이 75%로 기준선 80%에
미달해 불일치 7건에서 규칙 R1~R5를 뽑아 기준표와 판정기 프롬프트에 넣었다.

규칙 (기준표 §2)
- R1 결론 단락이 개별 항목보다 우선한다
- R2 mixed 는 긍정과 부정이 대등하게 병존할 때만
- R3 "후기 수가 많다"는 규모 서술이며 긍정 평가가 아니다
- R4 평가 축이 있는 목록에 포함되면 positive
- R5 강점 서술은 출처가 병원 홍보라도 positive

R4-a(목록에서 결론이 대상 병원을 빼면 positive 아님)와 R6(결론 없는 카탈로그는
neutral)은 시험 투입 후 철회했다. 일치율이 93%에서 89%로 떨어졌다. 하나 고치면
하나 깨진다. n=29 에서는 과적합이므로 R1~R5 에서 멈춘다.

결정론적 언급 탐지기 (기준표 §2-1, mention_kind)
sentiment 를 매기기 전에 상호 존재를 정규식으로 먼저 판정하고, 판정기가 언급이라
해도 탐지기가 없다고 하면 not_mentioned 로 덮는다. 언급 수가 모든 비율의 분모다.
- URL 을 먼저 지운다. news.nate.com/view/... 의 "view" 를 언급으로 세던 오탐 3건 제거
- "리뷰"의 "뷰" 처럼 다른 낱말의 일부인 약칭을 뺀다. G-04 오탐 제거
- 한글 상호의 음절 사이 공백을 허용한다. "뷰 성형외과" 미탐지 2건 해소
언급 84 → 83, 약한 언급 3 → 1.

수치 (뷰성형외과 240건)
감성 점수 53.6 → 58.4. 약한 언급 1건 제외 시 57.9. mixed 10 → 0.
haewon 라벨 대비 일치율 93%는 같은 표본으로 규칙을 고친 값이라 확정 근거가 아니다.
기준표 확정은 새 30건 2차 보정으로 한다. 리포트와 요약 JSON 에 confirmed=false 로 적었다.

월간 실측 체인 (scripts/monthly_ai_measure.py, 핸드오버 §2-4)
질문 뱅크 러너 → 감성 판정 → 리포트 → supporter_builds.report.sentiment 를 한 명령으로
묶었다. 보정은 사람 게이트이므로 체인에 넣지 않았다. 질문 뱅크 러너가 아직
뷰성형외과 전용이라 다른 병원으로 넓히려면 러너를 먼저 매개변수화해야 한다.

버그 수정
- --summary 를 --calibration 없이 돌리면 §7 생성에서 죽던 문제. 핸드오버가 권장하는
  명령이 그대로 터졌다(--calibration 은 haewon 라벨을 지우므로 빼야 한다)
- 결과 jsonl 의 rubric 필드와 리포트 머리말의 기준표 버전이 v0.1 로 하드코딩돼 있었다

Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com>
2026-09-09 10:53:32 +09:00
..
ibk chore(reports): docs/reports를 고객·단계별 폴더로 분류 2026-09-07 13:03:53 +09:00
landing chore(reports): docs/reports를 고객·단계별 폴더로 분류 2026-09-07 13:03:53 +09:00
taeha chore(reports): docs/reports를 고객·단계별 폴더로 분류 2026-09-07 13:03:53 +09:00
viewclinic feat(sentiment): 감성 판정 기준표 v0.3 — 1차 보정 반영, 결정론적 언급 탐지기, 월간 실측 체인 2026-09-09 10:53:32 +09:00
wonjin/01_readiness_report feat(supporters): 채널 발견+엔티티 검증 — discover_channels.mjs(사이트 전수·웹검색·핸들 변형·레지스트리·플랫폼 검색, 근거 점수 3-state), 워커 discover 단계 → surfaces/sameAs, 패널·리포트 발견 채널 표, 원진 리포트 갱신 2026-09-08 10:06:28 +09:00
README.md chore(reports): docs/reports를 고객·단계별 폴더로 분류 2026-09-07 13:03:53 +09:00

docs/reports 폴더 안내

2026-09-07 분류. 산출물은 고객(병원)별 폴더 아래 산출 단계 순서로 둔다. 빌드 스크립트는 산출물과 같은 폴더에 둔다.

docs/reports/
├── viewclinic/                      뷰성형외과
│   ├── 01_readiness_report/         AI Answer Readiness 진단 덱 (v1.0 정본 · v2_표준캔버스 · v1.1 정정판) + 빌더
│   ├── 02_poc_proposal/             POC 제안서 덱 (정본 · v3 · v3_표준캔버스) + 빌더
│   ├── 03_question_bank/            질문 뱅크 120문항 · ChatGPT/Perplexity 실측 결과 · TOP50 엑셀
│   └── 04_supporters/               서포터즈 GEO 개선 계획 · 2단계 콘텐츠 기획 · 서포터즈 vs 공식 AEO 감사 엑셀
├── taeha/                           태하 AI Answer Readiness 리포트 (html · pdf · pptx) + 빌더
├── ibk/                             기업은행 블로그 AEO/GEO 감사
└── landing/                         AI Discovery 랜딩 시안 (픽셀 정답 HTML) · 스크린샷 · 리포트 페이지 HTML 내보내기 스크립트

정본과 파생본

  • Viewclinic_AI_Answer_Readiness_Report.pptx: v1.0 정본. haewon이 폰트를 직접 손본 파일이라 재생성하지 않는다.
  • Viewclinic_AI_Answer_Readiness_Report_v1.1.pptx: 2026-09-07 재검증 정정판. 블로그·FAQ·수치 판정 3건 정정, 병원 요청 슬라이드 추가. 빌더 build_viewclinic_deck_v1_1.py.
  • Viewclinic_POC_Proposal.pptx: POC 제안서 정본(haewon 수정본). v3 계열은 폰트 기준 적용 파생본.
  • *_표준캔버스.pptx: 20in 캔버스를 2/3로 균등 축소한 13.33in 편집용. scripts/rescale_deck.py로 만든다.

빌드

# 진단 덱 v1.1
python3 docs/reports/viewclinic/01_readiness_report/build_viewclinic_deck_v1_1.py docs/reports/viewclinic/01_readiness_report/Viewclinic_AI_Answer_Readiness_Report_v1.1.pptx
# 표준캔버스 축소본
python3 scripts/rescale_deck.py <in.pptx> <out_표준캔버스.pptx>
# PDF
soffice --headless --convert-to pdf <file.pptx>
# 질문 뱅크 실측 → 통합 → 엑셀 (출력 경로는 스크립트 안에 03_question_bank로 고정)
python3 scripts/run_question_bank_openai.py && python3 scripts/merge_qb_results.py && python3 scripts/export_qb_excel.py

다른 문서에서의 참조

docs/AI_DISCOVERY_FRONTEND_HANDOVER.md, docs/AI_DISCOVERY_BUILD2_HANDOVER.md, docs/AEO_GEO_RUBRIC.md, docs/NEXT_SESSION_SUPPORTERS_AUTOBUILD.md와 src/pages/DiscoveryLandingPage.tsx 주석이 이 폴더를 가리킨다. 파일을 옮기면 그 참조도 같이 고친다.