o2o-plagiarism-ai/tests
hbyang b73d27a850 feat: split author/admin detect views and add case matching KPI basis
월례회의 자료(2026-09-18) p.7 파이프라인의 3단계 「저자 화면에는 케이스 코드를
노출하지 않는다」를 구현하고, 후속 합의에 필요한 문서를 함께 남긴다.

- DetectOptions.audience(admin 기본 / author). author 직렬화에서 case_id,
  case_candidates, tags, legal_risk, is_infringement 을 제외하고 ccl_basis 를
  코드 없는 문장으로 대체한다. 일치 위치와 점수는 유지한다.
- is_infringement 는 필수 bool 로 둔다. run_precision_eval.py 등 소비자가 bool
  로 읽으므로 선택 필드로 두면 None 이 조용히 흘러간다. 제외는 직렬화에서만 한다.
- publication_verdict 필드 추가. 컴북스 코드표 미확보이므로 39건 전부 null 이며
  null 을 출간 허용으로 해석하지 않는다. enum 과 대표값 선정은 코드표 수령 후.
- request_id / taxonomy_version 을 응답에 싣는다. 관리자 확정 로그와 연결된다.
- engine_version 기본값을 2.2.1-cases-v1.3 으로 맞춘다. 직전 값(2.0.1)이 King
  운영값 2.2.0-persistent-cpu 보다 낮아 성적서 대조 시 뒤집혀 보였다.

케이스 정의는 39건(A 27건)을 유지한다. 회의 자료의 40건(A 28건)과 1건 차이가
있으나 아카이빙 DB v2.3 원본을 받기 전까지 추측해 채우지 않는다.

7,786편 운영 재검사는 모집단 불일치(현재 6,343건)로 중단했고 부분 실행은 집계하지
않는다. 별도 평가셋 재측정은 기존 testset_v2 수치(precision 98.4032%)를 그대로
재현했으며 새 독립 시험 결과가 아니다. 상세는 reports/CASE_MATCHING_EVAL_*.json.

Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com>
2026-09-18 16:16:33 +09:00
..
test_ai_detector.py AI 의심도 백분위 캘리브레이션 (학습·지표 없이 운영) 2026-08-11 09:05:48 +09:00
test_ai_training_split.py Claude 리뷰 기반 운영 안정성 보강 2026-08-10 16:42:17 +09:00
test_api.py feat: 저작권 탭 경량 응답 API 추가 2026-08-18 12:47:51 +09:00
test_auth_middleware.py Claude 리뷰 기반 운영 안정성 보강 2026-08-10 16:42:17 +09:00
test_case_coverage.py feat: expand infringement case matching to v1.3 precedent mapping 2026-09-18 15:42:34 +09:00
test_case_matching_views.py feat: split author/admin detect views and add case matching KPI basis 2026-09-18 16:16:33 +09:00
test_clean_ai_samples.py feat: 전달 파일 전용 정책과 AI 표본 품질 감사 추가 2026-08-21 08:44:22 +09:00
test_clustering.py 2단계 고도화 선행 작업: 군집화·요약·평가환경·데이터 스펙 (데이터 수령 전) 2026-06-18 13:16:07 +09:00
test_coverage_and_features.py Claude 리뷰 기반 운영 안정성 보강 2026-08-10 16:42:17 +09:00
test_dual_similarity.py Initial commit: O2O 저작권 침해 여부 탐지 API 2026-05-13 11:20:17 +09:00
test_frontend_legal_risk.py feat: 전체 판례 검색과 판례 탭 추가 2026-08-20 16:20:37 +09:00
test_generate_ai_samples.py feat: GPU 생성 작업 샤딩 지원 2026-08-20 17:19:41 +09:00
test_legal_risk.py feat: 전체 판례 검색과 판례 탭 추가 2026-08-20 16:20:37 +09:00
test_metadata_eval.py 2단계 고도화 선행 작업: 군집화·요약·평가환경·데이터 스펙 (데이터 수령 전) 2026-06-18 13:16:07 +09:00
test_ocr_normalize.py feat: OCR·조판 아티팩트 정규화와 백분위 컷 캘리브레이션 2026-08-19 13:53:59 +09:00
test_pdf_compliance.py feat: expand infringement case matching to v1.3 precedent mapping 2026-09-18 15:42:34 +09:00
test_precedent_api.py feat: 전체 판례 검색과 판례 탭 추가 2026-08-20 16:20:37 +09:00
test_precedent_collector.py feat: 판례 GPT 판단과 연동 가이드 최신화 2026-08-18 11:10:02 +09:00
test_preference.py 2단계 고도화 선행 작업: 군집화·요약·평가환경·데이터 스펙 (데이터 수령 전) 2026-06-18 13:16:07 +09:00
test_provenance_index.py feat: add anonymized infringement batch reporting 2026-09-02 09:23:45 +09:00
test_py39_compat.py fix: 평가환경(python 3.9)에서 임포트 실패 해결 2026-08-19 14:02:29 +09:00
test_review_regressions.py Claude 리뷰 기반 운영 안정성 보강 2026-08-10 16:42:17 +09:00
test_rouge.py fix: 요약 ROUGE를 계획서 수식에 맞춤 (F1 → recall, 다중 참조) 2026-08-19 13:54:22 +09:00
test_source_extraction.py 3.5만 에피소드 기반 표절·AI·판례 분석 파이프라인 구현 2026-08-10 16:12:15 +09:00
test_static_ui.py feat: 프론트에 AI 생성 의심도 표시 2026-08-11 09:02:04 +09:00
test_structural.py Initial commit: O2O 저작권 침해 여부 탐지 API 2026-05-13 11:20:17 +09:00
test_summarizer.py feat: 수령 자서전 데이터 파이프라인과 맞춤 요약 추가 2026-08-20 16:59:17 +09:00
test_summary_annotation_packet.py feat: 요약 검수 패킷과 수기집 원본 수집 도구 추가 2026-08-20 17:24:39 +09:00
test_training_data.py feat: 수령 자서전 데이터 파이프라인과 맞춤 요약 추가 2026-08-20 16:59:17 +09:00