o2o-site-AEO/solution/backend/services/seo_audit.py
Mina Choi 9d25ed613e 구조: 사장님(solution)과 내부 운영(admin)을 두 앱으로 가른다
최상단을 프로젝트 단위로 평평하게 둔다 — o2o-negosium 과 같은 규약이고, 이 레포만
다르게 갈 이유가 없다. negodata/{backend,front} 가 프로젝트 안에서 f/b 를 가르는 선례,
lps-admin/ 이 백엔드 없이 프론트만 가진 최상단 폴더의 선례다.

  backend/ frontend/{admin,site,shared}  →  solution/{backend,front,site,shared} + admin/

## 왜

내부 라우트(/local-content, /places/:id/seo)의 이름과 화면 코드가 사장님 번들에
그대로 실려 나가고 있었다. UserRole.DEVELOPER 주석의 "고객사에 존재를 노출하지 않는다"를
번들이 깨고 있었다 — 라우트 가드는 화면을 가리지 번들은 못 가린다.
번들을 갈라 확인했다: 사장님 dist 에서 local-content · /places · SeoAudit 이 전부 0건이다.

그 과정에서 두 곳이 더 새고 있었다.
- AppShell 의 NAV 배열이 내부 메뉴를 하드코딩하고 있었다. 앱을 가른 뒤에도 dist 에
  local-content 가 남아서 찾았다. 메뉴는 이제 앱이 prop 으로 들고 온다.
- EditorHeader·BuilderPage·LoginPage 가 /places 로 링크하고 있었다. 그 화면이 admin 으로
  나갔으니 사장님 앱에서는 404 다. 링크를 걷어내고 LoginPage 기본 도착지는 '/' 로 바꿨다
  (앱마다 홈이 다르고 각 라우터의 '/' 가 이미 그걸 안다).

## admin 에 백엔드를 두지 않았다

내부 화면이 부르는 훅이 전부 router/v1/{place,fact,local,validator} 에 이미 있다.
자체 백엔드를 두면 place·fact·link 를 같은 DB 에 대고 두 번 구현하게 된다.
대가는 solution/backend 가 죽으면 admin 도 멈추는 것 — 내부 도구라 감수한다.

## admin 의 `@` 는 solution/front/src 를 가리킨다

내부 화면이 쓰는 API 클라이언트·UI·수집 배선이 solution 에 한 벌만 있고 그 파일들끼리도
`@/...` 로 서로를 부른다. admin 에서 `@` 를 자기 src 로 잡으면 그 참조가 전부 깨진다
(실측 TS2307 14건). 복제하는 길도 있지만 RecollectPanel 주석이 금지한다 —
"수집 경로를 두 벌 만들면 확정 게이트"가 갈라진다.
admin 자기 파일만 `@admin` 이고, 의존 방향은 admin → solution 한 쪽뿐이다.

admin 이 여는 빌더는 다른 오리진이라 절대 URL + 새 탭이다(admin/src/lib/solutionUrl.ts).
react-router Link 로 두면 admin 안에서 라우트를 찾다 404 다.

## 그 밖

- npm 워크스페이스 루트를 레포 루트로 올렸다(admin 이 solution 밖이라).
- docker-compose 를 255→174줄로 줄이고 admin(:3002) 서비스를 넣었다. ADMIN_BIND 기본값은
  127.0.0.1 — 0.0.0.0 으로 열면 앱을 가른 의미가 없다.
- 발행 호스트를 프론트 .env 에 따로 적지 않는다. compose 가 루트의 SITE_PUBLIC_HOST 를
  VITE_PUBLISH_HOST 로 흘려보낸다 — 두 곳에 적으면 canonical 과 화면 주소가 조용히 갈라진다.
- nginx/site.conf 를 git 에서 빼고 .example 만 남겼다(.env·*.toml 과 같은 규약).
  compose 가 bind mount 하므로 클론 직후 복사해야 한다 — 없으면 Docker 가 그 자리에
  디렉토리를 만들어 nginx 가 설정 없이 뜬다.
- config.test.toml.example 을 추가했다. 없으면 클론한 사람이 pytest 를 아예 못 돌린다
  (conftest import 단계에서 죽는다). 외부 API 키는 전부 빈값이다 —
  APP_ENV=test 가 .env 를 안 읽는 이유를 여기서 우회하면 안 된다.
- 경로가 한 칸 깊어져 test_schema_ddl(parents[2]→[3]) 과 test_site_theme 을 고쳤다.

검증: front·admin·site 전부 lint 0 / build 0. 백엔드 514 passed.
남은 4건(test_build_publish 3 · test_snapshot 1)은 이 변경 전부터 실패하던 것으로,
손대지 않은 메인 체크아웃에서 같은 4건이 같게 실패하는 것을 확인했다.

Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com>
Claude-Session: https://claude.ai/code/session_019uYhHQdssRubirPirrdJJC
2026-08-31 15:12:09 +09:00

109 lines
7.2 KiB
Python

"""발행 사이트 SEO/AEO 준비도 채점.
점수는 검색 순위를 보장하는 외부 공인 점수가 아니라, 우리 빌더가 통제할 수 있는 신호의
완성도다. 같은 입력은 언제나 같은 결과를 내도록 순수 함수로 두어 UI와 발행 흐름이 서로
다른 기준을 말하지 않게 한다.
"""
from dataclasses import dataclass
@dataclass(frozen=True)
class AuditCheck:
id: str
group: str
label: str
points: int
earned: int
status: str
detail: str
recommendation: str | None = None
def as_dict(self) -> dict:
return self.__dict__.copy()
def _check(id, group, label, points, passed, detail, recommendation=None, partial=0):
earned = points if passed else min(points, max(0, partial))
status = "pass" if earned == points else ("warn" if earned > 0 else "fail")
return AuditCheck(id, group, label, points, earned, status, detail, recommendation)
def evaluate(snapshot: dict, *, verified: bool, site=None, version=None, ai_checks: list | None = None) -> dict:
place = snapshot.get("place") or {}
facts = snapshot.get("facts") or []
faqs = snapshot.get("faqs") or []
media = snapshot.get("media") or []
built = bool(version and getattr(version, "built_at", None))
unique_count = int(getattr(version, "unique_content_count", 0) or 0) if version else 0
domain = (getattr(site, "domain", None) or "").strip() if site else ""
fact_count = len([f for f in facts if str(f.get("value") or "").strip()])
sourced = len([f for f in facts if f.get("source_url") or f.get("verified_at")])
image_with_alt = len([m for m in media if str(m.get("alt_text") or "").strip()])
seo = [
_check("built", "기술 SEO", "정적 HTML 빌드", 15, built,
"크롤러가 자바스크립트 없이 읽을 수 있는 발행본이 있습니다." if built else "아직 빌드된 정적 발행본이 없습니다.",
"사이트를 빌드·발행하세요."),
_check("domain", "기술 SEO", "고유 주소와 canonical", 10, bool(domain),
f"고유 주소 {domain}이 canonical 기준이 됩니다." if domain else "고유 사이트 주소가 정해지지 않았습니다.",
"발행 전 사이트 주소를 확정하세요."),
_check("machine_files", "기술 SEO", "robots·sitemap·구조화 데이터", 15, built,
"robots.txt, sitemap.xml, JSON-LD가 발행본에 포함됩니다." if built else "기계용 파일은 빌드 시 생성됩니다.",
"빌드를 완료해 기계용 파일을 생성하세요."),
_check("address", "콘텐츠 SEO", "주소", 8, bool(place.get("road_address") or place.get("address")),
"지역 검색에 사용할 주소가 있습니다." if place.get("road_address") or place.get("address") else "주소가 없습니다.",
"도로명 주소를 확인하세요."),
_check("phone", "콘텐츠 SEO", "전화번호", 7, bool(place.get("phone")),
"전화 문의 답변에 사용할 번호가 있습니다." if place.get("phone") else "전화번호가 없습니다.",
"공식 전화번호를 등록하세요."),
_check("facts", "콘텐츠 SEO", "고유 정보량", 15, fact_count >= 8,
f"확인된 사업장 정보가 {fact_count}건입니다.", "영업시간·가격·시설 등 확인된 정보를 8건 이상 채우세요.",
partial=min(10, fact_count)),
_check("images", "콘텐츠 SEO", "설명 있는 이미지", 10, image_with_alt >= 3,
f"alt 설명이 있는 이미지가 {image_with_alt}장입니다.", "대표·내부·상품 사진을 3장 이상 승인하세요.",
partial=min(6, image_with_alt * 2)),
_check("unique", "신뢰·품질", "고유 콘텐츠", 10, unique_count > 0,
f"최근 빌드의 고유 콘텐츠 판정은 {unique_count}건입니다." if version else "고유 콘텐츠를 판정할 빌드가 없습니다.",
"복제 문구가 아닌 사업장 고유 소개·FAQ·사진을 추가하세요."),
_check("verified", "신뢰·품질", "동일 업소 검증", 10, verified,
"공식 사업장으로 검증되었습니다." if verified else "동일 업소 검증 전입니다.", "사업장 검증을 완료하세요."),
]
aeo = [
_check("entity", "엔티티", "사업장 엔티티 식별", 20, verified and bool(place.get("road_address") or place.get("address")),
"상호와 검증된 주소로 사업장을 명확히 식별합니다." if verified else "사업장 정체성 신호가 부족합니다.",
"사업장을 검증하고 공식 주소를 채우세요."),
_check("geo", "엔티티", "좌표와 지역 문맥", 10, place.get("latitude") is not None and place.get("longitude") is not None,
"좌표를 구조화 데이터에 제공할 수 있습니다." if place.get("latitude") is not None else "좌표가 없습니다.",
"검증된 위도·경도를 등록하세요."),
_check("answers", "답변 가능성", "확인된 사실", 20, fact_count >= 8,
f"AI가 답변에 사용할 확인된 사실이 {fact_count}건입니다.", "고객이 자주 묻는 영업·이용 정보를 보강하세요.",
partial=min(15, fact_count * 2)),
_check("faq", "답변 가능성", "질문형 FAQ", 20, len(faqs) >= 3,
f"발행 가능한 FAQ가 {len(faqs)}건입니다.", "실제 고객 질문과 짧고 단정적인 답변을 3건 이상 승인하세요.",
partial=min(12, len(faqs) * 4)),
_check("llms", "기계 가독성", "JSON-LD·llms.txt", 15, built,
"구조화 데이터와 llms.txt가 생성되었습니다." if built else "빌드 전이라 기계용 요약이 없습니다.",
"사이트를 빌드해 JSON-LD와 llms.txt를 생성하세요."),
_check("sources", "신뢰성", "출처와 검증 시각", 10, fact_count > 0 and sourced == fact_count,
f"확인된 정보 {fact_count}건 중 {sourced}건에 출처 또는 검증 시각이 있습니다.",
"출처가 없는 정보는 사장님 확인을 거쳐 검증 시각을 남기세요.", partial=5 if sourced else 0),
_check("freshness", "신뢰성", "최신 발행본", 5, built,
"최근 빌드 시각을 검색엔진에 제공합니다." if built else "발행 시각 신호가 없습니다.", "변경 내용을 다시 빌드하세요."),
]
ai_checks = ai_checks or []
cited = sum(1 for row in ai_checks if getattr(row, "is_own_site_cited", False))
return {
"seo_score": sum(c.earned for c in seo),
"aeo_score": sum(c.earned for c in aeo),
"overall_score": round((sum(c.earned for c in seo) + sum(c.earned for c in aeo)) / 2),
"checks": [c.as_dict() for c in (*seo, *aeo)],
"summary": {
"facts": fact_count, "faqs": len(faqs), "images_with_alt": image_with_alt,
"built": built, "domain": domain or None,
},
"visibility": {"checks": len(ai_checks), "own_site_cited": cited},
"disclaimer": "준비도 점수이며 검색 순위나 AI 인용을 보장하지 않습니다.",
}