o2o-site-AEO/backend/services/vision_service.py
Mina Choi 6784e59ca5 최초 커밋 — 기존 코드 전체 + 문서 체계 신설
git 저장소가 없어 히스토리·협업 기반이 아예 없던 상태를 연다.
함께 문서를 재편했다. 그동안 문서가 있어도 "이 제품이 뭘 푸는가"와
"어떻게 도는가"를 담은 문서가 없어서, 목표 문장이 backend/frontend
README 두 곳에 복붙돼 있었다 — 상위 문서가 없어 아래로 샌 것이다.

신설
  README.md               레포 진입점 + 문서 지도 + 문서 규칙 4가지
  AGENTS.md               에이전트·신규 합류자용 함정 목록과 규약
                          (CLAUDE.md 는 여기로 걸린 심볼릭 링크)
  docs/PRODUCT.md         제품 정의 — 문제·사용자·원칙·**non-goals**·성공 기준
  docs/ARCHITECTURE.md    payload 경계·발행 파이프라인·서빙 결정·앱 분리 설계

이동
  backend/docs/DECISIONS.md → docs/DECISIONS.md
    백엔드만의 결정이 아니다. 게다가 코드 주석 ~25곳이 이미
    `docs/DECISIONS.md` 로 적고 있어 레포 루트 기준으로는 그게 맞다.

갱신
  docs/DEPLOY.md          서빙 결정 반영 — nginx 정적 서빙이 지금 경로(3절),
                          Azure 는 나중에 켤 때(4절)로 분리
  docs/ARCHITECTURE.md    사이트 = 한 장(2026-08-31) 구조 반영
  docs/COLLECTION_SEO_AEO_FLOW.md
                          robots.txt·sitemap.xml 은 오리진 루트에만 굽는다는 점 명시
  frontend/site/scripts/prerender.ts
                          헤더 주석의 렌더 보고서 경로가 실제(422줄)와 달라 수정

.gitignore
  ★ CLAUDE.md 를 더 이상 무시하지 않는다. 에이전트 지침은 팀과 모든
    에이전트가 공유하는 규약이라 커밋해야 한다 — 무시하면 클론한 사람이
    "배포 후 republish_all.py 필수" 같은 함정을 전달받지 못한다.
    개인용 오버라이드는 ~/.claude/CLAUDE.md 에 둔다.
2026-08-31 13:57:59 +09:00

117 lines
4.9 KiB
Python

"""사진 분류 + alt 생성 — VISION 잡이 하는 일.
수집된 사진을 Gemini Vision 에 넘겨 분류 라벨과 alt 텍스트를 받아 media 에 반영한다.
★ 신뢰도가 낮은 항목은 자동 반영하지 않는다. 라벨·alt 는 저장하되(사람이 보고 고칠 재료)
status 는 PENDING_REVIEW 로 남겨 사람 확인 큐에 둔다. 임계값은 설정값 하나로만 판단한다.
★ 사진 20~50장을 한 번에 처리하므로 배치·재시도·부분 실패는 클라이언트가 담당한다.
여기서는 "결과를 어떻게 반영할 것인가"만 판단한다.
"""
import uuid
from common.database.db_session_manager import DB_SESSION_MNG
from common.database.model.models import media, places
from common.enums import DBWRType, ErrorType, MediaStatus, PlaceCategory
from common.logger import LOG
from common.utils.gtime import GTime
from config.server_configs import external_api_config
from crud.media_crud import MediaCRUD
from crud.place_crud import PlaceCRUD
from services.external import gemini
_media_crud = MediaCRUD()
_place_crud = PlaceCRUD()
class VisionAborted(RuntimeError):
"""재시도해도 소용없는 중단 — 잡의 last_error 로 남는다."""
async def run_vision(job: dict) -> dict:
"""VISION 잡 핸들러. payload: {place_id, company_id, force?}"""
payload = job["payload"]
place_id = payload["place_id"]
company_id = payload["company_id"]
force = bool(payload.get("force"))
if not gemini.is_configured():
raise VisionAborted("GEMINI_API_KEY 미설정 — 사진 분석을 할 수 없다")
err, place = await DB_SESSION_MNG.execute_lambda(
places.DBType(),
DBWRType.DB_READ.value,
lambda s: _place_crud.get_place(s, uuid.UUID(company_id), uuid.UUID(place_id)),
)
if err != ErrorType.SUCCESS or place is None:
raise VisionAborted(f"사업장을 찾을 수 없다: {place_id}")
# force 가 아니면 아직 분석 안 된 사진만 — 같은 사진을 다시 태우면 요금만 나간다.
list_err, rows = await DB_SESSION_MNG.execute_lambda(
media.DBType(),
DBWRType.DB_READ.value,
lambda s: _media_crud.list_media(s, uuid.UUID(place_id), unlabeled_only=not force),
)
if list_err != ErrorType.SUCCESS:
raise VisionAborted(f"사진 조회 실패: {list_err.name}")
if not rows:
return {"place_id": place_id, "analyzed": 0, "note": "분석할 사진이 없다"}
# 객실·메뉴 이름을 힌트로 준다 — 라벨이 units 와 같은 어휘로 나오면 매칭이 쉬워진다.
unit_err, unit_rows = await DB_SESSION_MNG.execute_lambda(
media.DBType(),
DBWRType.DB_READ.value,
lambda s: _place_crud.list_units(s, uuid.UUID(place_id)),
)
unit_names = [u.name for u in (unit_rows or [])] if unit_err == ErrorType.SUCCESS else []
unit_by_id = {u.unit_id: u.name for u in (unit_rows or [])} if unit_err == ErrorType.SUCCESS else {}
images = [
gemini.ImageInput(
origin_url=r.origin_url or r.url,
fetch_url=r.url,
unit_name_hint=unit_by_id.get(r.unit_id),
)
for r in rows
]
by_key = {(r.origin_url or r.url): r for r in rows}
threshold = external_api_config.vision_confidence_threshold
try:
results = await gemini.analyze_images(
images,
category=PlaceCategory(place.category),
unit_names=unit_names,
model=external_api_config.gemini_vision_model,
confidence_threshold=threshold,
)
except gemini.GeminiNotConfigured as ex:
raise VisionAborted(str(ex)) from ex
now = GTime.UTC()
stat = {"place_id": place_id, "analyzed": len(rows), "approved": 0, "needs_review": 0, "failed": 0}
for result in results:
row = by_key.get(result.origin_url)
if row is None:
continue
if not result.ok:
# 분석 실패 — 사진은 그대로 두고 사람 확인 큐에 남긴다. 잡을 실패시키지 않는다.
stat["failed"] += 1
continue
# ★ 신뢰도 미달이면 라벨은 저장하되 승인 상태로 올리지 않는다.
approved = not result.needs_review
status = MediaStatus.APPROVED.value if approved else MediaStatus.PENDING_REVIEW.value
run_err, _rc = await DB_SESSION_MNG.execute_lambda_claim(
media.DBType(),
lambda s, r=result, st=status: _media_crud.apply_vision(
s, by_key[r.origin_url].media_id, r.label, r.alt_text, r.confidence, st, now
),
)
if run_err != ErrorType.SUCCESS:
stat["failed"] += 1
continue
stat["approved" if approved else "needs_review"] += 1
LOG.i(f"[vision] place={place_id} {stat['analyzed']}장 → 자동반영 {stat['approved']} · "
f"확인필요 {stat['needs_review']} · 실패 {stat['failed']} (임계값 {threshold})")
return stat