from datetime import datetime from typing import Optional from pydantic import Field from common.models.gmodel import Res_WebPacketProtocol, WebPacketProtocol class LearningProtocol(WebPacketProtocol): pass class LearningKpi(LearningProtocol): learned_sessions: int = 0 # 학습에 반영된 협상 수 records: int = 0 # 학습 기록 수(카드 선택 1회 = 1건) used_cards: int = 0 # 한 번이라도 나간 카드 수 unused_cards: int = 0 # 아직 한 번도 안 나간 카드 수 top3_share: float = 0.0 # 상위 3장이 차지하는 사용 비중 — 쏠림 정도 last_learned_at: Optional[datetime] = None class CardUsageRow(LearningProtocol): number: str # 카드번호(NGC-001 등) name: Optional[str] = None card_id: Optional[str] = None # 카드 PK — 협상카드 상세(/cards?detail=) 링크용 type: str = "nego" # nego | wild used_sessions: int = 0 # 이 카드가 나간 협상 수 uses: int = 0 # 총 사용 횟수 share: float = 0.0 # 전체 카드 사용 중 이 카드의 비중 avg_turn: float = 0.0 # 평균 몇 번째 라운드에 나갔는지 — 설정한 국면과 대조용 last_used_at: Optional[datetime] = None # 선택 근거 — UCB = Q + 탐색보너스. 봇은 이 점수가 가장 높은 카드를 고른다. avg_q: Optional[float] = None # 선택 시점 Q값 평균 — 학습이 매긴 이 카드의 값어치 avg_ucb: Optional[float] = None # 선택 시점 UCB 평균 explore_bonus: Optional[float] = None # avg_ucb - avg_q — 클수록 '아직 덜 검증돼서' 뽑힌 것 visits: int = 0 # 마지막 선택 시점 누적 방문수 — 적으면 Q값이 아직 추측 class AnchoringCell(LearningProtocol): supplier_type: int = 0 supplier_type_label: str = "미지정" price_range_index: int = 0 # 목표가 기준 가격대 구간 price_range_label: str = "" # 그 구간의 실제 금액 범위(화면 표기용) anchoring_value: float = 0.0 # 앵커링 인하폭(‰ — 10 = 1%) last_adjusted_at: Optional[datetime] = None class AnchoringHistoryRow(LearningProtocol): supplier_type_label: str = "미지정" price_range_index: int = 0 price_range_label: str = "" value_before: float = 0.0 value_after: float = 0.0 sample_count: int = 0 # 조정 판단에 쓴 협상 표본 수 success_count: int = 0 success_rate: float = 0.0 created_at: Optional[datetime] = None class Res_LearningStatus(Res_WebPacketProtocol): kpi: LearningKpi = Field(default_factory=LearningKpi) cards: list[CardUsageRow] = [] class Res_AnchoringStatus(Res_WebPacketProtocol): cells: list[AnchoringCell] = [] history: list[AnchoringHistoryRow] = [] adjusted_count: int = 0