/s/stay 가 "스테이머뭄" 구글 검색에서 통째로 빠졌다. out/s/ 에 목업·백업(stay2 · stay3 · stay.old)이 운영본과 제목·본문이 같은 채(단어 87%) 각자 자기를 canonical 로 가리키고 있었고, 사이트맵·/s 목록이 디렉토리를 훑어 이들을 전부 구글에 제출했다 — 같은 글 여러 벌 중 구글이 하나만 고른다. 목업 셋은 운영 볼륨에서 noindex 로 바꿨고(2026-09-11), 이 커밋은 그런 페이지가 다시 제출되지 않게 한다. - seo/directory.ts: readBakedNoindex — 구운 HTML 의 robots 메타를 읽는다. 슬러그 이름(.old)으로 거르지 않는다 — 페이지 자신의 선언이 유일한 출처다 - prerender.ts writeRootMachineFiles: noindex 페이지를 사이트맵·/s 목록·루트 llms.txt 에서 뺀다. 남겨 두면 서치콘솔이 "제출된 URL 에 noindex" 를 계속 띄운다 vitest directory.test.ts 8 passed · tsc·eslint 통과 Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com> Claude-Session: https://claude.ai/code/session_01CEQ9auj65yJKk2MnWbtRqU
891 lines
40 KiB
TypeScript
891 lines
40 KiB
TypeScript
import {
|
|
copyFileSync,
|
|
existsSync,
|
|
mkdirSync,
|
|
readFileSync,
|
|
readdirSync,
|
|
renameSync,
|
|
rmSync,
|
|
statSync,
|
|
writeFileSync,
|
|
} from 'node:fs';
|
|
import {basename, dirname, join, resolve} from 'node:path';
|
|
import {fileURLToPath} from 'node:url';
|
|
import type {SitePayload} from '@o2o/shared';
|
|
import {
|
|
joinUrl,
|
|
parseSectionData,
|
|
sanitizePayloadForPublish,
|
|
SECTION_ITEM_REQUIRED_KEY,
|
|
} from '@o2o/shared';
|
|
import {render} from '@site/entry-server';
|
|
import {
|
|
collectJsonLd,
|
|
homeMeta,
|
|
readBakedLastmod,
|
|
readBakedNoindex,
|
|
readBakedTitle,
|
|
renderHead,
|
|
renderLlmsTxt,
|
|
renderRootLlmsTxt,
|
|
renderRootRobotsTxt,
|
|
renderSiteIndex,
|
|
renderSiteUrlset,
|
|
type DirectoryEntry,
|
|
type SiteEntry,
|
|
verifyGeo,
|
|
verifyJsonLd,
|
|
} from '@site/seo';
|
|
import {MOONLIGHT_STAY_PAYLOAD} from '@site/fixtures/moonlight-stay';
|
|
|
|
/**
|
|
* 발행 사이트 프리렌더.
|
|
*
|
|
* npm run prerender 데모 payload 로 굽는다
|
|
* npm run prerender -- --payload=a.json 파일 하나
|
|
* npm run prerender -- --payload=a.json --payload=b.json 여러 개(바뀐 것만)
|
|
* npm run prerender -- --payload=./payloads 디렉토리 안의 *.json 전부
|
|
* npm run prerender -- --out=../../dist 출력 위치 지정
|
|
*
|
|
* ★ --payload 은 여러 번 줄 수 있다. 사이트 1,000개에서 한 명이 발행했다고 전부 다시
|
|
* 구우면 못 쓴다 — 감시 프로세스가 바뀐 payload 만 골라 넘긴다.
|
|
*
|
|
* 산출물(사이트 1개당):
|
|
* out/s/<slug>/index.html 사이트 전체(한 장)
|
|
* out/s/<slug>/llms.txt 확인된 사실 목록(AEO)
|
|
* out/payloads/.status/<slug>.json 렌더 결과 보고서(백엔드가 읽는다)
|
|
*
|
|
* 오리진 루트(사이트 전체가 공유):
|
|
* out/robots.txt · out/sitemap.xml 크롤러가 읽는 유일한 자리
|
|
* out/<indexnow-key>.txt 색인 통보용 키 파일
|
|
*
|
|
* 공용 산출물(사이트 전체가 공유):
|
|
* out/assets/… 클라이언트 번들(하이드레이션용)
|
|
* out/fonts/… 폰트
|
|
*
|
|
* ★ 자산을 사이트마다 복사하지 않는다. 같은 해시의 번들을 1,000벌 복사하면 디스크도
|
|
* 낭비지만, 더 나쁜 건 브라우저 캐시가 사이트마다 따로 잡혀 매번 새로 받는다는 점이다.
|
|
* (커스텀 도메인 사이트는 예외 — 호스트가 달라 공용 경로를 공유할 수 없다.)
|
|
*
|
|
* ★ 이 스크립트는 백엔드 BUILD 잡이 부르는 자리다. 잡이 payload JSON 을 써 주고
|
|
* 이걸 실행하면 정적 파일이 나온다. 지금은 payload 를 파일에서 읽지만,
|
|
* API 가 열리면 --payload=https://... 를 지원하는 것으로 충분하다.
|
|
*/
|
|
|
|
/** 사이트별 산출물이 놓이는 디렉터리. 발행 주소 `<host>/s/<slug>` 와 같은 모양이다. */
|
|
const SITE_DIR = 's';
|
|
|
|
const HERE = dirname(fileURLToPath(import.meta.url));
|
|
const SITE_ROOT = resolve(HERE, '..', '..'); // dist/prerender → site/
|
|
const CLIENT_DIR = join(SITE_ROOT, 'dist', 'client');
|
|
|
|
interface Args {
|
|
/** --payload 은 여러 번 줄 수 있다. 비면 데모 payload 로 굽는다. */
|
|
payloads: string[];
|
|
out: string;
|
|
}
|
|
|
|
function parseArgs(): Args {
|
|
const args: Args = {payloads: [], out: join(SITE_ROOT, 'out')};
|
|
for (const arg of process.argv.slice(2)) {
|
|
const [key, value] = arg.replace(/^--/, '').split('=');
|
|
if (key === 'payload' && value) args.payloads.push(value);
|
|
if (key === 'out' && value) args.out = resolve(process.cwd(), value);
|
|
}
|
|
return args;
|
|
}
|
|
|
|
/** 경로(파일 또는 디렉토리)를 payload 파일 목록으로 편다. */
|
|
function expandPayloadPaths(paths: string[]): string[] {
|
|
const files: string[] = [];
|
|
for (const path of paths) {
|
|
const target = resolve(process.cwd(), path);
|
|
if (!existsSync(target)) {
|
|
throw new Error(`payload 를 찾을 수 없습니다: ${target}`);
|
|
}
|
|
if (target.endsWith('.json')) {
|
|
files.push(target);
|
|
continue;
|
|
}
|
|
for (const name of readdirSync(target)) {
|
|
// 백엔드가 원자적 rename 전에 쓰는 임시파일(.<slug>.json.tmp)을 집지 않는다.
|
|
if (name.endsWith('.json') && !name.startsWith('.')) files.push(join(target, name));
|
|
}
|
|
}
|
|
// 같은 파일을 두 번 굽지 않는다(--payload=dir --payload=dir/a.json 같은 조합).
|
|
return [...new Set(files)];
|
|
}
|
|
|
|
/**
|
|
* 읽어들인 payload 한 건. 읽기·검증이 실패했으면 payload 대신 error 가 담긴다.
|
|
*
|
|
* ★ 실패를 여기서 throw 하지 않는다. 예전에는 payload 하나가 깨지면 배치 전체가 죽어서,
|
|
* 멀쩡한 사이트까지 못 구웠다(게다가 아무 보고서도 남지 않았다). 실패는 값으로 옮기고
|
|
* main 이 사이트 단위로 격리한다.
|
|
*/
|
|
interface LoadedPayload {
|
|
payload?: SitePayload;
|
|
/** 렌더 결과 보고서를 이 파일 옆에 쓴다 — 백엔드가 보는 유일한 경로다. */
|
|
file?: string;
|
|
error?: string;
|
|
}
|
|
|
|
/** payload 파일 하나를 읽고 검증한다. */
|
|
function loadOne(file: string): LoadedPayload {
|
|
try {
|
|
const payload = JSON.parse(readFileSync(file, 'utf-8')) as SitePayload;
|
|
// 모르는 스키마 버전을 반쪽만 렌더해서 내보내는 게 최악이다 — 이 파일만 건너뛴다.
|
|
if (payload.schemaVersion !== 1) {
|
|
return {
|
|
file,
|
|
payload,
|
|
error: `지원하지 않는 schemaVersion=${payload.schemaVersion} (이 렌더러는 1만 처리합니다)`,
|
|
};
|
|
}
|
|
if (!payload.site?.slug) {
|
|
return {file, payload, error: 'payload 에 site.slug 이 없습니다'};
|
|
}
|
|
return {file, payload};
|
|
} catch (ex) {
|
|
return {file, error: ex instanceof Error ? ex.message : String(ex)};
|
|
}
|
|
}
|
|
|
|
/** payload 를 읽는다. 파일 / 디렉토리 / 미지정(데모) 셋을 받는다. */
|
|
function loadPayloads(paths: string[]): LoadedPayload[] {
|
|
if (paths.length === 0) {
|
|
console.log('[prerender] --payload 이 없어 데모 payload 로 굽습니다.');
|
|
return [{payload: MOONLIGHT_STAY_PAYLOAD}];
|
|
}
|
|
|
|
const files = expandPayloadPaths(paths);
|
|
if (files.length === 0) throw new Error(`payload JSON 이 없습니다: ${paths.join(', ')}`);
|
|
return files.map(loadOne);
|
|
}
|
|
|
|
/** 클라이언트 빌드 manifest 에서 엔트리 JS/CSS 경로를 뽑는다. */
|
|
function readAssets(): {script: string; css: string[]} {
|
|
const manifestPath = join(CLIENT_DIR, '.vite', 'manifest.json');
|
|
if (!existsSync(manifestPath)) {
|
|
throw new Error(
|
|
`클라이언트 빌드 결과가 없습니다: ${manifestPath}\n 먼저 \`npm run build:client\` 를 실행하세요.`,
|
|
);
|
|
}
|
|
const manifest = JSON.parse(readFileSync(manifestPath, 'utf-8')) as Record<
|
|
string,
|
|
{file: string; css?: string[]; isEntry?: boolean}
|
|
>;
|
|
const entry = Object.values(manifest).find((chunk) => chunk.isEntry);
|
|
if (!entry) throw new Error('manifest 에 엔트리 청크가 없습니다.');
|
|
|
|
// ★ 파일명만 돌려준다. 앞에 붙일 경로는 사이트마다 다르다(`/s/<slug>`) —
|
|
// 여기서 `/assets/…` 로 굳히면 사이트가 `/s/mmg/` 아래 놓이는 순간 전부 404 가 되고,
|
|
// JS 가 안 붙어 하이드레이션이 죽는다(정적 HTML 만 남는다). 실측으로 그렇게 됐다.
|
|
return {
|
|
script: entry.file.replace(/^assets\//, ''),
|
|
css: (entry.css ?? []).map((file) => file.replace(/^assets\//, '')),
|
|
};
|
|
}
|
|
|
|
/**
|
|
* 구조화 데이터 대조 실패. ★ 재시도해도 소용없다 — 데이터가 고쳐져야 통과한다.
|
|
*
|
|
* 일반 렌더 오류(디스크·번들)와 구분해야 한다. 그쪽은 재시도가 의미 있지만
|
|
* 이건 사장님이 값을 고치기 전까지 몇 번을 구워도 같은 결과다.
|
|
*/
|
|
class VerifyError extends Error {
|
|
constructor(
|
|
readonly mismatches: string[],
|
|
/** ★ 실패해도 계수는 보고한다. 백엔드가 NO_UNIQUE_CONTENT 와 JSONLD_MISMATCH 를 갈라야 한다. */
|
|
readonly uniqueContentCount: number | null = null,
|
|
) {
|
|
super(`구조화 데이터가 화면 값과 다릅니다(${mismatches.length}건): ${mismatches.slice(0, 3).join(' · ')}`);
|
|
this.name = 'VerifyError';
|
|
}
|
|
}
|
|
|
|
/**
|
|
* 고유 콘텐츠 0건. **VerifyError 와 갈라 둔다.**
|
|
*
|
|
* ★ 예전에는 이 사유를 VerifyError 의 mismatches 에 실어 던졌다. 백엔드 게이트는
|
|
* mismatches 가 비지 않았다는 것만 보고 JSONLD_MISMATCH 로 판정했고, 사장님 화면에는
|
|
* "구조화 데이터와 화면 값이 다릅니다" 라는 **틀린 문구**가 떴다 — 구조화 데이터는
|
|
* 멀쩡했다. 사유가 다르면 예외도 갈라야 라벨이 안 섞인다.
|
|
*/
|
|
class NoUniqueContentError extends Error {
|
|
/** 백엔드가 JSONLD_MISMATCH 로 오인하지 않도록 늘 비어 있다. */
|
|
readonly mismatches: string[] = [];
|
|
|
|
constructor(readonly uniqueContentCount: number) {
|
|
super('고유 콘텐츠가 0건이다 — 이 가게에만 있는 내용이 없으면 발행하지 않는다');
|
|
this.name = 'NoUniqueContentError';
|
|
}
|
|
}
|
|
|
|
/**
|
|
* 사이트는 **한 장**이다(2026-08-31). 예전에는 홈·객실·객실상세·주변·오시는길·FAQ 로
|
|
* 라우트를 갈라 사이트 하나에 30개 안팎의 HTML 을 구웠다.
|
|
*
|
|
* ★ 왜 합쳤나 — 소상공인은 원래 내용이 적다. 쪼갤수록 페이지마다 얇아지고, 검색엔진은
|
|
* 그런 페이지를 색인에서 버린다. 한 장에 모으면 알찬 페이지 하나가 된다.
|
|
* 경로형(`/s/<slug>`)이라 얇은 페이지의 평가가 도메인 전체로 번지는 것도 막는다.
|
|
*/
|
|
|
|
/**
|
|
* payload 를 HTML 안에 심을 수 있게 직렬화한다.
|
|
*
|
|
* ★ `<`, `>`, `&` 를 유니코드 이스케이프한다. 안 하면 사장님이 소개문에 적은
|
|
* `</script>` 한 줄이 스크립트 태그를 닫아 버린다 — 그 뒤 내용이 마크업으로 새고,
|
|
* 최악의 경우 임의 스크립트가 된다. U+2028/2029 는 JS 문법상 줄바꿈이라 함께 막는다.
|
|
*/
|
|
function serializePayload(payload: SitePayload): string {
|
|
return JSON.stringify(payload)
|
|
.replace(/</g, '\\u003c')
|
|
.replace(/>/g, '\\u003e')
|
|
.replace(/&/g, '\\u0026')
|
|
.replace(/\u2028/g, '\\u2028')
|
|
.replace(/\u2029/g, '\\u2029');
|
|
}
|
|
|
|
function writeFile(outDir: string, relPath: string, content: string) {
|
|
const full = join(outDir, relPath);
|
|
mkdirSync(dirname(full), {recursive: true});
|
|
writeFileSync(full, content, 'utf-8');
|
|
}
|
|
|
|
/** Node 24의 recursive cpSync가 macOS Docker bind mount에서 0바이트·write-only 파일을
|
|
* 남기고 EACCES로 실패하는 경우가 있어, 빌드 자산은 파일 단위로 복사한다. */
|
|
function copyDirectoryFiles(source: string, destination: string) {
|
|
mkdirSync(destination, {recursive: true});
|
|
for (const entry of readdirSync(source, {withFileTypes: true})) {
|
|
const from = join(source, entry.name);
|
|
const to = join(destination, entry.name);
|
|
if (entry.isDirectory()) copyDirectoryFiles(from, to);
|
|
else if (entry.isFile()) {
|
|
// 이전 실패가 write-only 0바이트 파일을 남겼어도 덮어쓰기를 시도하지 말고 먼저 지운다.
|
|
rmSync(to, {force: true});
|
|
copyFileSync(from, to);
|
|
}
|
|
}
|
|
}
|
|
|
|
function assetPlan(payload: SitePayload, outRoot: string, siteDir: string) {
|
|
const basePath = payload.site.basePath.replace(/\/+$/, '');
|
|
const suffix = `/${SITE_DIR}/${payload.site.slug}`;
|
|
// out/ 이 도메인 루트가 아닌 곳에 마운트돼도 맞도록 basePath 에서 역산한다.
|
|
// ('/s/joy' → '' · '/sites/s/joy' → '/sites')
|
|
const rootPrefix = basePath.endsWith(suffix) ? basePath.slice(0, -suffix.length) : '';
|
|
const shared = basePath !== '';
|
|
|
|
return {
|
|
shared,
|
|
/** 자산을 실제로 복사해 넣을 디렉토리. */
|
|
dir: shared ? outRoot : siteDir,
|
|
/** HTML 이 참조할 접두사. 두 경우 모두 루트 절대경로가 된다. */
|
|
base: `${rootPrefix}/assets`,
|
|
};
|
|
}
|
|
|
|
function prerenderSite(
|
|
input: SitePayload,
|
|
outRoot: string,
|
|
assets: ReturnType<typeof readAssets>,
|
|
referenced: Set<string>,
|
|
) {
|
|
// ★ 여기서 한 번 깎고, 그 뒤로는 깎인 payload 만 쓴다 —
|
|
// 서버 렌더 · JSON-LD · llms.txt · HTML 에 심는 블롭이 전부 같은 객체를 본다.
|
|
// (블롭만 원본으로 두면 미검증 fact 가 HTML 소스로 새고, AI 크롤러는 그걸 읽는다.)
|
|
const payload = sanitizePayloadForPublish(input);
|
|
// ★ 발행 주소가 `<host>/s/<slug>` 이므로 파일도 같은 모양으로 놓는다.
|
|
// 그래야 out/ 을 그대로 정적 서빙하면 발행된 모든 사이트가 실제 주소로 열린다 —
|
|
// 사이트마다 서버를 따로 띄우거나 경로를 손으로 맞출 필요가 없다.
|
|
const siteDir = join(outRoot, SITE_DIR, payload.site.slug);
|
|
const plan = assetPlan(payload, outRoot, siteDir);
|
|
/** 브라우저가 자산을 찾아갈 접두사. 파일이 놓인 자리와 같아야 한다. */
|
|
const assetBase = plan.base;
|
|
|
|
/**
|
|
* ★ 먼저 메모리에 굽고, 검증을 통과한 뒤에야 파일로 쓴다.
|
|
* 렌더하면서 바로 쓰면 검증에 걸린 페이지가 이미 디스크에 나가 있게 된다 —
|
|
* 그 순간 방문자와 크롤러가 그걸 읽는다. 게이트가 있으나 마나가 된다.
|
|
* 실패하면 아무것도 쓰지 않으므로 **직전 버전이 그대로 서비스된다**(빈 사이트가 되지 않는다).
|
|
*/
|
|
const mismatches: string[] = [];
|
|
// 실패하더라도 보고서에 실어야 하므로 먼저 센다.
|
|
const uniqueContentCount = countUniqueContent(payload);
|
|
|
|
const meta = homeMeta(payload);
|
|
const appHtml = render(payload);
|
|
const jsonld = collectJsonLd(payload, {title: meta.title, description: meta.description});
|
|
const head = renderHead({
|
|
payload,
|
|
meta,
|
|
scriptSrc: `${assetBase}/${assets.script}`,
|
|
cssHrefs: assets.css.map((file) => `${assetBase}/${file}`),
|
|
});
|
|
|
|
const html = [
|
|
'<!doctype html>',
|
|
'<html lang="ko">',
|
|
' <head>',
|
|
head,
|
|
' </head>',
|
|
/* ★ class="site" 는 장식이 아니다 — 시안 토큰·유틸(shared/styles/site.css)이 이 클래스
|
|
안에서만 산다. 빼면 유동 타이포와 .shell·.h2 가 통째로 죽어 글자 크기가 본문으로 떨어진다.
|
|
빌더 캔버스는 같은 규칙을 `.site-canvas` 로 받는다. */
|
|
' <body class="site">',
|
|
` <div id="root">${appHtml}</div>`,
|
|
` <script>window.__SITE_PAYLOAD__=${serializePayload(payload)}</script>`,
|
|
' </body>',
|
|
'</html>',
|
|
'',
|
|
].join('\n');
|
|
|
|
/** ★ 절대규칙 3 — 나갈 바로 그 HTML 에 대고 대조한다. */
|
|
for (const problem of verifyJsonLd(html, jsonld)) mismatches.push(problem);
|
|
for (const problem of verifyGeo(jsonld, payload.place.latitude, payload.place.longitude)) {
|
|
mismatches.push(problem);
|
|
}
|
|
|
|
if (mismatches.length > 0) {
|
|
throw new VerifyError(mismatches, uniqueContentCount);
|
|
}
|
|
|
|
/**
|
|
* ★ 절대규칙 2 — 이 가게에만 있는 콘텐츠가 0건이면 굽지 않는다.
|
|
*
|
|
* 같은 템플릿으로 대량 생성한 사이트는 스팸 판정을 받고, 판정되면 사이트가 통째로 무의미해진다.
|
|
* 이 검사도 **렌더러 안**에 있어야 한다 — 백엔드가 나중에 거부하더라도 그 전에 이미
|
|
* 페이지가 디스크에 나가 있으면 크롤러가 그걸 읽는다.
|
|
*/
|
|
if (uniqueContentCount <= 0) {
|
|
throw new NoUniqueContentError(uniqueContentCount);
|
|
}
|
|
|
|
writeFile(siteDir, 'index.html', html);
|
|
|
|
/**
|
|
* 기계용 파일은 `llms.txt` 하나만 남는다.
|
|
*
|
|
* ★ 사이트별 `sitemap.xml` 을 없앴다 — 한 장짜리 사이트의 사이트맵은 URL 이 하나뿐이라,
|
|
* 사이트가 1,000개면 URL 한 줄짜리 파일이 1,000개 생긴다. 루트 사이트맵 하나에
|
|
* 전부 담는다(사이트맵 하나에 URL 50,000개까지 들어간다).
|
|
*
|
|
* ★ 사이트별 `robots.txt` 도 없앴다 — `<host>/s/<slug>/robots.txt` 는 **아무도 읽지 않는다**.
|
|
* 크롤러는 오리진 루트에서만 읽는다(RFC 9309).
|
|
*/
|
|
writeFile(siteDir, 'llms.txt', renderLlmsTxt(payload));
|
|
|
|
// 하이드레이션용 번들. 공용 호스트면 out/ 루트 한 벌을 공유하므로 여기서는 아무것도 안 한다
|
|
// (main 이 사이트를 굽기 전에 한 번 깔아 둔다). 커스텀 도메인일 때만 사이트 안에 복사한다.
|
|
if (!plan.shared) {
|
|
writeSharedAssets(plan.dir, referenced);
|
|
}
|
|
|
|
// 이전 구현이 사이트마다 복사해 둔 자산이 남아 있으면 지운다 — 공용으로 바뀐 뒤에는
|
|
// 아무도 참조하지 않는 죽은 파일이고, 사이트 수만큼 디스크를 계속 먹는다.
|
|
if (plan.shared) {
|
|
rmSync(join(siteDir, 'assets'), {recursive: true, force: true});
|
|
rmSync(join(siteDir, 'fonts'), {recursive: true, force: true});
|
|
}
|
|
|
|
// 보고서용 — 실제로 나간 JSON-LD 를 그대로 담는다. 백엔드가 이걸
|
|
// site_versions.jsonld(파이썬 빌더 산출물)와 대조해 두 렌더러의 드리프트를 잡는다.
|
|
return {
|
|
siteDir,
|
|
payload,
|
|
jsonld,
|
|
uniqueContentCount,
|
|
};
|
|
}
|
|
|
|
/**
|
|
* 이 가게에만 있는 콘텐츠 건수 — 백엔드 `count_unique_content` 와 **같은 규칙**이다.
|
|
*
|
|
* ★ 두 숫자가 다르면 게이트가 통과시킨 근거와 실제 페이지가 어긋났다는 뜻이다.
|
|
* 백엔드가 보고서를 받아 대조한다. 규칙을 바꿀 땐 반드시 양쪽을 같이 고친다.
|
|
* (backend/services/builder/render.py 의 MIN_UNIQUE_TEXT · count_unique_content)
|
|
*/
|
|
const MIN_UNIQUE_TEXT = 8;
|
|
|
|
function countUniqueContent(payload: SitePayload): number {
|
|
const long = (value: unknown) => String(value ?? '').trim().length >= MIN_UNIQUE_TEXT;
|
|
let count = 0;
|
|
|
|
// 소개 섹션의 직접 입력 본문은 실제 AboutSection 에 표시되는 가게 고유 문장이다.
|
|
// ★ enabled 를 함께 본다. 꺼서 페이지에 없는 문장까지 세면 빈 페이지가 게이트를 통과한다.
|
|
const intro = payload.theme.sections.find((section) => section.id === 'intro');
|
|
if (intro?.enabled && long(intro.body)) count += 1;
|
|
|
|
/**
|
|
* 붙여넣기 아이템(가요·일력·승차권·인물…)의 항목도 이 가게에만 있는 문장이다.
|
|
*
|
|
* ★ 안 세면 "곡을 여덟 개 채웠는데 고유 콘텐츠 0건으로 발행이 막힌다"가 된다 —
|
|
* 소개 본문(intro.body)이 계약에 없던 시절과 같은 구멍이다.
|
|
* ★ 긴 문장이 한 줄이라도 있는 항목만 센다. 제목·연도만 있는 줄은 가게를 구분하지 못한다.
|
|
*/
|
|
const hasLongText = (value: unknown): boolean => {
|
|
if (typeof value === 'string') return long(value);
|
|
if (Array.isArray(value)) return value.some(hasLongText);
|
|
if (value && typeof value === 'object') return Object.values(value).some(hasLongText);
|
|
return false;
|
|
};
|
|
for (const section of payload.theme.sections) {
|
|
if (!section.enabled || !SECTION_ITEM_REQUIRED_KEY[section.id]) continue;
|
|
const parsed = parseSectionData<Record<string, unknown>>(section.id, section.data);
|
|
for (const item of parsed.items) {
|
|
if (hasLongText(item)) count += 1;
|
|
}
|
|
}
|
|
|
|
// 문장형 fact 만 센다 — bool·number·time 은 전부 템플릿 값이라 가게를 구분하지 못한다.
|
|
for (const fact of [...payload.facts, ...payload.units.flatMap((unit) => unit.facts)]) {
|
|
if (fact.type === 'text' && long(fact.value)) count += 1;
|
|
}
|
|
for (const faq of payload.faqs) {
|
|
if (String(faq.question ?? '').trim() && long(faq.answer)) count += 1;
|
|
}
|
|
for (const item of payload.media) {
|
|
if (long(item.alt)) count += 1;
|
|
}
|
|
|
|
return count;
|
|
}
|
|
|
|
/**
|
|
* 렌더 결과 보고서. payload 파일 옆(`.status/<slug>.json`)에 쓴다.
|
|
*
|
|
* ★ 왜 필요한가
|
|
* 지금까지 프리렌더는 성공하든 실패하든 아무것도 남기지 않았다. 빌드가 깨지면
|
|
* DB 에는 "발행됨"으로 남고 페이지는 없는 상태가 되는데, 아무도 그걸 모른다.
|
|
* 백엔드에 마운트된 유일한 디렉토리가 payload 디렉토리라 보고서도 그 안에 쓴다.
|
|
*
|
|
* ★ 임시파일 → rename. 백엔드가 반쯤 쓰인 JSON 을 읽지 않게 한다.
|
|
*/
|
|
interface RenderReport {
|
|
schemaVersion: 1;
|
|
slug: string;
|
|
siteId: string;
|
|
placeId: string;
|
|
siteVersion: number;
|
|
ok: boolean;
|
|
renderedAt: string;
|
|
routes: number;
|
|
bundle: string;
|
|
uniqueContentCount: number | null;
|
|
jsonld: unknown[] | null;
|
|
/** ★ 절대규칙 3 위반 목록. 비어야 발행 가능하다 — 백엔드 게이트가 이걸 본다. */
|
|
mismatches: string[];
|
|
error: string | null;
|
|
}
|
|
|
|
function writeReport(payloadFile: string, report: RenderReport) {
|
|
const dir = join(dirname(payloadFile), '.status');
|
|
mkdirSync(dir, {recursive: true});
|
|
const target = join(dir, `${report.slug}.json`);
|
|
const tmp = join(dir, `.${report.slug}.json.tmp`);
|
|
writeFileSync(tmp, JSON.stringify(report, null, 2), 'utf-8');
|
|
renameSync(tmp, target);
|
|
}
|
|
|
|
/**
|
|
* 옛 자산 보관 기간.
|
|
*
|
|
* ★ 왜 지우지 않고 남기나 — HTML 은 자산 경로를 **파일명 해시까지 박아** 굽는다
|
|
* (`/assets/index-DvNTmLhy.css`). 렌더러를 배포하면 이름이 바뀌는데, 그 순간 옛 파일을
|
|
* 지우면 아직 다시 굽지 않은 사이트는 CSS·JS 가 **404** 다. 예전 구현이 그랬다.
|
|
*
|
|
* ★ 더 나쁜 건 크롤러다. 구글은 HTML 을 가져간 뒤 렌더를 **나중에** 돌린다. 그 사이에
|
|
* 자산이 사라지면 스타일도 스크립트도 없는 페이지를 렌더한 것으로 기록한다 — 하필
|
|
* 신규 도메인이 평가받는 시기에 그렇게 된다. 유예 창이 필요하다는 게 업계 통념이고
|
|
* (Vercel 은 검색봇에 한해 스큐 보호 창을 60일로 늘린다), 우리 창은 0초였다.
|
|
*
|
|
* 한 벌이 400KB 안팎이라 한 달치를 남겨도 10MB 남짓이다 — 싸게 사는 안전이다.
|
|
*/
|
|
const ASSET_RETENTION_DAYS = 30;
|
|
/** 하루에 여러 번 배포해도 직전 빌드는 반드시 남는다(보관 기간과 무관). */
|
|
const ASSET_MIN_BUILDS = 2;
|
|
/**
|
|
* 어떤 빌드가 어떤 파일을 깔았는지. **보관 기간의 근거는 이 파일이다.**
|
|
*
|
|
* ★ 파일 mtime 으로 나이를 재지 않는다 — 복사·동기화가 시각을 갈아 버리면 옛 파일이
|
|
* 영원히 젊어지거나 산 파일이 지워진다. 점(.)으로 시작해 업로드에서 빠진다
|
|
* (azure_static 이 dotfile 을 거른다).
|
|
*/
|
|
const ASSET_LEDGER = '.builds.json';
|
|
|
|
/** 자산 대장 한 줄 — 한 번의 번들 빌드가 깐 파일 목록. */
|
|
interface AssetBuild {
|
|
/** 이 번들을 마지막으로 깐 시각(ISO). 같은 번들로 다시 구우면 갱신된다. */
|
|
at: string;
|
|
/** assets/ 기준 상대 경로. */
|
|
files: string[];
|
|
}
|
|
|
|
/** 디렉토리 안의 파일을 상대 경로로 편다(하위 디렉토리 포함). */
|
|
function listRelativeFiles(dir: string, prefix = ''): string[] {
|
|
const found: string[] = [];
|
|
for (const entry of readdirSync(dir, {withFileTypes: true})) {
|
|
const rel = prefix ? `${prefix}/${entry.name}` : entry.name;
|
|
if (entry.isDirectory()) found.push(...listRelativeFiles(join(dir, entry.name), rel));
|
|
else if (entry.isFile()) found.push(rel);
|
|
}
|
|
return found;
|
|
}
|
|
|
|
/**
|
|
* 발행본이 **지금 실제로 참조하고 있는** 자산. 여기 들어오면 절대 지우지 않는다.
|
|
*
|
|
* ★ 왜 보관 기간만으로는 부족한가 — `out/s/` 에는 **payload 가 없는 사이트**가 있다(목업).
|
|
* 그건 재굽기 대상이 아니다. 프리렌더는 payload 를 받아 그 사이트만 굽고, payload 가 없는
|
|
* 디렉토리는 쳐다보지도 않는다 — 그래서 자산이 한 번 지워지면 **영영 복구되지 않는다.**
|
|
* 재굽기를 몇 번을 돌려도 살아나지 않고, 사람이 파일을 손으로 되돌려 넣어야 한다.
|
|
*
|
|
* 실측(2026-09-07): `/s/stay` · `/s/stay2` · `/s/stay3` 가 번들 해시가 바뀐 순간
|
|
* CSS·JS·이미지 전부 404 가 됐다. 보관 기간(30일)으로는 못 막는다 — 기간이 지나면
|
|
* 똑같은 일이 난다. **참조가 살아 있는 한 남긴다** 가 유일하게 맞는 규칙이다.
|
|
*
|
|
* ★ 사이트를 굽기 전에 부른다. 그래야 이번에 다시 굽지 않는 사이트의 옛 참조가 잡힌다.
|
|
*/
|
|
function referencedAssets(outRoot: string): Set<string> {
|
|
const sitesDir = join(outRoot, SITE_DIR);
|
|
const found = new Set<string>();
|
|
if (!existsSync(sitesDir)) return found;
|
|
|
|
for (const entry of readdirSync(sitesDir, {withFileTypes: true})) {
|
|
if (!entry.isDirectory()) continue;
|
|
const file = join(sitesDir, entry.name, 'index.html');
|
|
if (!existsSync(file)) continue;
|
|
// basePath 가 붙어도(`/sites/assets/…`) `/assets/` 뒤만 집으면 파일 경로가 나온다.
|
|
for (const match of readFileSync(file, 'utf-8').matchAll(/\/assets\/([^"'\s)\\]+)/g)) {
|
|
found.add(decodeURIComponent(match[1]));
|
|
}
|
|
}
|
|
return found;
|
|
}
|
|
|
|
function readAssetLedger(assetsDir: string): AssetBuild[] {
|
|
try {
|
|
const parsed = JSON.parse(readFileSync(join(assetsDir, ASSET_LEDGER), 'utf-8')) as {
|
|
builds?: AssetBuild[];
|
|
};
|
|
return Array.isArray(parsed.builds) ? parsed.builds : [];
|
|
} catch {
|
|
// 없거나 깨졌으면 빈 대장으로 시작한다. 디스크에 있던 파일은 pruneAssets 가
|
|
// "처음 본 것" 으로 입양하므로 지워지지 않는다 — 그 ★ 주석이 이 실패의 근거다.
|
|
return [];
|
|
}
|
|
}
|
|
|
|
/**
|
|
* 보관 기간이 지난 옛 해시 파일만 지운다.
|
|
*
|
|
* ★ 발행할 때마다 이 함수가 돈다(사이트 하나만 구울 때도). 번들이 그대로면 대장에 줄이
|
|
* 늘지 않고 맨 앞 줄의 시각만 갱신된다 — 안 그러면 발행 횟수만큼 대장이 자란다.
|
|
*/
|
|
function pruneAssets(assetsDir: string, current: string[], referenced: Set<string>) {
|
|
const signature = (files: string[]) => [...files].sort().join('\n');
|
|
const now = new Date().toISOString();
|
|
const previous = readAssetLedger(assetsDir);
|
|
const head: AssetBuild = {at: now, files: current};
|
|
const builds =
|
|
previous[0] && signature(previous[0].files) === signature(current)
|
|
? [head, ...previous.slice(1)]
|
|
: [head, ...previous];
|
|
|
|
/**
|
|
* ★ 대장에 없는 파일은 **지우지 않는다.** 언제 깔렸는지 모를 뿐이므로 지금 처음 본 것으로
|
|
* 치고 보관 기간을 새로 준다.
|
|
*
|
|
* 이 줄이 없어서 실제로 운영 사이트가 끊겼다(2026-09-07). 대장은 이 기능과 함께 생겼으니
|
|
* **배포 직후 첫 실행에는 대장이 없다** — 그때 디스크에 있던 기존 자산이 전부 "대장에 없음"
|
|
* 으로 분류돼 한꺼번에 삭제됐고, 아직 다시 굽지 않은 사이트의 CSS 가 통째로 404 가 됐다.
|
|
* 옛 자산을 남기려고 만든 코드가 첫 실행에서 정확히 반대로 동작했다.
|
|
*/
|
|
const recorded = new Set(builds.flatMap((build) => build.files));
|
|
const adopted = listRelativeFiles(assetsDir).filter(
|
|
(file) => file !== ASSET_LEDGER && !recorded.has(file),
|
|
);
|
|
if (adopted.length > 0) {
|
|
builds.push({at: now, files: adopted});
|
|
console.log(` ✓ 대장에 없던 자산 ${adopted.length}개를 보관 대상으로 넣는다`);
|
|
}
|
|
|
|
const cutoff = Date.now() - ASSET_RETENTION_DAYS * 24 * 60 * 60 * 1000;
|
|
const kept = builds.filter(
|
|
(build, index) => index < ASSET_MIN_BUILDS || Date.parse(build.at) >= cutoff,
|
|
);
|
|
const alive = new Set(kept.flatMap((build) => build.files));
|
|
|
|
let removed = 0;
|
|
for (const file of listRelativeFiles(assetsDir)) {
|
|
// ★ 참조가 살아 있으면 기간과 무관하게 남긴다 — referencedAssets 주석 참조.
|
|
if (file === ASSET_LEDGER || alive.has(file) || referenced.has(file)) continue;
|
|
rmSync(join(assetsDir, file), {force: true});
|
|
removed += 1;
|
|
}
|
|
|
|
writeFileSync(
|
|
join(assetsDir, ASSET_LEDGER),
|
|
JSON.stringify({schemaVersion: 1, builds: kept}, null, 2),
|
|
'utf-8',
|
|
);
|
|
if (removed > 0) {
|
|
console.log(` ✓ 보관 기간(${ASSET_RETENTION_DAYS}일)이 지난 자산 ${removed}개 정리`);
|
|
}
|
|
}
|
|
|
|
/**
|
|
* 클라이언트 번들과 public/ 을 대상 디렉토리에 깐다.
|
|
*
|
|
* ★ assets/ 를 통째로 지우고 다시 깔지 않는다(예전 구현). 옛 해시 파일은 보관 기간까지
|
|
* 남겨야 한다 — 근거는 ASSET_RETENTION_DAYS 주석. 권한 때문에 통째로 지웠던 것인데,
|
|
* copyDirectoryFiles 가 **파일마다** 먼저 rmSync 하므로 그 문제는 그대로 해결된다.
|
|
*/
|
|
function writeSharedAssets(destRoot: string, referenced: Set<string>) {
|
|
const assetsSrc = join(CLIENT_DIR, 'assets');
|
|
if (existsSync(assetsSrc)) {
|
|
const assetsDest = join(destRoot, 'assets');
|
|
copyDirectoryFiles(assetsSrc, assetsDest);
|
|
pruneAssets(assetsDest, listRelativeFiles(assetsSrc), referenced);
|
|
}
|
|
const publicDir = join(SITE_ROOT, 'public');
|
|
if (existsSync(publicDir)) {
|
|
copyDirectoryFiles(publicDir, destRoot);
|
|
}
|
|
}
|
|
|
|
/**
|
|
* 오리진 루트의 `robots.txt` 와 사이트맵 인덱스.
|
|
*
|
|
* ★ 왜 필요한가
|
|
* 크롤러는 robots.txt 를 **오리진 루트에서만** 읽는다(RFC 9309). 발행 사이트는
|
|
* `<host>/s/<slug>/` 아래라, 지금까지 구워 온 사이트별 robots.txt 는 한 번도 읽힌 적이 없다 —
|
|
* AI 크롤러 명시 허용도, `Sitemap:` 지시도 전달되지 않았다. 사이트맵은 만들어 두고
|
|
* 그 존재를 알릴 방법이 없었으니 크롤러가 사이트를 찾아올 경로 자체가 없었다.
|
|
*
|
|
* ★ 왜 이번 실행에 온 payload 가 아니라 출력 디렉토리를 훑는가
|
|
* 발행은 **바뀐 사이트 하나만** 굽는다(scripts/watch-payloads.mjs). 이번 실행분만 인덱스에
|
|
* 담으면 나머지 사이트가 인덱스에서 사라진다. 디스크에 실제로 존재하는 발행본이 곧 정답이다.
|
|
*/
|
|
/**
|
|
* 빌더 미리보기가 iframe 으로 띄우는 CSR 셸.
|
|
*
|
|
* ★ 왜 iframe 인가 (2026-09-09)
|
|
* 빌더 안에 발행본 컴포넌트를 **직접** 그려 봤는데, 색·서체·섹션 구성이 같아져도
|
|
* **레이아웃 폭이 어긋났다.** 미디어 쿼리는 창 폭을 보는데 미리보기의 실제 사이트 폭은
|
|
* 그 안의 프레임(max-w-5xl)이기 때문이다. 실측(1400px 창 · 1024px 프레임):
|
|
* festival 2560px → 6027px, guide 1168 → 2168, location 586 → 1135.
|
|
* 내용(글자 수)은 완전히 같은데 그리드 컬럼 수만 달라 두 배씩 길어졌다.
|
|
* iframe 은 자체 뷰포트를 가져서 미디어 쿼리가 발행본과 **정확히 같은 폭**을 본다.
|
|
* PC/태블릿/모바일 전환도 iframe 폭만 바꾸면 그대로 맞는다.
|
|
*
|
|
* ★ payload 는 셸이 아니라 브라우저가 가져온다(`entry-client`). 굽는 시점에는
|
|
* 어느 사업장을 미리 볼지 모르고, 미리보기는 **발행 전 최신 값**을 봐야 한다.
|
|
*/
|
|
function writePreviewShell(outRoot: string, assets: {script: string; css: string[]}) {
|
|
const lines = [
|
|
'<!doctype html>',
|
|
'<html lang="ko">',
|
|
' <head>',
|
|
' <meta charset="utf-8" />',
|
|
' <meta name="viewport" content="width=device-width, initial-scale=1" />',
|
|
// ★ 미리보기는 색인 대상이 아니다. 발행 전 값이라 검색에 걸리면 안 된다.
|
|
' <meta name="robots" content="noindex, nofollow" />',
|
|
' <title>미리보기</title>',
|
|
...assets.css.map((file) => ` <link rel="stylesheet" href="/assets/${file}" />`),
|
|
' </head>',
|
|
' <body class="site">',
|
|
' <div id="root"></div>',
|
|
` <script type="module" src="/assets/${assets.script}"></script>`,
|
|
' </body>',
|
|
'</html>',
|
|
];
|
|
const dir = join(outRoot, 'preview');
|
|
mkdirSync(dir, {recursive: true});
|
|
writeFileSync(join(dir, 'index.html'), lines.join('\n'), 'utf-8');
|
|
console.log(' ✓ 빌더 미리보기 셸 (/preview)');
|
|
}
|
|
|
|
function writeRootMachineFiles(outRoot: string, origin: string) {
|
|
const sitesDir = join(outRoot, SITE_DIR);
|
|
if (!existsSync(sitesDir)) return;
|
|
|
|
const sites: DirectoryEntry[] = readdirSync(sitesDir, {withFileTypes: true})
|
|
.filter((entry) => entry.isDirectory())
|
|
.map((entry) => ({slug: entry.name, file: join(sitesDir, entry.name, 'index.html')}))
|
|
// index.html 이 없으면 발행이 끝나지 않은(또는 실패한) 디렉토리다. 사이트맵에 넣지 않는다.
|
|
.filter((entry) => existsSync(entry.file))
|
|
// 제목·lastmod·noindex 가 같은 HTML 에서 나온다 — 파일은 한 번만 읽는다.
|
|
.map((entry) => ({...entry, html: readFileSync(entry.file, 'utf-8')}))
|
|
// ★ noindex 를 선언한 페이지(목업·백업)는 싣지 않는다 — readBakedNoindex 주석 참조.
|
|
.filter((entry) => !readBakedNoindex(entry.html))
|
|
.map(({html, ...entry}) => {
|
|
return {
|
|
// ★ 끝 슬래시를 붙이지 않는다. 페이지의 canonical 은 `/s/<slug>` 다(shared/lib/slug.ts
|
|
// publishUrl). 사이트맵이 `/s/<slug>/` 로 어긋나 있던 동안 서치콘솔은 제출한 URL 을
|
|
// 전부 "대체 페이지(적절한 표준 태그가 있음)" 로 분류했다 — 색인은 되는데 제출분은
|
|
// 0건으로 보이는, 눈으로 원인을 못 찾는 종류다.
|
|
loc: joinUrl(origin, SITE_DIR, entry.slug),
|
|
title: readBakedTitle(html) || entry.slug,
|
|
// ★ mtime 으로 떨어지는 건 dateModified 메타가 없던 시절의 산출물뿐이다.
|
|
// 그 사이트를 한 번 다시 구우면 제 값이 들어온다(readBakedLastmod 주석 참조).
|
|
lastmod: readBakedLastmod(html) ?? statSync(entry.file).mtime.toISOString(),
|
|
};
|
|
})
|
|
.sort((a, b) => a.loc.localeCompare(b.loc));
|
|
|
|
// ★ `/s` 목록 페이지. 크롤러가 발행본에 닿는 두 번째 경로다 —
|
|
// 사이트맵만 있을 때 서치콘솔은 "참조 페이지: 감지된 페이지 없음" 이라고 답했다.
|
|
// ★ 끝 슬래시를 붙이지 않는다 — 슬러그 페이지(`/s/<slug>`)와 같은 형태여야 한다.
|
|
// nginx 가 `location = /s` 로 이 파일을 직접 주고 `/s/` 는 여기로 301 한다
|
|
// (nginx/site.conf). 그 블록이 없으면 `/s` 는 빌더 SPA 셸을 200 으로 내준다.
|
|
const indexUrl = joinUrl(origin, SITE_DIR);
|
|
writeFileSync(join(sitesDir, 'index.html'), renderSiteIndex(origin, indexUrl, sites), 'utf-8');
|
|
|
|
// 사이트맵에는 랜딩·목록 페이지도 담는다. 랜딩은 이 호스트의 첫 페이지이고,
|
|
// 목록은 발행본 전부로 이어지는 허브다 — 둘 다 크롤러가 먼저 열어야 하는 자리다.
|
|
const entries: SiteEntry[] = [{loc: origin + '/'}, {loc: indexUrl}, ...sites];
|
|
|
|
writeFileSync(join(outRoot, 'robots.txt'), renderRootRobotsTxt(origin), 'utf-8');
|
|
writeFileSync(join(outRoot, 'sitemap.xml'), renderSiteUrlset(entries), 'utf-8');
|
|
writeFileSync(join(outRoot, 'llms.txt'), renderRootLlmsTxt(origin, indexUrl, sites), 'utf-8');
|
|
console.log(` ✓ 루트 robots.txt · sitemap.xml · llms.txt · /s/ 목록 (사이트 ${sites.length}개)`);
|
|
writeIndexNowKey(outRoot);
|
|
}
|
|
|
|
/**
|
|
* IndexNow 키 파일 — `https://<host>/<key>.txt` 에 키 문자열만 들어 있다.
|
|
*
|
|
* ★ 이게 없으면 백엔드의 통보가 403 으로 거절된다. 검색엔진은 통보를 받으면
|
|
* 이 URL 을 열어 같은 키가 있는지 보고, 그걸로 "이 호스트를 제어하는 쪽이 보냈다"를 확인한다.
|
|
* 비밀이 아니다 — 공개되어야 작동하는 값이다.
|
|
*
|
|
* ★ 백엔드와 **같은 env 를 본다**. 키를 두 군데 적으면 어긋나는 날 통보가 조용히 다 막힌다.
|
|
*/
|
|
function writeIndexNowKey(outRoot: string) {
|
|
const key = (process.env.INDEXNOW_KEY ?? '').trim();
|
|
if (!key) return;
|
|
// 규격: 8~128자, 영문·숫자·하이픈. 어긋나면 굽지 않는다(잘못된 파일이 있으면 원인 찾기가 더 어렵다).
|
|
if (!/^[A-Za-z0-9-]{8,128}$/.test(key)) {
|
|
console.warn(' ! INDEXNOW_KEY 형식이 규격(8~128자 영문·숫자·하이픈)에 맞지 않아 건너뛴다');
|
|
return;
|
|
}
|
|
writeFileSync(join(outRoot, `${key}.txt`), key, 'utf-8');
|
|
console.log(' ✓ IndexNow 키 파일');
|
|
}
|
|
|
|
function main() {
|
|
const args = parseArgs();
|
|
const loaded = loadPayloads(args.payloads);
|
|
const assets = readAssets();
|
|
|
|
console.log(`[prerender] 사이트 ${loaded.length}개 → ${args.out}`);
|
|
|
|
// ★ 굽기 **전에** 참조를 훑는다. 이번에 다시 굽지 않는 사이트(payload 가 없는 목업 포함)가
|
|
// 무엇을 가리키고 있는지는 지금 디스크에 있는 HTML 만 안다.
|
|
const referenced = referencedAssets(args.out);
|
|
|
|
// ★ 공용 자산은 사이트를 굽기 전에 딱 한 번 깐다. 사이트마다 복사하던 걸 여기로 뺐다.
|
|
writeSharedAssets(args.out, referenced);
|
|
|
|
let failed = 0;
|
|
/** 루트 기계용 파일을 쓸 오리진. 이 호스트의 사이트는 전부 같은 오리진을 쓴다. */
|
|
let origin = '';
|
|
|
|
/** 보고서용 슬러그. payload 를 못 읽었으면 파일명에서 얻는다(백엔드가 `<slug>.json` 으로 쓴다). */
|
|
const slugOf = (entry: LoadedPayload) =>
|
|
entry.payload?.site?.slug ?? (entry.file ? basename(entry.file, '.json') : '');
|
|
|
|
const fail = (
|
|
entry: LoadedPayload,
|
|
message: string,
|
|
mismatches: string[] = [],
|
|
uniqueContentCount: number | null = null,
|
|
) => {
|
|
failed += 1;
|
|
console.error(` ✗ ${slugOf(entry) || '(slug 없음)'} — ${message}`);
|
|
if (!entry.file) return;
|
|
writeReport(entry.file, {
|
|
schemaVersion: 1,
|
|
slug: slugOf(entry),
|
|
siteId: entry.payload?.site?.siteId ?? '',
|
|
placeId: entry.payload?.site?.placeId ?? '',
|
|
siteVersion: entry.payload?.site?.version ?? 0,
|
|
ok: false,
|
|
renderedAt: new Date().toISOString(),
|
|
routes: 0,
|
|
bundle: assets.script,
|
|
uniqueContentCount,
|
|
jsonld: null,
|
|
mismatches,
|
|
error: message,
|
|
});
|
|
};
|
|
|
|
for (const entry of loaded) {
|
|
// 읽기·검증 단계에서 이미 실패한 건 굽지 않는다. 다른 사이트는 계속 간다.
|
|
if (entry.error || !entry.payload) {
|
|
fail(entry, entry.error ?? 'payload 를 읽지 못했습니다');
|
|
continue;
|
|
}
|
|
|
|
try {
|
|
const result = prerenderSite(entry.payload, args.out, assets, referenced);
|
|
const payload = result.payload;
|
|
origin = origin || payload.site.origin;
|
|
const home = joinUrl(payload.site.origin, payload.site.basePath);
|
|
console.log(
|
|
` ✓ ${payload.place.name} (${payload.site.slug}) — index.html + llms.txt`,
|
|
);
|
|
console.log(` ${result.siteDir}`);
|
|
console.log(` ${home}`);
|
|
|
|
if (entry.file) {
|
|
writeReport(entry.file, {
|
|
schemaVersion: 1,
|
|
slug: payload.site.slug,
|
|
siteId: payload.site.siteId,
|
|
placeId: payload.site.placeId,
|
|
siteVersion: payload.site.version,
|
|
ok: true,
|
|
renderedAt: new Date().toISOString(),
|
|
// 사이트당 한 장. 보고서 스키마는 백엔드가 읽으므로 필드는 남긴다.
|
|
routes: 1,
|
|
bundle: assets.script,
|
|
uniqueContentCount: result.uniqueContentCount,
|
|
jsonld: result.jsonld,
|
|
mismatches: [],
|
|
error: null,
|
|
});
|
|
}
|
|
} catch (ex) {
|
|
// ★ 한 사이트가 깨졌다고 나머지를 못 굽게 두지 않는다. 실패는 보고서로 남긴다 —
|
|
// 조용히 넘어가면 "발행했는데 페이지가 없다"가 다시 반복된다.
|
|
// ★ 계수를 못 잰 실패(디스크·번들·payload 파손)는 null 로 남긴다. 0 으로 적으면
|
|
// 백엔드가 "고유 콘텐츠 0건" 으로 읽어 또 엉뚱한 사유를 붙인다.
|
|
const counted = ex instanceof VerifyError || ex instanceof NoUniqueContentError ? ex : null;
|
|
fail(
|
|
entry,
|
|
ex instanceof Error ? ex.message : String(ex),
|
|
counted?.mismatches ?? [],
|
|
counted?.uniqueContentCount ?? null,
|
|
);
|
|
}
|
|
}
|
|
|
|
// ★ 실패한 사이트가 있어도 루트 파일은 갱신한다 — 성공한 사이트까지 색인에서 빠질 이유가 없다.
|
|
// (인덱스는 디스크를 훑으므로 실패한 사이트는 애초에 들어가지 않는다.)
|
|
writePreviewShell(args.out, assets);
|
|
if (origin) writeRootMachineFiles(args.out, origin);
|
|
|
|
if (failed > 0) {
|
|
console.error(`[prerender] ${loaded.length}개 중 ${failed}개 실패`);
|
|
process.exitCode = 1;
|
|
return;
|
|
}
|
|
console.log('[prerender] 완료');
|
|
}
|
|
|
|
main();
|