# AI 可检索 — WOHO猫

> 漫画是图片。AI 读不懂图片。所以本站把每一话的对白、分镜、画面描述全部做成纯文本，和图片并排放着——人看图，AI 读字。
> 本文件是 https://www.wohupanda.com/ai.html 的纯文本镜像。

## 已验证可读

ChatGPT · Claude · Gemini · Perplexity

---

## 机制 ① .md 镜像 — 每个页面都有纯文本孪生

你在浏览器看到的：`/chapters/chap01.html`（图 + 版式）
AI 客户端请求同路径加 `.md`：`/chapters/chap01.md` —— 对白、画面描述、摘要，全部是纯 Markdown。

请求示例：

```
GET /chapters/chap01.md HTTP/1.1
Host: www.wohupanda.com

HTTP/1.1 200 OK
Content-Type: text/markdown; charset=utf-8
Vary: Accept
Link: </chapters/chap01.html>; rel="alternate"

# 新崤山藏锋录 · 第 1 话 · 渡头初逢
（完整对白 + 逐格画面描述）
```

→ 真实样例：[第 1 话 .md 镜像](https://www.wohupanda.com/chapters/chap01.md)

---

## 机制 ② /llms.txt — 站点说明书

一份放在站点根目录的 Markdown 目录：这是什么站、有哪些作品、哪些章节免费。AI 平台把它当 README 用。

```
# WOHO猫

> 华语漫画平台：武侠魔幻、
> 都市言情、生活现实。

## 作品
- [新崤山藏锋录](/work.html): 武侠悬疑 · 连载中 · 第一部 14 话
  - [第 1 话 · 渡头初逢](/chapters/chap01.md)
…（全站章节清单）
```

→ [/llms.txt](https://www.wohupanda.com/llms.txt)

---

## 机制 ③ robots.txt — 明确欢迎 AI 爬虫

很多站一边抱怨「AI 怎么不引用我」，一边在 robots.txt 里把 GPTBot 拦得死死的。我们反着来：

- 放行 GPTBot / ClaudeBot / PerplexityBot / Google-Extended / Bytespider（字节跳动）
- 声明 `Content-Signal: search=yes, ai-input=yes, ai-train=yes`
- sitemap.xml 每日更新

```
User-agent: GPTBot
Allow: /

User-agent: ClaudeBot
Allow: /

User-agent: PerplexityBot
Allow: /

User-agent: *
Content-Signal: search=yes, ai-input=yes, ai-train=yes
```

→ [/robots.txt](https://www.wohupanda.com/robots.txt)

---

## 机制 ④ Accept 内容协商 — 同一 URL，智能返回

```
# 浏览器请求（要 HTML）
GET /chapters/chap01.html
Accept: text/html, */*
→ 返回 text/html（图 + 版式）

# Claude Code / Cursor 请求（要 Markdown）
GET /chapters/chap01.html
Accept: text/markdown, text/html
→ 返回 text/markdown（纯文本孪生）
响应头 Vary: Accept，CDN 分开缓存，不算 cloaking
```

这是 HTTP 标准玩法（1997 年就有），不是给爬虫看另一篇文章——同一内容、两种表示。验收工具：`acceptmarkdown.com` / `isitagentready.com`

→ 部署时由 `vercel.json` 与 Cloudflare `_headers` 同步落地。

---

## 机制 ⑤ 全量图片 alt

每一格漫画都带真实画面描述的 alt（不是「图片1」）。屏幕阅读器与 AI 共用这条通道。

例：「晨雾中的青石城门，一名背着长剑的少年迈步走出」

---

## 机制 ⑥ schema.org ComicSeries

结构化数据标注「这是漫画连载的第几话」，搜索引擎与部分 AI（Bing 系）据此建索引。在 `work.html` 与每话 `chapXX.html` 的 `<head>` 中以 JSON-LD 注入：

- `ComicSeries`（系列元数据，挂在 work.html）
- `ComicIssue`（单话元数据，挂在每话 chapXX.html，含 `isPartOf` 指向 ComicSeries）

---

## AI 可读性声明（汇总）

- 每个页面在同路径 `.md` 后缀下提供纯 Markdown 镜像
- 支持 `Accept: text/markdown` 内容协商（响应带 `Vary: Accept`）
- 漫画内容提供对白 transcript 与逐格画面描述（图片 alt 与正文同源）
- robots.txt 放行 GPTBot / ClaudeBot / PerplexityBot / Bytespider 等全部 AI 爬虫，并声明 `Content-Signal: search=yes, ai-input=yes, ai-train=yes`
- 结构化数据：schema.org ComicSeries + ComicIssue

---

平台：WOHO猫 · https://www.wohupanda.com
引用许可：`Content-Signal: search=yes, ai-input=yes, ai-train=yes`