# maytally.co.uk 被 AI 引用体检：82/100 · 基础扎实，细节待补

- 目标：https://maytally.co.uk/
- 扫描时间：2026-09-15T12:09:01.993Z（耗时 4513 ms）
- 报告：https://madeinred.com/scan/maytally.co.uk
- JSON：https://madeinred.com/api/v1/report?url=https%3A%2F%2Fmaytally.co.uk%2F

## 分层得分

| 层 | 得分 | 通过 |
|---|---|---|
| 抓取许可（不开门，推了也白推） | 45 / 45 | 12 / 12 |
| 推送就绪（等价于 GSC 的那个按钮） | 19.4 / 25 | 6 / 9 |
| 引用形态（推不动，只能塑形） | 17.5 / 30 | 7 / 16 |
| 新兴信号（有则加分，无不扣分） | +0 / 5 | 0 / 6 |

## 全身检查（抽样页面的引用形态）

| 类型 | 页面 | HTTP | 引用形态 | 缺口 |
|---|---|---|---|---|
| 文章页 | https://maytally.co.uk/guides/emmas-diary-argos-vs-boots-stock | 200 | 93% | 标题后紧跟 40–80 词直接结论 |
| 其它页 | https://maytally.co.uk/about | 200 | 59% | H2 使用问句 / 对比句；标题后紧跟 40–80 词直接结论；发布 / 更新日期可机读；作者 / 发布者可机读；JSON-LD 结构化数据 |
| 其它页 | https://maytally.co.uk/benefits/for/high-earner | 200 | 60% | H2 使用问句 / 对比句；标题后紧跟 40–80 词直接结论；发布 / 更新日期可机读；作者 / 发布者可机读；引用外部来源 |

- sitemap 抽检：6 / 6 存活
- 信任页：关于 ✓，联系 ✕ 404，政策 ✓

## 优先修复

### 01 Bing Webmaster Tools 验证痕迹 · 推送就绪 · 未通过

证据：没有 msvalidate.01 meta，也没有 /BingSiteAuth.xml。（若通过 DNS CNAME 验证则站外不可见，可忽略此项。）

修复：

注册 Bing Webmaster Tools（bing.com/webmasters），选择"从 Google Search Console 导入"一键同步站点与 sitemap；验证后对重点页面用 URL Inspection → Request Indexing 手动请求收录——这就是那个"pin"按钮。

### 02 RSS / Atom 订阅源可发现 · 推送就绪 · 未通过

证据：<head> 中没有 RSS/Atom 的 <link rel="alternate">。

修复：

输出 RSS 或 Atom（WordPress 默认有 /feed/），在 <head> 声明 <link rel="alternate" type="application/rss+xml" href="...">，并在 Bing Webmaster Tools 的 Sitemaps 里一并提交订阅源。

### 03 Google Search Console 验证痕迹 · 推送就绪 · 部分

证据：没有 google-site-verification meta。GSC 常用 DNS / GA / GTM 验证，站外无法确认，仅扣一半。

修复：

确认站点已在 Google Search Console 验证并提交 sitemap（喂 AI Overviews 与 Gemini）。

### 04 H2 使用问句 / 对比句 · 引用形态 · 未通过

证据：6 个 H2/H3 全是名词短语，没有一个是问句或对比句：「Tell us a little」 「See what may apply」 「Take your next step」

修复：

```
把 H2 改写成用户会向 ChatGPT 提出的问题或对比句，例如：
- 「产品特点」→「What is the difference between X and Y?」
- 「关于我们」→「Why choose our Z for …?」
每个问句标题下第一段直接给 40–80 词结论。
```

### 05 标题后紧跟 40–80 词直接结论 · 引用形态 · 未通过

证据：6 个 H2/H3 中 0 个后面紧跟 40–80 词的结论段；0 个后面没有段落，6 个段落过短，0 个段落过长。

修复：

每个 H2/H3 之后的第一段直接回答标题提出的问题：一句结论 + 一两句依据，40–80 词（中文约 60–150 字），不要先铺垫。列表和表格放在结论段之后。

### 06 发布 / 更新日期可机读 · 引用形态 · 未通过

证据：没有机读的发布/更新日期（JSON-LD、article:*_time、<time datetime> 均未发现）。

修复：

在 JSON-LD 中输出 datePublished 与 dateModified，并在页面可见处用 <time datetime="2026-…">更新于 …</time>。

### 07 引用外部来源 · 引用形态 · 未通过

证据：正文没有引用任何外部来源（社媒链接不计）。

修复：

为关键数据、标准与结论加 2 个以上权威外链。注意："有其他站佐证"指的是别人引用你，站外无法在此验证——这里量的是你引用别人，是可信度的下限。

### 08 抽样页面的引用形态（产品 / 文章 / 分类） · 引用形态 · 部分

证据：抽样 3 个页面的引用形态得分率：文章页 93%，其它页 59%，其它页 60%（平均 71%）。共同缺口：标题后紧跟 40–80 词直接结论（3/3 页）；H2 使用问句 / 对比句（2/3 页）；发布 / 更新日期可机读（2/3 页）；作者 / 发布者可机读（2/3 页）。

修复：

按页面类型修模板，而不是逐页改：最弱的是 其它页（59%，https://maytally.co.uk/about）。跨页面最常见的缺口：标题后紧跟 40–80 词直接结论（3/3 页）；H2 使用问句 / 对比句（2/3 页）；发布 / 更新日期可机读（2/3 页）；作者 / 发布者可机读（2/3 页）。这些多半来自同一个页面模板，改模板一次即可覆盖全站同类页面。

### 09 关于 / 联系 / 政策页可抓取 · 引用形态 · 部分

证据：找到 关于、政策（退换 / 隐私 / 条款）；缺 联系（尝试 https://maytally.co.uk/contact → 404）。

修复：

补齐并在页脚链接：关于页（公司实体、地址、成立时间）、联系页（邮箱 / 电话 / 表单）、退换货与隐私政策页。Shopify 用 /pages/about、/pages/contact、/policies/refund-policy；自建站放 /about、/contact、/returns、/privacy。这些 URL 同时也是 Agentic Commerce 商品 feed 里 return_policy / privacy_policy 字段要填的值。

### 10 作者 / 发布者可机读 · 引用形态 · 部分

证据：有 Organization 结构化数据，但页面没有 author 归属。

修复：

文章类页面在 JSON-LD 中加 author（Person 或 Organization，含 name 与 url）；品牌页至少给 publisher。

### 11 品牌实体（Organization + sameAs） · 引用形态 · 部分

证据：有 Organization，但没有 sameAs 指向官方社媒 / LinkedIn / Wikidata / Crunchbase 等。

修复：

在 Organization 中加 sameAs 数组，列出所有官方外部身份页，让引擎把"其他站的佐证"归到同一实体。

### 12 Open Graph 完整 · 引用形态 · 部分

证据：缺少：og:image。

修复：

补齐 Open Graph 四要素，og:image 用 1200×630 的品牌图。

## 实测抓取（按 User-Agent）

| 身份 | HTTP | 正文字符 | 耗时 | 判定 |
|---|---|---|---|---|
| 普通浏览器 | 200 | 2892 | 492 ms | 正常 |
| OAI-SearchBot | 200 | 2892 | 265 ms | 正常 |
| ChatGPT-User | 200 | 2892 | 285 ms | 正常 |
| Bingbot | 200 | 2892 | 418 ms | 正常 |

## 抓取许可 · 不开门，推了也白推

- ✓ **robots.txt 放行 OAI-SearchBot** — 通配分组 User-agent: * 允许抓取 /（未被 Disallow 命中，默认放行）。
- ✓ **实测：OAI-SearchBot 身份可抓取** — 以 OAI-SearchBot 身份抓取正常。HTTP 200，22287 字节，正文 2892 字符（浏览器基线 2361 字符），265 ms。
- ✓ **robots.txt 放行 ChatGPT-User** — 通配分组 User-agent: * 允许抓取 /（未被 Disallow 命中，默认放行）。
- ✓ **robots.txt 放行 Bingbot** — 通配分组 User-agent: * 允许抓取 /（未被 Disallow 命中，默认放行）。
- ✓ **实测：ChatGPT-User 身份可抓取** — 以 ChatGPT-User 身份抓取正常。HTTP 200，22287 字节，正文 2892 字符（浏览器基线 2361 字符），285 ms。
- ✓ **页面允许索引** — robots 指令存在但不含 noindex：meta: index, follow。
- ✓ **实测：Bingbot 身份可抓取** — 以 Bingbot 身份抓取正常。HTTP 200，22287 字节，正文 2892 字符（浏览器基线 2361 字符），418 ms。
- ✓ **放行其它 AI 答案引擎** — 8 个答案引擎爬虫（PerplexityBot, Perplexity-User, Claude-SearchBot, Claude-User, DuckAssistBot, Applebot, Amazonbot, MistralAI-User）全部放行。
- ✓ **允许摘录片段** — 未设置摘录限制。
- ✓ **HTTP 基础健康** — HTTP 200，HTTPS，0 次跳转，首字节 492 ms（含正文 492 ms），22287 字节，Content-Type text/html;charset=utf-8。
- ✓ **robots.txt 放行 Googlebot** — 通配分组 User-agent: * 允许抓取 /（未被 Disallow 命中，默认放行）。
- ✓ **不存在的路径返回真实 404** — 随机不存在路径返回 HTTP 404。
- i **GPTBot（训练爬虫）策略**（仅展示） — GPTBot（训练爬虫）目前放行。放不放行不影响 ChatGPT 搜索引用，纯属你对训练数据的态度。
- i **CDN / WAF 识别**（仅展示） — 站点走 Cloudflare（cf-ray a3b7850f5fabf7bd-LAX，cf-cache-status DYNAMIC）。Bot Fight Mode / AI Crawl Control 的默认策略会拦截 AI 爬虫，请对照上面三条"实测"结果逐项核查。
- — **Content-Signal 未禁止 AI 检索** — robots.txt 中没有 Content-Signal 指令（未使用 Cloudflare 内容信号），不适用。

## 推送就绪 · 等价于 GSC 的那个按钮

- ✕ **Bing Webmaster Tools 验证痕迹** — 没有 msvalidate.01 meta，也没有 /BingSiteAuth.xml。（若通过 DNS CNAME 验证则站外不可见，可忽略此项。）
- ✕ **RSS / Atom 订阅源可发现** — <head> 中没有 RSS/Atom 的 <link rel="alternate">。
- ~ **Google Search Console 验证痕迹** — 没有 google-site-verification meta。GSC 常用 DNS / GA / GTM 验证，站外无法确认，仅扣一半。
- ✓ **sitemap.xml 存在且被 robots.txt 声明** — sitemap https://maytally.co.uk/sitemap.xml，774 条，已在 robots.txt 声明。
- ✓ **sitemap 里的 URL 真实存活** — 抽检 6 条 URL 全部返回 2xx（sitemap 共 774 条）。
- ✓ **sitemap 带 lastmod 且近期更新** — 774/774 条带 lastmod（100%），最新 2026-09-15（0 天前）。
- ✓ **canonical 自指向** — canonical 自指向：https://maytally.co.uk/
- ✓ **http 自动跳转 https** — http:// 经 1 跳（301）到 https://maytally.co.uk/
- ✓ **title 与 meta description 完备** — title「Find out what you may be able to claim — MayTally」(49)；description 146 字符。
- i **IndexNow 即时推送**（仅展示） — IndexNow 的 key 文件名不可预测，站外无法验证是否接入。若你的发布流程已经在推送，忽略此项。
- — **多语言 hreflang** — 未声明 hreflang。单语站不适用；若你有多语言版本，请为每种语言互相声明 <link rel="alternate" hreflang="..."> 并含 x-default。

## 引用形态 · 推不动，只能塑形

- ✕ **H2 使用问句 / 对比句** — 6 个 H2/H3 全是名词短语，没有一个是问句或对比句：「Tell us a little」 「See what may apply」 「Take your next step」
- ✕ **标题后紧跟 40–80 词直接结论** — 6 个 H2/H3 中 0 个后面紧跟 40–80 词的结论段；0 个后面没有段落，6 个段落过短，0 个段落过长。
- ✕ **发布 / 更新日期可机读** — 没有机读的发布/更新日期（JSON-LD、article:*_time、<time datetime> 均未发现）。
- ✕ **引用外部来源** — 正文没有引用任何外部来源（社媒链接不计）。
- ~ **抽样页面的引用形态（产品 / 文章 / 分类）** — 抽样 3 个页面的引用形态得分率：文章页 93%，其它页 59%，其它页 60%（平均 71%）。共同缺口：标题后紧跟 40–80 词直接结论（3/3 页）；H2 使用问句 / 对比句（2/3 页）；发布 / 更新日期可机读（2/3 页）；作者 / 发布者可机读（2/3 页）。
- ~ **关于 / 联系 / 政策页可抓取** — 找到 关于、政策（退换 / 隐私 / 条款）；缺 联系（尝试 https://maytally.co.uk/contact → 404）。
- ~ **作者 / 发布者可机读** — 有 Organization 结构化数据，但页面没有 author 归属。
- ~ **品牌实体（Organization + sameAs）** — 有 Organization，但没有 sameAs 指向官方社媒 / LinkedIn / Wikidata / Crunchbase 等。
- ~ **Open Graph 完整** — 缺少：og:image。
- ✓ **服务端渲染的正文** — 原始 HTML 正文 2361 字符 / 约 414 词，文本占比 10.6%，H1 1 个，HTML 22 KB。
- ✓ **标题层级清晰** — 1 个 H1、6 个 H2、共 7 个标题，层级顺序正常。
- ✓ **JSON-LD 结构化数据** — 1 段 JSON-LD，类型：Organization, WebSite。
- ✓ **可抽取的列表 / 表格** — 正文区有 3 个列表（≥3 项）与 0 个表格。
- ✓ **<html lang> 声明** — <html lang="en-gb">
- ✓ **<main> / <article> 语义容器** — 存在 <main>。
- ✓ **图片 alt 文本** — 2/2 张图片有 alt（100%）。
- — **Product / Offer 结构化数据完整** — 未发现产品页（sitemap 与内链里没有 /products/ 类路径，页面也没有 Product 结构化数据）。非电商站可忽略。

## 新兴信号 · 有则加分，无不扣分

- ✕ **/llms.txt** — /llms.txt 不存在（HTTP 404，返回的是 HTML）。
- ✕ **Accept: text/markdown 内容协商** — Accept: text/markdown 返回 text/html;charset=utf-8，未做内容协商。
- ✕ **/llms-full.txt** — /llms-full.txt 不存在。
- ✕ **FAQPage / HowTo 结构化数据** — 没有 FAQPage / HowTo 结构化数据。
- ✕ **/.well-known/api-catalog** — /.well-known/api-catalog 不存在。
- ✕ **ETag / Last-Modified** — 没有 ETag / Last-Modified。
- — **AggregateRating / Review 结构化数据** — 无产品页。

---
方法论：https://madeinred.com/methodology · 共 50 项检查，本次计分 43 项。