MadeInRed

引用就绪

0/ 100
0 较上次
扫描于 2026-09-03 05:05 UTC2876 ms计分 43 项 第 7 次扫描
重新扫描

分数与每项证据公开;修复提示词(每项的证据、原始数据与改法打包成一段可贴给 Cursor / Codex 的话)需要注册后领取,免费,30 秒,注册后这个站会自动进你的「我的站点」。

优先修复 · 抓取许可优先,其次推送就绪,再是引用形态

01

Google Search Console 验证痕迹 部分通过 (50%)需站主操作

推送就绪 · 权重 1 · GSC 照旧走,喂 AI Overviews 与 Gemini。可能通过 DNS 验证,站外不可见。
02

图片 alt 文本 未通过

引用形态 · 权重 1 · 多模态检索与无障碍的共同基础。
03

服务端渲染的正文 部分通过 (60%)

引用形态 · 权重 6 · OAI-SearchBot 与 ChatGPT-User 不执行 JavaScript,看到的就是原始 HTML。
基于上面的证据生成,主链路 Codex,兜底 Cursor 池。

ChatGPT 视角 · OAI-SearchBot 不执行 JavaScript,它看到的正文就是左边这段;右边是能被整段摘走的块

爬虫看到的正文 2,349 字符
检测你的网站能否被 AI 引用 你的网站会被 ChatGPT 引用 吗? 贴一个 URL,按三层 pin 模型给出 0–100 的被引就绪分。 精选报告 真实案例 motscan.co.uk91/100 madeinred.com100/100 最近评分 实时更新 johgeeirrig.com89/100 motscan.co.uk/blog/is-cheap-obd2-scanner-worth-it95/100 wordpress.org/news78/100 cyclami.co.uk85/100 anker.com/uk85/100 zhihu.com/signin30/100 thisdomaindoesnotexist-xyz123.co.uk29/100 notion.com73/100 ecoflow.com/uk85/100 johgeeirrig.com89/100 nytimes.com39/100 en.wikipedia.org/wiki/On-board_diagnostics81/100 hongzhizuo.com/biaozhu90/100 hongzhizuo.com/gongjian93/100 hongzhizuo.com91/100 johgeeirrig.com87/100 accessorie.co.uk87/100 hongzhizuo.com/diaoyan94/100 stonecommissions.co.uk74/100 obdcode.co.uk86/100 johgeeirrig.com87/100 dunuf.co…
可摘录块 5 可整段引用 · 0 需改写 · 3 无段落
ChatGPT 搜索到底从哪里找内容?
ChatGPT 联网搜索的检索层是 Bing 索引加上 OpenAI 自己的 OAI-SearchBot 补充抓取。OpenAI 没有站长平台,但 Bing Webmaster Tools 有,所以"主动把页面 pin 进索引"的链路真实存在:先进 Bing 索引,再放行 OpenAI 的爬虫,最后把内容写成能被摘走的形状。
H2 · 52 词 · 问句 · 40–80 词直接结论,可整段引用
为什么抓取许可的权重最高?
因为不开门,推了也白推。robots.txt 必须放行 OAI-SearchBot(建索引)和 ChatGPT-User(用户提问时实时抓取);封了前者等于永久放弃被引用。更隐蔽的坑是 Cloudflare 的 Bot Fight Mode 与 AI 爬虫一键拦截会把它们挡在 WAF 上,robots 写得再对也没用。所以本工具用这三个身份各实抓一遍,失败直接封顶。
H2 · 64 词 · 问句 · 40–80 词直接结论,可整段引用
什么样的内容会被 ChatGPT 摘走?
进了索引不等于被引用。ChatGPT 挑的是能整段摘走的内容:服务端渲染的正文、问句式的 H2、紧跟其后 40–80 词的直接结论、可机读的发布与更新日期、明确的作者或品牌实体、JSON-LD 结构化数据,以及对比表和步骤列表这种可抽取结构。营销口号式的名词短语标题命中率最低。报告里的"ChatGPT 视角"会把爬虫真正看到的正文和能摘走的块直接摆出来。
H2 · 83 词 · 问句 · 40–80 词直接结论,可整段引用
主动推送能加速多少?
已在 Bing 相关词前十的页面,发布后几天内就可能出现在引用里;Bing 零基础的站要 4–12 周。IndexNow 在发布瞬间通知 Bing,省掉的是被发现的等待,省不掉的是建立权重的时间。具体做法:
H2 · 44 词 · 问句 · 40–80 词直接结论,可整段引用
报告怎么用?
先看顶部有没有硬门槛标红,有就只修那一条。然后按抓取许可、推送就绪、引用形态的顺序处理"优先修复"列表,用"复制修复提示词"挑选要修的项一键生成提示词贴给 Cursor 或 Codex。不适用的检查不计罚,新兴信号只加分。报告有稳定 URL 可分享,同一 URL 支持 Accept: text/markdown、JSON API 与 MCP;完整权重见 方法论。
H2 · 72 词 · 问句 · 40–80 词直接结论,可整段引用
精选报告
标题后面没有段落——ChatGPT 拿不到可摘录的答案
最近评分
标题后面没有段落——ChatGPT 拿不到可摘录的答案
三层 pin 模型
标题后面没有段落——ChatGPT 拿不到可摘录的答案
让模型扮演 ChatGPT 搜索做引用选择,只引用页面原文。

全身检查 · 引用发生在页面级:从 sitemap 抽产品页 / 文章页 / 分类页各一个,按同一套引用形态标准打分

类型页面HTTP引用形态缺口
文章页/scan/motscan.co.uk/blog/is-cheap-obd2-scanner-worth-it
motscan.co.uk/blog/is-cheap-obd2-scanner-worth-it 被引体检 95/100 · 引用就绪 · Is Cited
20077%H2 使用问句 / 对比句 标题后紧跟 40–80 词直接结论 引用外部来源
分类页/scan/wordpress.org/news
wordpress.org/news 被引体检 78/100 · 基础扎实,细节待补 · Is Cited
20073%H2 使用问句 / 对比句 标题后紧跟 40–80 词直接结论 引用外部来源
其它页/methodology
评分方法论 · 三层 pin 模型 · Is Cited
20090%标题后紧跟 40–80 词直接结论 引用外部来源
sitemap 抽检
6 / 6 存活
抽样的 URL 全部返回 2xx
信任页
3 / 3
✓ 关于 200
✓ 联系 200
✓ 政策 200

分数里的"抽样页面的引用形态"就来自这张表。同类页面多半共用一个模板:修模板一次,全站同类页面一起好。站点在 Bing 里收了多少页,这里不猜——以 Bing Webmaster Tools 的收录数为准。

实测抓取 · 同一 URL,不同 User-Agent

身份HTTP正文字符耗时判定
普通浏览器 200 2,665 118 ms 正常
OAI-SearchBot 200 2,665 7 ms 正常
ChatGPT-User 200 2,665 8 ms 正常
Bingbot 200 2,665 8 ms 正常

出口 IP 不是各爬虫的官方 IP 段:IP 白名单式放行在此看不到,UA 级封禁会原形毕露。以服务器日志里真实爬虫回 200 为最终确认。

审计每一项 · 50 项检查,本次计分 43 项;通过项也附证据与"为什么重要"

第 1 层 抓取许可 · 不开门,推了也白推13 / 13 通过 · 45 / 45
robots.txt 放行 OAI-SearchBot权重 10 · 通过
专属分组 User-agent: OAI-SearchBot 允许抓取 /(显式放行)。
为什么重要 · OAI-SearchBot 建 ChatGPT 搜索索引,封了它等于永久放弃被引用。
实测:OAI-SearchBot 身份可抓取权重 9 · 通过
以 OAI-SearchBot 身份抓取正常。HTTP 200,50107 字节,正文 2665 字符(浏览器基线 2349 字符),7 ms。
为什么重要 · robots.txt 写得再对,WAF 在前面拦一下就全白搭。以 OAI-SearchBot UA 实抓验证。
robots.txt 放行 ChatGPT-User权重 5 · 通过
专属分组 User-agent: ChatGPT-User 允许抓取 /(显式放行)。
为什么重要 · 用户提问时的实时抓取,决定 ChatGPT 能否当场读到你的页面。
robots.txt 放行 Bingbot权重 5 · 通过
专属分组 User-agent: Bingbot 允许抓取 /(显式放行)。
为什么重要 · ChatGPT 搜索的检索层建在 Bing 索引上。
实测:ChatGPT-User 身份可抓取权重 5 · 通过
以 ChatGPT-User 身份抓取正常。HTTP 200,50107 字节,正文 2665 字符(浏览器基线 2349 字符),8 ms。
为什么重要 · 实时抓取的身份,同样会被 Bot Fight Mode / AI 爬虫拦截规则误伤。
页面允许索引权重 5 · 通过
robots 指令存在但不含 noindex:meta: index,follow,max-snippet:-1。
为什么重要 · noindex(meta 或 X-Robots-Tag)会让页面从任何索引中消失。
实测:Bingbot 身份可抓取权重 4 · 通过
以 Bingbot 身份抓取正常。HTTP 200,50107 字节,正文 2665 字符(浏览器基线 2349 字符),8 ms。
为什么重要 · 进不了 Bing 索引,ChatGPT 搜索就找不到你。
放行其它 AI 答案引擎权重 3 · 通过
8 个答案引擎爬虫(PerplexityBot, Perplexity-User, Claude-SearchBot, Claude-User, DuckAssistBot, Applebot, Amazonbot, MistralAI-User)全部放行。
为什么重要 · Perplexity、Claude、DuckDuckGo AI、Apple、Amazon 的检索爬虫,同一套逻辑。
Content-Signal 未禁止 AI 检索权重 3 · 通过
Content-Signal 存在且未禁止检索/AI 输入:* → search=yes, ai-input=yes, ai-train=no。ai-train=no 不影响被引用。
为什么重要 · Cloudflare 托管 robots.txt 会注入 Content-Signal,search=no 或 ai-input=no 会被合规爬虫尊重。
允许摘录片段权重 3 · 通过
未设置摘录限制。
为什么重要 · nosnippet / max-snippet:0 直接禁止引擎摘录你的文字。
HTTP 基础健康权重 3 · 通过
HTTP 200,HTTPS,0 次跳转,首字节 118 ms(含正文 118 ms),50107 字节,Content-Type text/html; charset=utf-8。
为什么重要 · HTTPS、200、短跳转链、合理响应时间是爬虫预算的前提。
robots.txt 放行 Googlebot权重 2 · 通过
通配分组 User-agent: * 允许抓取 /(未被 Disallow 命中,默认放行)。
为什么重要 · 喂 AI Overviews 与 Gemini。
不存在的路径返回真实 404权重 2 · 通过
随机不存在路径返回 HTTP 404。
为什么重要 · 软 404 会让爬虫以为所有路径都存在,浪费抓取预算并污染索引。
i
GPTBot(训练爬虫)策略仅展示
GPTBot(训练爬虫)目前放行。放不放行不影响 ChatGPT 搜索引用,纯属你对训练数据的态度。
i
CDN / WAF 识别仅展示
未识别到常见 CDN/WAF(server: —)。
第 2 层 推送就绪 · 等价于 GSC 的那个按钮7 / 8 通过 · 24.5 / 25
~
Google Search Console 验证痕迹权重 1 · 部分通过 (50%)
没有 google-site-verification meta。GSC 常用 DNS / GA / GTM 验证,站外无法确认,仅扣一半。
改法已生成(68 字)· 登录后查看
sitemap.xml 存在且被 robots.txt 声明权重 6 · 通过
sitemap https://madeinred.com/sitemap.xml,30 条,已在 robots.txt 声明。
为什么重要 · Bing Webmaster Tools 一键导入与 URL 提交都以 sitemap 为骨架。
sitemap 里的 URL 真实存活权重 5 · 通过
抽检 6 条 URL 全部返回 2xx(sitemap 共 30 条)。
为什么重要 · sitemap 是你交给引擎的清单;里面的死链会让 OAI-SearchBot 把抓取预算花在 404 上,引用机会直接丢掉。抽检最多 8 条。
Bing Webmaster Tools 验证痕迹权重 5 · 通过
发现 meta msvalidate.01(C7E21B97…),站点已在 Bing Webmaster Tools 验证。
为什么重要 · 注册 Bing 站长平台才能手动请求收录——这就是那个"pin"按钮。
sitemap 带 lastmod 且近期更新权重 4 · 通过
30/30 条带 lastmod(100%),最新 2026-09-03(0 天前)。
为什么重要 · lastmod 是 Bing 判断"要不要重抓"的主要信号。
canonical 自指向权重 3 · 通过
canonical 自指向:https://madeinred.com/
为什么重要 · 避免推送的 URL 与索引的 URL 不一致,权重被分散。
title 与 meta description 完备权重 2 · 通过
title「Is Cited · 被引体检 — 你的网站会被 ChatGPT 引用吗?」(37);description 76 字符。
为什么重要 · Bing 索引条目的骨架,也是 ChatGPT 引用卡片的标题来源。
RSS / Atom 订阅源可发现权重 1 · 通过
发现订阅源:https://madeinred.com/feed.xml
为什么重要 · Bing 支持订阅源提交,新文章发布可被快速发现。
i
IndexNow 即时推送仅展示
IndexNow 的 key 文件名不可预测,站外无法验证是否接入。若你的发布流程已经在推送,忽略此项。
改法已生成(200 字)· 登录后查看
多语言 hreflang权重 2 · 不适用
未声明 hreflang。单语站不适用;若你有多语言版本,请为每种语言互相声明 <link rel="alternate" hreflang="..."> 并含 x-default。
http 自动跳转 https权重 2 · 不适用
本站自扫描:Worker 无法向自己所在 zone 发起 http:// 请求,http→https 由 Cloudflare Always Use HTTPS 在边缘处理。
第 3 层 引用形态 · 推不动,只能塑形14 / 16 通过 · 27.6 / 30
图片 alt 文本权重 1 · 未通过
0/24 张图片有 alt(0%)。
改法已生成(37 字)· 登录后查看
~
服务端渲染的正文权重 6 · 部分通过 (60%)
原始 HTML 正文 2349 字符 / 约 703 词,文本占比 4.9%,H1 1 个,HTML 46 KB。 文本占比低于 5%(非内容标记过多)。
改法已生成(43 字)· 登录后查看
抽样页面的引用形态(产品 / 文章 / 分类)权重 5 · 通过
抽样 3 个页面的引用形态得分率:文章页 77%,分类页 73%,其它页 90%(平均 80%)。共同缺口:标题后紧跟 40–80 词直接结论(3/3 页);引用外部来源(3/3 页);H2 使用问句 / 对比句(2/3 页)。
为什么重要 · AI 引用发生在页面级,被引的从来不是首页。从 sitemap 抽产品页、文章页、分类页各一个,按同一套引用形态标准打分。
H2 使用问句 / 对比句权重 4 · 通过
8 个 H2/H3 中 5 个是问句/对比句(63%):「ChatGPT 搜索到底从哪里找内容?」 「为什么抓取许可的权重最高?」 「什么样的内容会被 ChatGPT 摘走?」
为什么重要 · ChatGPT 按用户问题匹配段落,问句式标题命中率最高。
标题后紧跟 40–80 词直接结论权重 4 · 通过
8 个 H2/H3 中 5 个后面紧跟 40–80 词的结论段;3 个后面没有段落,0 个段落过短,0 个段落过长。
为什么重要 · 能被整段摘走的答案块,是被引用的最小单元。
标题层级清晰权重 3 · 通过
1 个 H1、8 个 H2、共 9 个标题,层级顺序正常。
为什么重要 · 唯一 H1 + 多个 H2,层级不跳跃,是可摘录内容的骨架。
发布 / 更新日期可机读权重 3 · 通过
发布 2026-09-01,更新 2026-09-02(1 天前),来源:JSON-LD datePublished、JSON-LD dateModified。
为什么重要 · 带日期的页面更容易被选为"最新"来源;一年内更新加分。
JSON-LD 结构化数据权重 3 · 通过
1 段 JSON-LD,类型:Organization, WebSite, SearchAction, WebPage。
为什么重要 · Article / Product / Organization 等 schema 帮引擎理解页面是什么。
关于 / 联系 / 政策页可抓取权重 2 · 通过
关于、联系、政策页均可抓取:关于、联系、政策(退换 / 隐私 / 条款)。
为什么重要 · 引擎判断"这是一家真实商家"的最低门槛,也是 Agentic Commerce 要求的退换货 / 隐私政策 URL 的来源。
作者 / 发布者可机读权重 2 · 通过
meta author: MadeInRed
为什么重要 · 归属明确的内容更可信,E-E-A-T 的基础。
品牌实体(Organization + sameAs)权重 2 · 通过
Organization 实体带 2 条 sameAs。
为什么重要 · 让引擎把站点、社媒、Wikidata 等身份连成一个实体,"有其他站佐证"的起点。
可抽取的列表 / 表格权重 2 · 通过
正文区有 1 个列表(≥3 项)与 0 个表格。
为什么重要 · 对比表、步骤列表最容易被整块摘录。
引用外部来源权重 2 · 通过
正文引用了 3 个外部域名:platform.openai.com, bing.com, indexnow.org
为什么重要 · 有据可查的内容更像"可信资料",而不是营销页。
<html lang> 声明权重 1 · 通过
<html lang="zh-cn">
为什么重要 · 让引擎把页面归入正确的语言市场。
Open Graph 完整权重 1 · 通过
og:title / og:description / og:image / og:type 齐全。
为什么重要 · ChatGPT 引用卡片与分享预览的标题、描述、图片来源。
<main> / <article> 语义容器权重 1 · 通过
存在 <main>。
为什么重要 · 帮抽取器区分正文与导航噪音。
Product / Offer 结构化数据完整权重 3 · 不适用
未发现产品页(sitemap 与内链里没有 /products/ 类路径,页面也没有 Product 结构化数据)。非电商站可忽略。
加分 新兴信号 · 有则加分,无不扣分3 / 6 通过 · +4 / 5
/llms-full.txt权重 1 · 未通过
/llms-full.txt 不存在。
改法已生成(41 字)· 登录后查看
FAQPage / HowTo 结构化数据权重 1 · 未通过
没有 FAQPage / HowTo 结构化数据。
改法已生成(40 字)· 登录后查看
ETag / Last-Modified权重 0.5 · 未通过
没有 ETag / Last-Modified。
改法已生成(43 字)· 登录后查看
/llms.txt权重 2 · 通过
/llms.txt 存在(982 字符),首行:# Is Cited · 被引体检
为什么重要 · 面向 LLM 的站点导览,告诉 agent 你是谁、何时该用你。
Accept: text/markdown 内容协商权重 1.5 · 通过
Accept: text/markdown 返回 text/markdown; charset=utf-8(546 字节)。
为什么重要 · 同一 URL 给 agent 返回 Markdown,摘录零噪音。
/.well-known/api-catalog权重 0.5 · 通过
/.well-known/api-catalog 存在(application/linkset+json; charset=utf-8)。
为什么重要 · RFC 9727 机器可读的 API 目录。
AggregateRating / Review 结构化数据权重 1 · 不适用
无产品页。
最终 URL https://madeinred.com/ 标题 Is Cited · 被引体检 — 你的网站会被 ChatGPT 引用吗? lang zh-cn