采集与互认说明
我们对你站点做什么、怎么做、如何喊停,写在这里,一件都不藏着。
一、我们收录什么
只收录三类信息:博客(名称/网址/程序/一句话简介)、RSS 元数据(标题、摘要、原文链接、发布时间)、来自本站的点击(用于流量回执)。不抓正文、不镜像全文、不缓存图片、不采集评论、不跟踪读者。
二、抓取身份与频率
- 探测 UA:
YeCha-LinksProbe/1.5 (+https://yecha.org) - 体检约每 6 小时 1 次;RSS 聚合约每 1 小时 1 次;单次 ≤10 秒、≤512KB,尊重 robots.txt。
三、如何停止抓取 / 移除
对我们返回 403 Forbidden(或屏蔽上述 UA)持续 3–7 天,我们会移除;也可直接来信申请退出——会先标注、不会悄悄消失。
四、互认(徽标与来源)
已收录站点在各自“流量回执”页领取徽标。我们所有出站链接统一携带 via=yecha.org,任何收到流量的站点都能识别“谁把我带了过去” —— 开放、无中心依赖,欢迎其它收录圈采用(参数规范随插件文档发布)。
五、AI 时代的姿态
这里只收录“人在写”的内容。若更新开始明显由机器批量生成,我们会先沟通再决定是否移除。