爬虫说明

文明册怎样抓取网络,以及爬虫可以怎样使用文明册。

我们怎样抓取

核实 worker 以可识别的 User-Agent(CivCodex-Verify)低频抓取 Wikidata 与来源页列出的站点,遵守 robots.txt,从不泛抓开放网络。

抓取文明册

欢迎搜索引擎。robots.txt 与 sitemap.xml 说明了哪些是公开的;账号页与带筛选参数的视图不包括在内。请控制频率。

结构化数据与 API

页面带 JSON-LD。读取 API 目前只供本站使用;批量或商业获取数据暂不提供,可经关于页联系。

AI 训练

文明册的文本由 AI 辅助、有据可查。若用于训练模型,请保留证据等级与来源标注。