4. 爬虫-从大量域名中找出符合条件的目标
自动化 SRC 之目标筛选:对海量域名批量查询爱站权重(百度≥1 谷歌≥3)是否达标,站长之家补齐备案信息,按资产类型过滤个人站的两步流程。
3. 爬虫-获取高权重网站
自动化 SRC 之高权重网站获取:以爱站百度/谷歌权重为收录依据,从网站排行榜与爱企查企业信息两条途径批量抓取高权重站点的爬虫实现。
2. 爬虫-根据域名获取企业备案所有域名
自动化 SRC 之备案域名扩展:用站长之家 SEO 综合查询获取域名备案号与企业名称,再按备案号反查同主体全部注册域名的三步爬取实现。
爬虫-补天注册厂商域名获取
自动化 SRC 系列开篇:补天漏洞平台的收录标准与注册厂商列表获取思路,注册厂商不限权重、证明归属即可收录,为后续批量收集域名资产打基础。
26-Cookie反爬虫4-瑞数5代
瑞数5代逆向:以 5 开头 cookie 与 412 响应码特征,与四代结构差异,银河证券完整补环境案例——script/meta/localStorage 全套环境,附 fiddler hook 与联合调试。
文本混淆专题
字体反爬专题:@font-face 自定义字体的混淆原理与 font 标记识别,fontTools 解析 woff/ttf 的 cmap 映射与 glyf 字形坐标,实习僧薪酬、人人车标题两个还原案例。
XSS靶场练习
XSS 靶场练习笔记:PTE 靶场 CMS 题目,存储型 XSS 的验证、管理员访问触发弹窗、盗取 cookie 拿 flag 的解题记录,双浏览器双身份演示。
23-RPC技术专题
RPC 逆向技术专题:websocket 协议原理与手写转发脚本,把浏览器加密函数暴露成服务的思路,Sekiro-RPC 的 group/action 概念与注入模板,案例覆盖响应解密与同花顺 cookie,附并发限制说明。
爬虫项目部署
爬虫项目部署实战:crontab 定时任务与 scp 上传,scrapyd 部署 Scrapy 全流程(配置与 API 调试),Gerapy 图形化管理,websocket/webhook 实时采集方案及 pythonw 后台运行。
分布式爬虫及Scrapy-Redis
分布式爬虫与 Scrapy-Redis 详解:调度器、去重过滤器、管道、RedisSpider 四大组件原理与核心配置,聚美优品实战演示 RedisSpider 改写、mongo 入库与 lpush 分发任务。
33-反爬虫手段及各种现象的处理
反爬虫手段全景与应对手册:Headers/行为频率等基础手段与速率限制绕过,浏览器环境检测八大类(webdriver、原型链、Canvas/WebGL 指纹)破解,TLS 指纹的 tls-client 过法及 webpack/jsvmp 对抗索引。
Python爬虫练习(JS逆向)
JS 逆向练习项目清单与案例资源:待攻克目标(拼多多 anti-content 等)的参考资料链接,附 Scrape Center 爬虫案例库与 Python 爬虫100例等练习资源索引。

















