Scrapy进阶用法学习
发表于|更新于|PythonPython爬虫和JS逆向
文章作者: 晚上十一点睡觉
版权声明: 本博客所有文章除特别声明外,均采用 CC BY-NC-SA 4.0 许可协议。转载请注明来源 晚上十一点睡觉のBlog!
相关推荐

2023-04-13
24-Websocket爬虫专题
Websocket 爬虫专题:ws 协议与 HTTP 差异、握手流程与适用场景,双端代码写法,抖音直播间弹幕完整实战——signature 生成、ttwid 提取、protobuf 消息解析与本地转发解密。

2023-01-15
03-数据提取方法
爬虫数据提取总览:结构化与非结构化数据的分类及对应解析方式,静态与动态加载数据的判断方法,用开发者工具 Fetch/XHR 定位数据接口的技巧,及 xpath、bs4、正则三种提取方式的性能对比与选型建议。

2023-06-08
03. 数据提取方法-xpath
xpath 数据提取详解:路径表达式与节点定位语法、position/last() 索引、contains 等常用函数,lxml 解析与 tostring 排错,「先分组再提取」实战模式,附豆瓣 Top250 练习。

2024-09-10
26-Cookie反爬虫2-akamai逆向
Akamai _abck 逆向入门:CDN 风控特征识别(_abck、sensor_data 与 GET/POST 双请求),DHL 案例 sensor_data 五次赋值生成链路,AST 解混淆后硬扣加密数组的思路。

2023-04-11
浏览器中js代码调试技巧和逆向思路分析
JS 逆向定位与思路方法论:启动器、关键词搜索、断点、hook、堆栈分析等九种定位加密位置的手段及优先级,判断参数是否加密的八项依据(长度、格式、变化规律、写死判断),逆向七步流程与响应解密的页面瞬间定位技巧。

2023-03-25
26-Cookie反爬虫
Cookie 反爬虫逆向三种类型:后端 set-cookie 直接携带、前端 JS 二次加密、环境自动生成,案例覆盖 CSRF token、阿里系 acw_sc__v2 的 unsbox+hexXor、加速乐三次请求,附厂商特征速查。
评论
公告
stay passionate and never say die





