AI&逆向知识热点日报 — 2026-09-10

聚焦 AI 在 JS 逆向、安卓逆向、验证码、防爬、风控和爬虫领域的应用
数据采集周期:2026-09-09 ~ 2026-09-10(本期主题词是”模型层的攻防”:反爬与风控开始把”模型的输出/参数”当作战场——要么是别家模型的输出,要么是你自己模型的输出;两条头条分别从”采集别人”与”被采集”两端展开)


本期导读

本期第一条主线,是**”反爬/风控”第一次以国家级网络安全公告的形式登场**:美国 NSA、CISA、FBI 三机构联合发布公告,指控 DeepSeek、月之暗面、阿里巴巴、MiniMax、阶跃星辰、Z.AI 六家中国 AI 公司自 2024 年底起对 Claude/GPT/Gemini/Grok 等美前沿模型实施”工业规模的知识蒸馏”(即通过海量 API 请求把大模型的”能力”蒸馏进自家小模型),并给出了一整套”如何检测与削弱蒸馏”的防御建议——这套建议里藏着给爬虫/风控工程师的”模型级反爬”方法清单(异常行为监控、订阅使用比、新账号峰值、响应微扰=输出毒化、跨机构情报共享)。中国商务部已于 9/9 深夜回应:指控”于事无凭、于法无据”,称蒸馏是行业通行做法、美方是”双重标准”。无论立场如何,“模型的输出被当成资源来规模化采集”这件事,已经从灰色地带正式进入地缘与技术对抗的中心——这正是过去一年我们在 Web 爬虫身上看到的故事,在模型 API 层面完整重演了一遍。

本期第二条主线,是 OpenAI 用约 1 万个并发智能体、88 小时攻克数学界 90 年未解的千禧年难题 Navier-Stokes——但同时被 NYU 数学家公开指控”截胡”其未公开研究路线,引爆学术伦理争议。这条新闻对逆向/爬虫读者有双重价值:一是**”万 agent 蜂群”的任务编排结构**(问题变体并行→小组探索→Codex 汇总交叉授粉→失败分支当库存→Lean 形式化验证闭环)本身就是大规模自动化的最佳教材;二是它再次提出那个我们熟悉的灵魂问题——AI 的”学习素材”边界到底在哪(这次是数学家的 Codex 对话记录与未公开手稿,上次是 vec2vec 里的嵌入向量、Ask HN 里的钢琴卷编码)。

本期第三条主线是成本与规模的剪刀差:DeepSeek V4.1 Flash 今日(9/10)正式上线,性能全面超越 V4 Pro 的同时大幅降价,且所有指向 V4 Pro 的 API 请求被自动路由到 V4.1 Flash(引发社区对”静默降级”的讨论)——做采集与逆向的团队要重新评估缓存命中定价与模型行为漂移;另一边 OpenAI 因 Astra 需求”前所未有”甚至可能暂停新 Pro 订阅,并把 Astra 全面推送给 Plus/Pro/Business/Enterprise 全部付费用户——能”操控电脑的模型”正式进入大众订阅,Cloudflare 9/15(剩 5 天)对 Agent 流量的默认拦截,正好卡在这个时间点上。

本期三大主线:① “蒸馏”从技术名词变成国家级攻防议题(模型层反爬方法论首次官方化);② 万 agent 蜂群攻克千禧难题 + AI 科研伦理争议(编排范式 + 机器可验证证明);③ 模型 API 的规模经济与自动路由争议(DeepSeek 降价路由 / Astra 全面商用)。另有:Cloudflare 9/15 倒计时收口、工具雷达(camofox 续涨破万后加速至 10,815⭐)等。


1️⃣ 美 NSA/CISA/FBI 联合公告:指控六家中国 AI 公司”工业规模蒸馏”美前沿模型——反爬/风控第一次以”国家级公告”现身,官方给出的竟是给爬虫工程师的”模型级反爬方法论”(本期头条)

  • 事件:9/8,美国国家安全局(NSA)、网络安全与基础设施安全局(CISA)、联邦调查局(FBI)联合发布网络安全公告(编号 AA26-251A),指控 DeepSeek(深度求索)、Moonshot AI(月之暗面)、阿里巴巴、MiniMax、StepFun(阶跃星辰)、Z.AI 六家中国 AI 公司,自 2024 年底起对美前沿模型实施”工业规模的知识蒸馏(industrial-scale knowledge distillation)“,并称该行为”构成了中国 AI 发展战略的核心(the core, not merely a supplement)”。核心指控点:
    • “蒸馏”是什么(初级工程师版):用一个大模型(教师)的输出作为训练数据,去训练/优化一个更小的模型(学生)。大模型通过 API 回答海量精心构造的问题,学生的参数被调成”尽量复现教师的回答”。合法用法是压缩自家模型,但把它用在别家付费 API 上、绕过条款去抄能力,就成了”借腹生子”式的数据采集——本质上和”爬虫抓页面拿去训练”是同一件事,只是采集对象从网页变成了模型的输出;
    • 美方声称的具体时间线:DeepSeek 自 2024 年底起蒸馏 GPT-4/4o/5、Claude 3.7/Sonnet 4/4.5/Opus 4.1、Gemini 2.5、Grok 4 等训练 R1/V3(并暗示其公开的”560 万美元训练成本”没算上蒸馏获得的”免费数据”);月之暗面自 2025 年中起大规模提取 Claude Fable 5 数据训练 Kimi-K3、GPT-4o 数据训练 Kimi-K2,覆盖 agentic 推理、工具调用、coding、computer use、CV 等领域;阿里巴巴用 Claude-4/Opus/Sonnet 与 GPT-5 蒸馏 Qwen 系列;MiniMax 蒸馏多模型 CoT/RL/SFT 能力训练 M2,且被指对 Claude Code 注入提示、伪装成”MiniMax 自家产品”来骗过它;StepFun 用 GPT-5.x/Claude Opus 4.x 蒸馏 Step 4;Z.AI 到 2026 年中已蒸馏”数十亿 token”的 GPT-5.5 与 Claude Opus 4.8;
    • 手法与灰色通道:美方称这些请求经由原生 API、海外云、第三方聚合器(自动混淆用户元数据),并通过一种叫 “transfer stations(转运站)”的灰色市场——把美方模型的访问权限以官方价的一个零头转售,既能绕过地理封锁、又能逃避风控与溯源。⚠️ 爬虫从业者看到这里应该会心一笑:这就是”代理池 + 账号池 + API 转售”在模型层的翻版,连名字都似曾相识;
    • 美方给出的”防御建议”(对风控读者是干货):① 检测与缓解——监控异常 prompt/账号/网络/行为,盯订阅用量比(subscription-to-usage ratio)、新账号的即时峰值用量、企业级吞吐模式;② 定向响应扰动——对疑似蒸馏的请求**”微妙地改变回答”(subtly alter responses)以降低其训练收益——翻译过来就是给可疑采集者喂”输出毒化”数据**;③ 跨机构情报共享——在多家模型商/云平台/API 聚合器之间关联活动以发现分布式蒸馏战役;
    • 中方回应(平衡视角):9/9 深夜,中国商务部新闻发言人答记者问称,美方所谓”工业规模蒸馏”指控”于事无凭,于法无据“,是把”蒸馏这一业内正常的技术和商业问题政治化、工具化”,是”典型双重标准”;并指出美企自身研发报告也披露大量蒸馏中国模型(如开源模型被广泛使用),中方开源模型一直向全球开放,坚决反对美方以打击蒸馏为名实施遏压,否则”必将坚决采取措施予以反制”。⚠️ 本条目为对美方公告的事实性转述 + 中方回应,被点名企业均未对公告细节作出逐条公开回应,相关指控尚无司法定论。
  • 值得关注的原因:⭐⭐⭐⭐⭐ ① 对做爬虫/采集的读者:这是”把模型的输出当采集目标”第一次被官方定性为国家级威胁——过去一年你熟悉的剧本(UA 信任崩塌、住宅代理、账号池、内容毒化、跨平台关联)原封不动发生在模型 API 上,而且比 Web 更快、更贵、更政治化;它意味着模型层条款(ToS)与”蒸馏检测”正在成为硬合规——只要你的业务涉及”用 A 模型输出喂 B 模型”(哪怕只是 RAG 微调的数据回流),就要开始自查数据来源条款与用量模式,别等被发律师函/封号才意识到;② 对做风控/反爬的读者:官方第一次给了一整套”模型层反爬”的检测清单——订阅用量比、新账号即时峰值、企业级吞吐异动,这套信号和你网页风控里的”注册频率、登录频次、IP 聚合度”完全同构,可以直接平移成”大模型 API 风控”的特征工程;而”对疑似蒸馏做微妙响应扰动”就是输出层面的主动防御(毒化/水印/诱饵)——如果你正在做反爬对抗,这条思路同样适用于”识别到爬虫后返回掺假数据”的场景;③ 对做逆向的读者:’transfer station/转运站’这条灰色链路值得研究——它说明模型的访问凭证(API key、订阅账号)已经被证券化转售,逆向的目标正从”网页参数”扩展到”模型服务的计量与鉴权体系”(怎么按用量计费、怎么限流、缓存命中怎么定价,本期第 3 条 DeepSeek 路由事件是同一主题的另一半);④ 对初级工程师理解行业:把这条与 8/31 的 GreyNoise(824 个地址伪造 AI 爬虫 UA 扫 .env)、9/8 的 kernel.org 账单(爬虫 CPU 成本超过合法流量)连起来读——“谁的算力/数据/内容被白嫖”已经从技术抱怨升级为地缘博弈筹码,做采集行业要习惯在更高的合规水位线上生存;⑤ 提醒:本事件发酵才一天,后续(企业回应、可能的制裁/限制、OpenAI/Anthropic 是否公开证据)值得按天跟进,做 API 相关业务的朋友建议订阅跟进。
  • 来源:CISA 官网:三机构联合公告全文(AA26-251A,9/8) | Unite.AI:深度解读(含各家具体蒸馏对象/时间线) | The Register:US claims Chinese AI companies’ core AI strategy is distilling American models(9/9) | SecurityDone:US Warns Chinese AI Firms Are Illicitly Distilling Models(9/8) | IT之家:商务部回应美方所谓 AI 蒸馏指控(9/9 原文全文) | 中国日报英文版:China rejects US allegations of AI distillation(9/9) | 背景:AIHOT 索引:NSA/FBI/CISA 指控六家中国 AI 公司大规模提取美模型知识(9/9)

2️⃣ OpenAI 用约 1 万个并发智能体、88 小时攻克千禧年难题 Navier-Stokes,同步引爆学术”截胡”争议——“万 agent 蜂群编排”与”Lean 机器可验证证明”的活教材(本期次头条)

  • 事件:9/89/9,OpenAI 宣布其一个未公开的内部模型(据称能力”显著强于 GPT-6 Astra”),以约 1 万个并发 AI 智能体协作、耗时约 88 小时,给出了 7 大千禧年难题之一——Navier-Stokes 方程存在性与光滑性问题的解答(构造出一个”从光滑静止状态出发、有限时间内速度趋于无穷但总动能保持有限”的奇点),并同步公开 **165166 页论文 + Lean 形式化验证代码**,宣布放弃申领 100 万美元奖金。关键细节:
    • 解题过程是一套教科书级的”蜂群编排”:9/1 启动(OpenAI 称起因是”听到有传言称两大千禧难题被解出”);不同小组的 agent 拿到不同版本的问题陈述(指向”证明光滑”的 A/B 版与指向”构造反例”的 C/D 版分别给不同组);中途约 100 个 agent 花 50 小时先解决了无外力 Euler 方程的正则性反证(把相关难题先打穿);随后用 Codex 汇总各组最有价值的中间结论”交叉授粉”(cross-pollinate);9/5 首批 agent 启动约 88 小时后拿到 Navier-Stokes 解;再用 GPT-6 Astra 花 17 小时做 Lean 形式化验证;全程 agent 间交换 490 万条消息、消耗约 3000 亿输出 token(其中 Navier-Stokes 相关约 270 万条消息 / 1300 亿 token),按公开费率粗算成本达数百万美元级(媒体换算口径不一,Noam Brown 称”成本会快速下降”);
    • 学术争议同步引爆(对逆向读者的伦理镜鉴):NYU 数学教授 Tristan Buckmaster 指控:他与 Anthropic 研究员 Levent Alpöge 已沿同一条冷门路线(”通过平滑力构造奇点”的 Fefferman 选项 c/d)研究该问题一年、大量使用 OpenAI Codex,并怀疑其未公开的 Codex 交互数据可能被用于训练/指导 OpenAI 的研究方向;Buckmaster 还称 OpenAI 曾提出争议性的署名妥协方案、威胁”不要毁掉自己的职业生涯”。OpenAI 与研究员 Bubeck 否认,称 9/1 只听到传言、未以任何方式接触对方未公开成果、未为解题访问任何特定用户数据,但承认”不能排除用户产品的去标识化数据匿名改善了模型”;OpenAI 同时承认 Buckmaster/Alpöge 团队在”带外力 Euler 方程”上领先并致贺(双方证明的对象其实不同:forced vs unforced Euler);菲尔兹奖得主陶哲轩评论称”AI 跨界抢跑,好问题正在成为稀缺资源“。
  • 值得关注的原因:⭐⭐⭐⭐⭐ ① 对做爬虫/自动化的读者:这是”大规模 agent 编排”迄今最完整的公开案例——注意它的工程结构:把问题陈述做变体化分发(防同质化收敛)→ 小组并行探索 → 用另一个 agent(Codex)做跨组知识汇总再回灌(防信息孤岛)→ 把已打穿的相邻问题作为”跳板”喂给主攻组 → 失败/中间分支当库存 → 最后用 Lean 做机器可验证的收口。这套”分治 + 交叉授粉 + 可验证闭环”和你做分布式爬虫/验证码对抗时的任务分片、结果校验、失败重试是同构的,值得逐条抄进自己的 agent 编排设计;② 对做逆向的读者:’机器可验证证明’(Lean)正在成为确定性的代名词——OpenAI 特意让 GPT-6 Astra 把答案形式化为 Lean 证明以便任何人机械复核,这和上期 reverify(模型提议 + 确定性工具裁决)以及 Portal 通关的”动作后状态快照校验”是同一个哲学:AI 的输出必须能回到可执行的验证闭环里才可信——做 AI 辅助逆向的团队,把这条当作设计原则(让 LLM 每一步分析都能落回反汇编/运行时证据),比追求”一次答对”重要得多;③ 学术争议给我们的伦理镜鉴:Buckmaster 的质疑核心——“我在你们产品里留下的对话与手稿,会不会被你们拿去训练,然后用在我的对手身上?“——这和爬虫圈多年的版权焦虑(vec2vec 嵌入向量、Ask HN Fable 钢琴卷、AI 训练数据诉讼)是同一条线的两端:当你把内容/代码/对话喂给任何 SaaS 模型时,边界在哪里?做逆向/采集的团队在选择模型服务商做敏感分析时,建议把”数据是否用于训练、是否被审计、企业版零保留”写进选型 checklist(本次 OpenAI 恰好同步宣布 Astra 为符合条件的 API 客户提供零数据保留选项);④ 成本账的启示:1300 亿 token / 数百万美元买一道数学证明,说明**”用算力换突破”在大规模 agent 场景下是真实可行的路线**,也意味着做长程 agent 任务时 token 计量与成本护栏(本期第 3 条 DeepSeek 缓存命中定价、第 4 条 Astra 额度规则)会成为工程必修;⑤ 跟进提示:证明是否通过克雷数学研究所与数学共同体评审尚无定论(Clay 所长已回应”需时间评估”),OpenAI 也明确”不申领奖金、定位为 AI 进步快照”——把它当”agent 能力的里程碑演示”而非”数学定理终审”来读更合适。
  • 来源:OpenAI 官网:On the Navier–Stokes Millennium Prize Problem(9/8 官方全文,含编排细节与 4.9M 消息/300B token 数据) | 澎湃:用约 1 万个智能体 88 小时解决 90 年难题,放弃申领 100 万奖金(9/9) | 腾讯新闻(潮新闻):88 小时一万个智能体攻克千禧难题(9/9) | TechWeb:OpenAI 发布 165 页论文与 Lean 验证代码(9/9) | Interesting Engineering:10,000 OpenAI agents crack Navier-Stokes in 88 hours(9/8) | 环球网:NYU 教授指控 OpenAI”截胡”(9/9 中文) | 腾讯新闻:OpenAI 承认对方领先(9/9) | TechCrunch:OpenAI fought dirty on career-making math problem, says NYU mathematician(9/8) | Simon Willison:On Navier-Stokes(9/8 独立视角) | 背景:OpenAI X 官方公告 | X:Noam Brown(成本会快速下降)

3️⃣ DeepSeek V4.1 Flash 今日正式上线:性能全面超越 V4 Pro + 大降价 + “V4 Pro 请求自动路由至 Flash”引发静默降级争议——模型 API 的”价格体系与路由行为”对采集/逆向团队的直接影响

  • 事件:9/9 公告、北京时间 9/10(今天)正式发布 DeepSeek V4.1 Flash,官方称其在性能、响应速度、计算费用、总处理用时等核心指标上全面超越 V4 Pro;新模型采用全新架构、原生支持多模态,社区内测反馈生成速度约 284 token/s(对比 V4 约 97 token/s)。同步还有三件对 API 使用者很重要的事:
    • 9/10 12:00 起 Flash 系列大幅降价:以空闲时段为例,输入(缓存命中)0.02 元/百万 token(较旧价降幅约 60%)、输入(缓存未命中)1 元(降约 33%)、输出 4 元(降约 11%);高峰时段(周一至五 9:00-12:00/14:00-18:00)价格为空闲两倍。缓存命中与未命中差 50 倍——对高频重复调用(批量采集、内容处理、常驻 agent)是显著利好,前提是你把请求设计成能命中缓存;
    • 自动路由:官方宣布在 V4.1 Flash 上线后、V4.1 Pro 问世前,所有指向 V4 Pro 的 API 请求将被自动路由至 V4.1 Flash,并按 Flash 单价计费——用户无需改代码、成本反而下降,被官方称为”升级降价同步”;
    • 争议(社区风向):KOL karminski 公开质疑该路由政策——把”用户指定调用的模型”静默换成另一个模型(即便更强更便宜),本质是服务端替用户做了模型选择;对依赖固定模型行为做复现/评测/逆向的团队来说,模型被”悄悄换掉”意味着输出特征、能力边界、失败模式都可能漂移,且没有 opt-out 开关的自动路由缺少透明度。
  • 值得关注的原因:⭐⭐⭐⭐ ① 对做爬虫/采集与批量调用的读者:这是”成本结构”的一次重定价——缓存命中价格暴降 60%,意味着凡是能复用 prompt 前缀的批量任务(网页结构化提取模板、验证码判别模板、商品字段抽取)都值得做”系统提示词固化 + 前缀复用”设计去蹭缓存命中价;把 DeepSeek 这类便宜模型当作”数据清洗/中间层”的路子会更划算;② 对做逆向/代理类工具的读者:’模型自动路由’是一个需要警惕的新现象——当你把”调用某模型”写进生产管线(比如签名算法逆向后用 LLM 做参数还原、或把解密后的流量丢给模型做语义分析),路由漂移会让结果在无预警的情况下变化;建议在代码里显式锁定 model 名 + 记录响应来源 + 对行为差异做监控告警,而不是信任”名字不变就不变”;③ 对初级工程师理解 API 经济:DeepSeek 这次”降价 + 换性能”的激进策略,配合它同步筹备科创板 IPO(9/9 传出聘请中信证券的消息)的资本动作,说明价格战 + 规模抢量正在成为国产模型的主叙事——做 Agent/采集产品的人现在有很强的议价空间,但也要预留”模型/价格随时变”的架构弹性(配置化、可替换、监控告警);④ 对验证码/多模态场景:V4.1 Flash 原生多模态 + 2.9× 速度,值得在 OCR/滑块/点选类判别任务上重新跑一轮基准(视觉 token 计费与缓存命中规则记得看文档)。
  • 来源:腾讯新闻(科创板日报):DeepSeek 双线推进——V4.1 Flash 明日发布、同步筹备科创板 IPO(9/9) | 腾讯新闻(上海证券报):DeepSeek 新模型将正式上线,Flash 定价细则(9/9) | Hacker News(buzzing.cc):DeepSeek 将于 9/10 发布 V4.1 Flash(9/9) | AIHOT 索引:karminski 质疑 V4 Pro 请求路由至 V4.1 Flash(9/9) | 背景:DeepSeek 开放平台公告(V4.1 Flash 发布时间与调价通知) | 环球网科技:V4.1 Flash 发布消息(9/9)

4️⃣ OpenAI 把 Astra 全面推送给 Plus/Pro/Business/Enterprise 全部付费用户 + 需求”前所未有”或暂停新 Pro 订阅——能”操控电脑的模型”正式进入大众订阅,正好撞上 Cloudflare 9/15 的 Agent 默认拦截(剩 5 天)

  • 事件:9/9,OpenAI 官方 X 宣布 GPT-6 Astra 已向 ChatGPT Plus、Pro、Business、Enterprise 全部付费档位推送(此前 9/3 发布时是分批/限量开放),API、Azure、AWS Bedrock 同步可用;企业工作区需管理员手动启用(默认关闭)。同日,OpenAI Codex 负责人 Tibo Sottiaux 在 X 上称对 Astra 的需求”前所未有“,公司已调动全部资源保供给,若需求继续上涨可能临时暂停新的 Pro 订阅,现有用户额度优先保障;此前 OpenAI 曾承诺”每有一天无法正常使用 Astra 就重置一天额度”,并对长尾使用做优化使额度消耗降至原来的 1/4~1/3。
  • 值得关注的原因:⭐⭐⭐⭐ ① 对做风控/反爬的读者:这是”计算机使用型 agent 流量”开始主流化的标志——Astra(能自主操控浏览器/桌面的旗舰模型)进入全部付费档位后,真实用户的浏览器会话里会混入越来越多的”agent 替人类操作”,传统的”真人行为特征”假设(鼠标轨迹、阅读时长、操作节律)会被进一步稀释;结合 Cloudflare 9/15(本周日,剩 5 天) 新规——对新域名/免费档带广告页面默认拦截 Training 与 Agent 类爬虫、混合用途爬虫一刀切全拦——“agent 流量”正在从安全团队的论文议题变成线上默认策略的一部分,做采集与反爬的团队这周务必按上期清单完成策略核查;② 对做采集/自动化的读者:Astra 全面商用意味着”用 agent 替你做端到端业务”(登录→查询→填表→提交)的用户量会指数级上升,服务端无法再靠 UA/行为单一信号区分人、agent、脚本——如果你做的是电商/票务/社交类网站的风控,本周起把”允许哪些 agent 进、以什么身份进、进来能干什么”(Cloudflare Web Bot Auth 的 Ed25519 机器身份路线)提上评估表;③ 对关注 AI 成本的读者:需求空前 + 可能暂停订阅 + 额度重置承诺,说明顶尖 agent 的算力供给仍是硬约束——做重度依赖 API 的业务要有”额度耗尽/暂停订阅”的应急预案(多供应商、本地模型兜底);④ 衔接上期:Astra 从”48 关验证码通关的能力演示”到”全量付费用户可用”,能力与规模两侧都在加速,我们此前反复提示的”防线从认知题迁向服务端身份/行为层”的判断正在被验证。
  • 来源:X:OpenAI 官方(Astra 全面推送公告,9/9) | IT之家:GPT-6 Astra 需求空前,必要时暂停 Pro 新增订阅(9/9) | 网易/至顶科技:OpenAI 发布 GPT-6 Astra,首个跨越关键网络安全阈值的模型(含各档位与定价) | AIHOT 索引:Sam Altman 回应 Astra 需求空前(9/9) | 关联:Cloudflare:Block AI Bots 文档(9/15 新默认值细则)

5️⃣ 工具雷达:camofox-browser 破万后加速(10,298→10,815⭐),reverify/js-reverse-mcp/jshookmcp 稳爬,新面孔 kunglao-agent 出现——“隐身浏览器 + 确定性裁决”叙事继续领跑

  • 事件:GitHub 检索(9/9~9/10)+ 历史去重后,本期工具动态如下:
    • jo-inc/camofox-browser(10,298→10,815⭐,9/9 仍在更新):C++ 级反指纹浏览器服务器(”bypass Cloudflare, bot detection”),破万后一周再涨 517⭐,增速较上期(+850/周)略有回落但仍在高位——“agent 原生隐身浏览器”赛道的社区热度未见顶;配套 redf0x1/camofox-mcp(111⭐,持平);
    • 2akouwu/reverify(1,034→1,063⭐,9/7 活跃):抗幻觉逆向 MCP(模型提议 + 确定性工具裁决),续涨 29⭐;”AI 输出必须落回可验证闭环”的方法论本周被 OpenAI Navier-Stokes 的 Lean 形式化验证再次印证(见本期第 2 条),两者哲学同源值得对照阅读;
    • zhizhuodemao/js-reverse-mcp(2,708→2,710⭐)/ vmoranv/jshookmcp(1,977→1,981⭐):中文 JS 逆向 MCP 双雄平稳缓爬;jshookmcp 9/8 仍有提交;
    • BetterWright/betterwright(249→252⭐)/ cua-lite/cua-lite(80→82⭐):持久化策略守卫浏览器与 Computer Use 开源平台续涨(衔接 9/8~9/9 工具雷达);cozyblaze/portal-agent(Astra 通关 Portal 的 setup 仓库)已升至 77⭐(9/7 建仓后快速爬升,9/7 仍有提交),说明”复制 SOTA agent 实验配置”的需求真实存在;
    • 新面孔(生态观察):amd2g2zz/kunglao-agent(21⭐,9/9 活跃)——自称”reverse-engineering expert agent:自主规划分析路径、逐步推导结论”的逆向专家 agent,属于”让 LLM 全流程自主逆向”方向的又一位新玩家(与 ghastly/ghostwire、reverify 等构成同一谱系,注意其”规划-推导”是否带可验证闭环,带闭环的才值得跟);8eeth0ven/bfs-clicker(11⭐,Playwright 自动点击 Web 控制台爬虫 + Android App 逆向黑盒测试套件,中文项目,frida+adb 联动)——“Web 点击流爬虫 + 安卓自动化”一体化套件,偏黑盒 UI 遍历方向;Ashibalt/minusOne-mcp-reverse(2⭐,宣称 77 个语义化操作覆盖静态 triage/脱壳)与一堆 hermes-/qwen-agent-captcha-solver(0~1⭐,多为”fixture-first 有界授权验证码求解教程”),星数都低,仅作”验证码求解 MCP 化 + 合规化教程”的风向记录。
  • 值得关注的原因:⭐⭐⭐ ① 主线未变且持续自我强化:camofox(让 agent 隐身)与 reverify(让 AI 可信)仍是星数增长最快的两个方向,恰好对应本期两条头条的两端——NSA/CISA/FBI 教防守方”检测与毒化”,而 camofox 这类工具在进攻方一侧继续膨胀;在 Cloudflare 9/15 与”国家级蒸馏公告”双重背景下,反指纹/反检测工具的合规边界要格外注意(仅限授权测试与合规用途);② kunglao-agent 这类”逆向专家 agent”值得长期观察:当仓库从”MCP 工具封装”走向”自主规划分析路径的 agent”,说明 LLM 辅助逆向正在从”搭子”进化成”半自主分析师”——评估它时先看两件事:是否带可验证闭环(每一步能落回运行时证据)、失败时是否诚实上报而不是编造结论(这正是 reverify 解决的痛点);③ 小星工具照例仅供生态观察,动手前看 README 更新频率、license 与合规声明。
  • 来源:GitHub:jo-inc/camofox-browser(10,815⭐) | GitHub:2akouwu/reverify(1,063⭐) | GitHub:zhizhuodemao/js-reverse-mcp(2,710⭐) | GitHub:vmoranv/jshookmcp(1,981⭐) | GitHub:cozyblaze/portal-agent(77⭐) | GitHub:cua-lite/cua-lite(82⭐) | GitHub:amd2g2zz/kunglao-agent(21⭐,reverse-engineering expert agent) | GitHub:8eeth0ven/bfs-clicker(11⭐) | GitHub:Ashibalt/minusOne-mcp-reverse(2⭐)

其他值得一瞥


上期(2026-09-09)条目追踪

上期条目 状态 本期进展
GPT-6 Astra 通关《我不是机器人》48 关验证码(”认知题防线迁走”) 能力→商用 本期第 4 条:Astra 已全面推送 Plus/Pro/Business/Enterprise 全部付费档位、需求空前可能暂停新 Pro——“能过关的 agent”正式进入大众订阅;配合 Cloudflare 9/15(剩 5 天)默认拦截 Agent 类流量,防线迁移判断被两侧同时验证
Calif WeWorm(AI 两天找洞/一周造蠕虫,微信 VoIP 零点击) 稳定 无新增独立进展(腾讯 8 月已双端修复、8/28 服务端缓解);做移动安全/逆向的读者可继续按 9/9 头条的”AI 辅助漏洞挖掘 SOP”做技能储备
git.kernel.org 爬虫账单(14 核渲染 commit HTML) 升级为国家级议题 本期头条(NSA/CISA/FBI 蒸馏公告)把”爬虫成本/数据被白嫖”从服务器账单上升到地缘博弈——kernel.org 的账单与模型蒸馏的指控是同一叙事的两层;Cloudflare 9/15 剩 5 天,未配置策略的团队请本周末前完成
UC Berkeley CUA-Lite(Computer Use 统一平台) 稳定 80→82⭐(9/8 仍活跃);”环境即数据 + 一键评测”路线与本期 OpenAI 万 agent(隔离环境内读缓存/跑代码)的工程形态相互印证
工具雷达(camofox/reverify/js-reverse-mcp 等) 星数更新 camofox-browser 10,298→10,815⭐、reverify 1,034→1,063⭐、js-reverse-mcp 2,708→2,710⭐、jshookmcp 1,977→1,981⭐、BetterWright 249→252⭐、camofox-mcp 111⭐、portal-agent→77⭐;新增 kunglao-agent(21⭐)观察
MiniCPM5-2B 全家桶开源(UltraData/Meshy/JustRL II) 稳定 无重大新进展;”端侧可私有化 agent”路线继续被 FrogNano(4B 纯 RL)等新工作补充
上期遗留待挖 — 新增长线:“模型输出即资源”的国家级博弈(蒸馏公告 + OpenAI 数据伦理争议 + 模型自动路由);Cloudflare 9/15 本周日落地,下期将第一时间复盘其对代理/采集生态的实际影响;DeepSeek V4.1 Flash 今日上线后的路由争议与实测(缓存命中定价、284 token/s 速度)建议下周实际跑一轮

数据来源:AIHOT 精选/全部条目(aihot.virxact.com)、CISA/The Register/Unite.AI/SecurityDone、OpenAI 官方、澎湃/腾讯新闻/IT之家/科创板日报、中国日报、levels.io、GitHub 官方 API 等。GitHub 星数为 9/10 00:00(UTC+8)快照,与上期数值对比;标注”AIHOT 索引”的链接为聚合索引页,不含独立原文 URL(原文链接见同条其他来源)。被点名企业均未逐条回应美方蒸馏指控,相关指控尚无司法定论,本文仅作技术与行业事实转述。