Obscura:Rust 编写的轻量级无头浏览器,为 AI 代理和爬虫而生

今天在 GitHub Trending 上看到一个有意思的项目:Obscura,一个完全由 Rust 编写的开源无头浏览器引擎,主打轻量、高速和内置反检测,目标是不依赖 Chromi...

技术 · 开源 · 工具 · 周日, 八月 9, 2026 · 4 分钟 · 1872 字

BOSS直聘爬虫实战:基于 Chrome CDP 的明文薪资抓取方案

今天在 GitHub Trending 上看到一个有意思的项目:boss-zhipin-scraper,一个通过 Chrome DevTools Protocol 绕过字体反爬的 BOSS 直聘数据采集工具,直接输出明文薪资数...

技术 · 开源 · 周三, 七月 15, 2026 · 5 分钟 · 2183 字

MediaCrawler:多平台自媒体数据采集利器,一键爬取小红书、抖音、B站

今天在 GitHub Trending 上看到一个有意思的项目:MediaCrawler,一个支持小红书、抖音、快手、B站、微博、贴吧、知乎七大平台的多功能自媒体数据采集...

技术 · 开源 · 周五, 六月 26, 2026 · 5 分钟 · 2310 字

Puppeteer:Google 出品的浏览器自动化神器,从爬虫到测试全覆盖

今天在 GitHub Trending 上看到一个有意思的项目:Puppeteer,这是 Google 官方维护的浏览器自动化库,能够用几行代码控制 Chrome 或 Firefox 完成复杂任务。 一、项目概述 Puppeteer 是...

技术 · 开源 · 周二, 六月 16, 2026 · 5 分钟 · 2443 字

Scrapling:自适应智能爬虫框架,让数据采集不再头疼

今天在 GitHub Trending 上看到一个有意思的项目:Scrapling,一句话描述项目核心价值——它是一个「自适应」的 Web 爬虫框架,解析器能在网页结构变化时自动...

技术 · 开源 · 周日, 五月 31, 2026 · 6 分钟 · 2818 字