挖掘有趣 Github 的猫。


有事联系:https://t.me/qumaobot
🍭 #网络安全 #自动化抓取 #浏览器扩展


🏵 Scrapfly Anti-bot Detector - 识别网站防护与指纹追踪


🍥 简介:
本项目为基于Manifest V3的Chrome扩展程序,专为安全研究员及网页开发者设计。该工具能够自动化检测并分析多种网站防护机制及指纹识别技术。支持识别reCAPTCHA、hCaptcha、Cloudflare Turnstile等验证码系统,可对Cloudflare、Akamai、DataDome、AWS WAF等主流反爬虫架构进行特征匹配,并能精准识别Canvas、WebGL、Audio、WebRTC及浏览器Storage等设备指纹追踪手段。


🎈 【进入项目】


🗣 活动线报 | 掘金项目
🍭 #开源工具 #网页设计

🏵 Silex - 可视化静态网页构建工具

🍥 简介:
Silex 是一款基于浏览器的开源可视化网页设计工具。该程序允许用户通过拖拽界面构建静态网站,并支持集成动态数据。作为一款无代码开发平台,它具备高度灵活性,适用于快速部署各类网页内容,且完全开源免费,兼容多种前端部署环境。

🎈 【进入项目】


🗣 活动线报 | 掘金项目
🍭 #网站分析 #隐私保护


🏵 Plausible Analytics - 轻量级网站流量统计工具

🍥 简介:
Plausible Analytics 是一款专注于隐私保护的网站分析服务,旨在替代 Google Analytics。该工具无需部署复杂代码,且不收集任何个人识别信息,能够有效规避 Cookie 法规限制。通过直观的仪表盘,用户可直接获取网站流量来源、页面浏览量及访客地理位置等核心统计数据,兼顾了数据洞察与用户隐私合规。

🎈 【进入项目】


🗣 活动线报 | 掘金项目
🍭 #人工智能 #网页自动化 #隐私保护


🏵 MATRIXON-AGENTIC-BROWSER - 基于AI的隐私型网页自动化代理


🍥 简介:
该项目是一款集成人工智能的网页浏览器,核心架构采用本地部署的小型语言模型(SLM),旨在保障用户隐私的前提下执行自动化任务。程序通过AI驱动,实现对网页交互的智能化控制与操作,有效避免敏感数据上传,满足高安全等级下的自动化流程需求,适用于本地化的数据抓取与流程处理。


🎈 【进入项目】


🗣 活动线报 | 掘金项目
🍭 #前端开发 #网页特效


🏵 CrosshairJs - 轻量级动态鼠标指针效果库

🍥 简介:
CrosshairJs 是一款轻量化的 JavaScript 库,用于实现网页自定义动态光标效果。该程序内置智能悬停交互功能,支持自动匹配交互逻辑,无需进行复杂的参数配置即可直接集成至项目中,能够显著增强前端页面的交互视觉体验。

🎈 【进入项目】


🗣 活动线报 | 掘金项目
🍭 #网络工具 #广告拦截

🏵 Pi-hole - 全局网络广告与流量拦截

🍥 简介:
Pi-hole 是一款运行于 Linux 系统的网络级广告拦截程序。该软件通过 DNS 过滤机制,无需在终端设备安装额外客户端,即可为局域网内的所有设备(包括智能电视、移动应用等)过滤广告及恶意内容。系统部署时间短,内置网页端仪表盘,支持通过缓存 DNS 查询记录优化网络响应速度,并提供直观的流量统计与管理功能。

🎈 【进入项目】


🗣 活动线报 | 掘金项目
🍭 #网页自动化 #自然语言处理


🏵 Page Agent - 自然语言网页自动化

🍥 简介:
Page Agent是一款开源工具,通过自然语言指令(如“点击登录按钮”)实现网页操作。它在浏览器内以单行代码运行,无需扩展、Python或截图。该工具支持自有AI模型集成,确保用户数据隐私。

🎈 【进入项目】


🗣 活动线报 | 掘金项目
🍭 #网页抓取 #Python工具


🏵 Scrapling - 高效网页数据提取

🍥 简介:
Scrapling是一个基于Python的快速网页抓取工具。它能够加载网页、绕过Cloudflare等反机器人阻断机制,并自动定位元素以适应网站变化。该工具支持使用CSS/XPath选择器、大型爬取任务的暂停与恢复功能、代理轮换以及命令行接口,部分操作无需编写代码。

🎈 【进入项目】


🗣 活动线报 | 掘金项目
🍭 #网络爬虫 #数据抓取 #开发框架


🏵 Scrapy - 网页数据抓取框架

🍥 简介:
Scrapy是一个开源的网络爬虫框架,专为从网站高效提取结构化数据而设计。它提供了一整套工具集,用于构建、部署和管理复杂的爬虫项目,实现自动化数据收集。Scrapy支持多平台运行,具备高度可扩展性,并且要求Python 3.10或更高版本作为其运行环境,以确保最佳兼容性和性能。

🎈 【进入项目】


🗣 活动线报 | 掘金项目
🍭 #文档转换 #网页生成


🏵 Paper2All - 工作转网页产品

🍥 简介:
Paper2All 是一款将学术论文自动化转换为交互式学术网页的流水线工具。它集成从论文到演示的全过程工作流。通过迭代优化内容和布局,该工具能够高效生成具有良好排版和高度互动性的科研项目网站,提升信息传播效果。

🎈 【进入项目】


🗣 活动线报 | 掘金项目
🍭 #网络爬虫 #数据抓取 #自动化


🏵 Scrapling - 响应式网络爬虫平台


🍥 简介:
Scrapling是一款响应式网络爬虫平台,旨在处理从单次请求到大规模扫描的各类数据抓取任务。该解析器能够监测网站内容变化,并在页面更新时自动调整元素定位。其内置了对Cloudflare Turnstile等反机器人保护机制的规避功能。平台提供了一个可扩展的爬虫框架,支持并行多会话扫描、暂停与恢复操作,并实现代理自动轮换,所有功能均可通过少量Python代码实现,提供高效且灵活的数据采集方案。


🎈 【进入项目】


🗣 活动线报 | 掘金项目
🍭 #AI助手 #网页自动化


🏵 富士网 - 基于AI的智能网页助手

🍥 简介:
富士网是一款基于人工智能的智能助手。它具备理解用户意图的能力,能够自主完成网站导航和页面操作,并代表用户执行各类任务。该程序通过清晰解释每一步骤,旨在自动化复杂的网页交互流程,提升用户操作效率,实现任务的精确执行。

🎈 【进入项目】


🗣 活动线报 | 掘金项目
🍭 #网站归档 #自托管工具

🏵 ArchiveBox - 网站内容归档

🍥 简介:
ArchiveBox是一款自托管系统,专为归档网站、文章、PDF文件及各类链接设计,确保内容长久保存不丢失。它支持以HTML快照、PDF、截图及源代码等多种格式保存页面。该工具适用于研究员、记者、法务部门及其他注重信息持久性保存的专业人士。

🎈 【进入项目】

🗣 羊毛撸货线报 | 合作/投稿
🍭 #网页抓取 #自动化 #数据采集


🏵 Scrapling - 自适应网页抓取库

🍥 简介:
Scrapling是一款创新的自适应网页抓取库。不同于传统爬虫,它能智能感知并自动适应目标网站结构的变化。当网站更新导致页面元素布局变动时,Scrapling能自动识别并调整抓取逻辑,确保数据提取任务持续稳定运行,有效避免因网站改版而需频繁维护爬虫代码的问题,提高抓取效率和稳定性。

🎈 【进入项目】


🗣 羊毛撸货线报 | 合作/投稿
🍭 #书签工具 #自托管 #网页应用


🏵 Faved - 链接收藏整理

🍥 简介:
Faved 是一款简洁的自托管网页应用,专注于帮助用户高效存储与整理各类网络链接。它同时支持桌面和移动设备访问,确保流畅的用户体验。Faved 完全免费且开源,承诺无广告、无跟踪,所有数据均本地存储,充分保障您的个人隐私与数据安全。

🎈 【进入项目】


🗣 [羊毛撸货线报] | [合作/投稿]
🍭 #网页操作系统 #云存储 #开发平台 #远程桌面


🏵 Puter - 网页操作系统

🍥 简介:
Puter是一款先进的开源网络操作系统,功能强大、运行快速且高度可扩展。它提供隐私友好的个人云存储,可安全存储文件、应用与游戏,并支持网站、网页应用及游戏的开发与发布。同时,它也可作为服务器和工作站的远程桌面环境,是传统云存储服务的有效替代方案。

🎈 【进入项目】


🗣 羊毛撸货线报 | 合作/投稿
🍭 #网页应用 #数据可视化


🏵 Voilà - Jupyter笔记本网页化工具

🍥 简介:
Voilà 是一个开源工具,能将 Jupyter 笔记本快速转换为独立的交互式网页应用。它通过为每个访问用户分配独立的 Jupyter 内核,支持实时响应网页控件交互并执行回调计算,同时默认隐藏代码单元格以保障安全性。该工具有效解决了传统静态HTML导出无法保持动态交互的问题,让数据分析结果能以更友好、安全的方式直接部署为原型系统或演示界面,大幅降低从分析到产品化的技术门槛。

🎈 【进入项目】


🗣 羊毛撸货线报 | 合作/投稿
🗣 每日羊毛线报 👈


🏵 Open Lovable - 网站克隆转React

🍥 简介:
Open Lovable 是一款基于AI的工具,能够在数秒内克隆任意网站并自动重构为现代化React应用。通过结合网页爬取与先进大模型能力,用户只需输入目标网址即可快速生成可编辑、可扩展的React项目源码。支持多种主流AI服务对接,适用于原型开发、页面迁移、产品重构等场景。项目开源,配置简单,提供本地一键部署体验,大幅提升前端开发自动化与效率。

🍭 #React开发 #网站克隆


🎈 【进入项目】


🎯 关注频道 🤖 合作/投稿
🗣 每日羊毛线报 👈


🏵 Defuddle - 网页内容提取器

🍥 简介:
Defuddle 是一款网页内容提取工具,旨在移除网页中不必要的元素,例如评论、侧边栏、页眉和页脚等,从而提取出主要内容,使其更易于阅读。Defuddle 的目标是输出干净且一致的 HTML 文档,更宽容地处理不确定元素,并提供对脚注、代码块等的一致输出。它还利用移动端样式来识别不必要元素,并提取更多元数据。

🍭 #网页内容提取 #HTML #内容清理


🎈 【进入项目】


🎯 关注频道 🤖 合作/投稿
🗣 每日羊毛线报 👈


🏵 Hyperbrowser MCP Server - 网页数据提取与爬取

🍥 简介:
Hyperbrowser MCP Server是Hyperbrowser的MCP服务器实现,提供网页抓取、结构化数据提取和网页爬取等工具。它集成了多种通用浏览器代理,如OpenAI的CUA和Anthropic的Claude Computer Use,方便用户进行自动化操作。主要功能包括:网页内容抓取、多页爬取、HTML到JSON的转换、Bing搜索以及各种浏览器自动化代理。Hyperbrowser API提供更丰富的功能。

🍭 #网页爬虫 #数据提取


🎈 【进入项目】


🎯 关注频道 🤖 合作/投稿
 
 
Back to Top