已测试

特色:

1.前端纯HTML+JS+JSON(链接统计除外),后端python生成标准JSON

2.自带30几个常用网站采集规则

3.多线程抓取,30+网站5秒内采集完毕

4.相同网站放在一个框架内,可局部刷新和滚动

5.更新时间显示(按采集页的自带更新时间或按时间排序的第一条时间采集,没有的为采集完成时间)

6.内容链接防盗链,链接通过base64+字符逆序+大小写反转+base64实现加密(更换大小写转换顺序或增加数字替换可实现不同密码加密)

7.内容链接点击统计

8.部分内容鼠标悬停提示(如appstore排行有更新内容、时间、版本号)

安装:

1.python3 caiji.py采集(保持后台运行请用screen或nohup)

2.打开首页访问

注:

caiji.py为后端采集程序,其余为前端需在同一目录

相应设置修改请查看源码中的注释

admin.php为第三方数据库管理程序,用于内容链接统计查看(默认密码admin,请在文件中修改)

点击统计数据库log.db会在首次访问内容链接时生成,如未建立请保证主目录可写

为了安全,后端程序caiji.py和数据库查看程序admin.php请改为复杂文件名,或移动到非web目录(需同时修改文件内的生成json保存目录为网站根目录,默认为当前目录)

默认使用多线程抓取,如有问题请改用单线程

今日头条的采集请更换为自己的cookie,头条短时间采集内容相同的太多(目前1分钟采一次合并10次数据),相同cookie分段采集后几乎不会有重复的,但采集一段时间后推荐的都是杂七杂八无关的垃圾内容(请定期更换cookie或自行加入随机的头条cookie生成规则)

采集站的logo大部分已修改为透明图层png,在非白色背景下可能会很难看

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注

本站所有资源版权均属于原作者所有,这里所提供资源均只能用于参考学习用,请勿直接商用。若由于商用引起版权纠纷,一切责任均由使用者承担。更多说明请参考 VIP介绍。

最常见的情况是下载不完整: 可对比下载完压缩包的与网盘上的容量,若小于网盘提示的容量则是这个原因。这是浏览器下载的bug,建议用百度网盘软件或迅雷下载。 若排除这种情况,可在对应资源底部留言,或联络我们。

对于会员专享、整站源码、程序插件、网站模板、网页模版等类型的素材,文章内用于介绍的图片通常并不包含在对应可供下载素材包内。这些相关商业图片需另外购买,且本站不负责(也没有办法)找到出处。 同样地一些字体文件也是这种情况,但部分素材会在素材包内有一份字体下载链接清单。

如果您已经成功付款但是网站没有弹出成功提示,请联系站长提供付款信息为您处理

源码素材属于虚拟商品,具有可复制性,可传播性,一旦授予,不接受任何形式的退款、换货要求。请您在购买获取之前确认好 是您所需要的资源