前言: 首先表示抱歉,春节后一直较忙,未及时更新该系列文章。 近期,由于监控的站源越来越多,就偶有站源做了反爬机制,造成我们的SupportYun系统小爬虫服务时常被封IP,不能进行数据采集。 这时候,前面有园友提到的IP代理就该上场表演了。 IP代理池设计: 博 ...
爬虫系统升级改造正式启动: 在第一篇文章,博主主要介绍了本次改造的爬虫系统的业务背景与全局规划构思: 未来Support云系统,不仅仅是爬虫系统,是集爬取数据 数据建模处理统计分析 支持全文检索资源库 其他业务部门和公司资讯系统重要数据来源 辅助决策等功能于一身的企业级Support系统。 介于好多园友对博主的任务排期表感兴趣,便介绍一下博主当时针对这个系统做的工作任务排期概要 排期表就是更加详 ...
2016-12-05 11:15 15 2315 推荐指数:
前言: 首先表示抱歉,春节后一直较忙,未及时更新该系列文章。 近期,由于监控的站源越来越多,就偶有站源做了反爬机制,造成我们的SupportYun系统小爬虫服务时常被封IP,不能进行数据采集。 这时候,前面有园友提到的IP代理就该上场表演了。 IP代理池设计: 博 ...
。 基本技术介绍: 还记得上一次做全文搜索是在2013年,主要核心设计与代码均是当时 ...
SupportYun当前状况: 博主的SupportYun系统基本已经完成第一阶段预期的底层服务开发啦~~~自己小嘚瑟一下。 有对该系统历史背景与功能等不明白的可先看该系列的第1/2篇文章: 1.记一次企业级爬虫系统升级改造(一) 2.记一次企业级爬虫系统升级 ...
首先表示抱歉,年底大家都懂的,又涉及SupportYun系统V1.0上线。故而第四篇文章来的有点晚了些~~~对关注的朋友说声sorry! SupportYun系统当前一览: 首先说一下,文章的进度一直是延后于系统开发进度的。 当前系统V1.0 已经正式上线服役了,这就给大家欣赏 ...
既定改造方案 基于上一篇分析出的种种问题,我们将库房人员的系统操作划分为两大类。 第一类为货物驱动的操作,这类操作主要随着货物而前进,人员不看或者看软件的次数比较少,更多是对货物的状态进行系统上的确认和进行下一步的业务数据准备。 第二类为任务驱动的操作,这类在库房目前特指质控的相关工作 ...
起因 无语的百度检测给了网站安全检测12分的低分,说是apache2.2.27有巴拉巴拉多的漏洞,你赶快升级吧。我假装没看到,然后被催了好几天,终于开始动手更新了。 第一步,安装新的apache 首先将/etc ...
针对业务开发人员通常面对的业务需求,我们将日志分为操作(请求)日志和系统运行日志,操作(请求)日志可以让管理员或者运营人员方便简单的在系统界面中查询追踪用户具体做了哪些操作,便于分析统计用户行为;系统运行日志又分为不同的级别(Log4j2): OFF > FATAL > ERROR ...