Pholcus Pholcus

Pholcus Pholcus

Apache
Google Go
跨平台
2015-06-22
bear256

已删除源码

加载中

评论(18)

天佑我儿
如果是有账号密码的私密代理怎么用啊?? 我在源代码里面找不到可用私密代理的方法
懒神
懒神
单机用还可以,其他有待优化。
青苗
青苗
满分
数据抓取
数据抓取
寻找一个小团队做新闻客户端数据抓取,感兴趣可微信联系zx_wander
红薯
红薯
没写 license #Pholcus#
成都阿布
成都阿布
必须要支持! #Pholcus#
小水熊
小水熊
紧紧是download页面还是可以parse数据?并发限制的是针对网站的还是爬虫客户端? #Pholcus#
__JM_Joy__
__JM_Joy__
厉害! #Pholcus#
烟灰o_O
烟灰o_O
支持Mac么? #Pholcus#
Jarry_liu
Jarry_liu
用什么写的界面? #Pholcus#

Pholcus 1.2 发布,高并发、分布式爬虫软件

Pholcus爬虫软件发布1.2版本,CPU使用率与内存占用均有大幅降低,运行更加稳定流畅。同时新增kafka输出方式,加快任务终止速度(秒级延时)。 Pholcus v1.2 具体更新细节如下: 一、输出功能...

2016/09/25 23:36

Pholcus(幽灵蛛)爬虫软件 v1.0 稳定版正式发布

自2015年5月 Pholcus 发布第一个版本起历经一年的版本迭代,今日 v1.0 稳定版本终于正式发布了。在此感谢所有关注过Pholcus、反馈过开发建议以及运行bug的朋友们。v1.0 版本是一个经过诸多用...

2016/06/16 14:40

高并发、分布式爬虫 Pholcus 0.8.5 发布

Pholcus 0.8.5 发布,此版本优化多项功能(如新增cmd版服务端、客户端,细化历史记录粒度等)、修复多个bug,并减少诸多依赖包,为发布1.0稳定版做准备。 Pholcus(幽灵蛛)是一款纯Go语言编...

2016/03/23 09:30

Pholcus 爬虫 v0.8.2,性能提升 20% 以上

Pholcus(幽灵蛛)是一款纯Go语言编写的高并发、分布式、重量级爬虫软件,支持单机、服务端、客户端三种运行模式,拥有Web、GUI、命令行三种操作界面;规则简单灵活、批量任务并发、输出方式...

2016/03/03 20:09

Pholcus 爬虫 v0.8.0,支持 HTML 风格动态规则

近日,Pholcus 升级 v0.8.0 版本了,最大的亮点就是:终于突破规则需要静态编译的局制,增加支持HTML风格的动态规则。以后交流分享规则变得更加方便,随之而来将会是愈加完善的生态圈。 以下...

2016/01/20 10:46

Pholcus 0.7.5 发布,Go 爬虫软件

Pholcus 0.7.5 发布,更新如下: 大量功能优化: 一、规则模块更新: 1. 封装Spider与Response为上下文Context,大大简化规则语法; 2. 支持从Context获取上一次Request,并可在修改后作为新...

2015/12/03 07:41

Pholcus 0.7.4 发布,Go 爬虫软件

Pholcus 0.7.4 发布,更新如下: Spider中添加Namespace func(*Spider) string与SubNamespace func(self *Spider, dataCell map[string]interface{}) string两个字段,实现自定义数据库、表单...

2015/11/11 07:55

Pholcus 0.7.3 发布,Go 爬虫软件

Pholcus 0.7.3 发布,更新内容如下: 全面升级 一、界面升级: 1. Windows下编译时自动添加图标 2. web及cmd版的命令行窗口添加软件名称 二、下载器相关升级: 1. 初步增加PhantomJS下载器,...

2015/10/21 07:58

Pholcus 0.6.1 发布,Go 爬虫软件

Pholcus 0.6.1 发布,更新内容如下: 调整spider结构体,规范命名,精简方法; 拓展Teleport Socket API; 新增大量采集规则实例; 解放规则库,用户可以自由指定规则库; 不再直接提供main包...

2015/08/20 09:34

Pholcus 0.6.0 发布,Go 爬虫软件

Pholcus 0.6.0 发布,更新内容如下: 新增web操作界面(已支持web/gui/command三种界面); 支持运行模式热切换。 下载器支持固定UserAgent,自动保存cookie模式; 下载器支持随机大量常用U...

2015/08/12 08:06

没有更多内容

加载失败,请刷新页面

1
回答
怎么使用pholcus

@henrylee2cn 你好,想跟你请教个问题:请问老师,这个到底怎么用啊?

2016/06/20 13:34
2
回答
如何用google地图收集历年来全国各县政府地址

@henrylee2cn 你好,想跟你请教个问题: 请问我可以用这个爬虫程序在google地图上批量搜集历年来的全国各个县的人民政府的地址吗?由于政府可能...

2016/04/25 16:59

没有更多内容

加载失败,请刷新页面

没有更多内容

[Pholcus爬虫] 实现一个简单的下载文件的动态规则

Pholcus爬虫的动态规则使用 .pholcus.html 作为规则文件后缀,默认放在当前目录的 ./pholcus_pkg/spiders 文件夹中。用户可以在配置文件 ./pholcus_pkg/config.ini 中通过修改“spiderdir”字...

2016/09/02 10:44
1.3K
2
Go 爬虫软件 Pholcus

Pholcus Pholcus(幽灵蛛)是一款纯Go语言编写的支持分布式的高并发、重量级爬虫软件,定位于互联网数据采集,为具备一定Go或JS编程基础的人提供一个只需关注规则定制的功能强大的爬虫工具。...

2016/11/22 10:47
632
0
[Pholcus爬虫] 应对网站反爬虫的多项策略

Pholcus如何应对网站反爬虫策略?

2016/09/02 23:19
860
0
基于golang的爬虫实战

Go语言实现的小型爬虫,基于selenium实现,功能比较简单,新人练手用,轻喷~

2018/04/20 14:33
9.5K
0
Google Go 语言从入门到应用必备开源项目

Go 语言于 2009 年 11 月正式宣布推出,成为开放源代码项目,发展至今已经具有越来越广泛的影响力,今年更是在 TIOBE 编程语言排行榜中跻身 20 强。很多开发者也逐渐将目光投向这门语言,本文...

2016/12/12 13:05
2W
22
2016年度开源中国最受欢迎开源软件参展合集

记录这些主要是方便后期阅读开源项目的时候方便查找:http://www.oschina.net/project/top_cn_2016 afinal Afinal简介 Afinal 是一个android的sqlite orm 和 ioc 框架。同时封装了android中的...

2016/12/21 19:17
694
0

没有更多内容

加载失败,请刷新页面

没有更多内容

返回顶部
顶部