专栏名称: 大数据挖掘DT数据分析
实战数据资源提供。数据实力派社区,手把手带你玩各种数据分析,涵盖数据分析工具使用,数据挖掘算法原理与案例,机器学习,R语言,Python编程,爬虫。如需发布广告请联系: hai299014
目录
相关文章推荐
数据派THU  ·  BayesFlow:基于神经网络的摊销贝叶斯 ... ·  昨天  
龙岩发布  ·  龙岩交警最新发布!这些路口违法行为多发→ ·  9 小时前  
数局  ·  听说他在中央混得不咋地 ·  昨天  
51好读  ›  专栏  ›  大数据挖掘DT数据分析

利用python爬取人人贷网的数据

大数据挖掘DT数据分析  · 公众号  · 大数据  · 2017-02-01 17:28

正文

请到「今天看啥」查看全文


1.直接抓取数据。

2.模拟浏览器抓取数据。

3.基于API接口抓取数据

综合分析,我决定用第2种方法"模拟浏览器登录",那得找好相应的python包,网上有:mechanize,selenium等等。


1.mechanize包的尝试

br.select_form(nr = 0) # Find the login form
br[
'vb_login_username'] = '你的用户名'
br['vb_login_password'] = '你的注册密码'

这段代码中老是遇到问题,第一,select_form中的nr怎么找,第二,在人人贷网站源代码中如何找所谓的'vb_login_username','vb_login_password'的专有名词。


其实我在代码测试中还是找到对于的nr=0,但是找了好久找不到对应的'vb_login_username'。(个人不太懂html,学的比较菜,有兴趣的可以尝试一下)。后来听朋友说可以试试selenium。

前面废话说了一大堆,都是我学的比较菜,也就是我的经验之谈。


2.selenium包的尝试(重点)







请到「今天看啥」查看全文