首页 > 其他 > 详细

互联网数据的挖掘和分析

时间:2015-09-30 12:43:14      阅读:190      评论:0      收藏:0      [点我收藏+]

基本上使用python语言完成

一、抓取
列表页
详细页

授权(API)&未授权(爬虫)
普通抓取&需登录

二、html解析
1. BeautifulSoup
2. 正则


三、文本分析&自然语言处理

四、性能优化
1. 反抓取屏蔽 http代理
2. 性能优化
多线程抓取

互联网数据的挖掘和分析

原文:http://www.cnblogs.com/gaotianpu/p/4848635.html

(0)
(0)
   
举报
评论 一句话评论(0
关于我们 - 联系我们 - 留言反馈 - 联系我们:wmxa8@hotmail.com
© 2014 bubuko.com 版权所有
打开技术之扣,分享程序人生!