Python爬取爬取明星关系并写入csv文件

时间：2021-04-07 12:27:20 阅读：24 评论：0 收藏：0 [点我收藏+]

　　今天用Python爬取了明星关系，数据不多，一共1386条数据，代码如下：

import requests
from bs4 import BeautifulSoup
import bs4
import csv

def getHTMLText(url):
    try:
        kv = {‘user-agent‘: ‘Mozilla/5.0‘}  # 请求头;指定访问浏览器为Mozilla5.0版本的浏览器
        r = requests.get(url)
        r.raise_for_status() #如果状态不是200，引发HTTPError异常
        r.encoding = r.apparent_encoding
        return r.text
    except:
        return "产生异常"

def fillUnivList(ulist,html):
    soup = BeautifulSoup(html,"lxml")
    for lis in soup.find_all(‘li‘, {‘liodd‘, ‘lieven‘}):
        if isinstance(lis, bs4.element.Tag):
            spans = lis(‘span‘)
            ulist.append([spans[0].text.strip(), spans[1].text.strip(), spans[2].text.strip()])

            #print(spans[0].text.strip(),"    ",spans[1].text.strip(),"    ",spans[2].text.strip(),)

    with open(‘star.csv‘, ‘a‘, newline=‘‘)as f:
        csv_writer = csv.writer(f)
        csv_writer.writerows(ulist)
    f.close()
    #print(ulist)

if __name__ == ‘__main__‘:
    print("爬虫开始")
    for page in range(1,100):
        url = "https://www.1905.com/mdb/relation/list/s0t0p" + str(page) + ".html"

        html = getHTMLText(url)
        ulist=[]
        fillUnivList(ulist,html)
    print("爬虫结束")

原文：https://www.cnblogs.com/qianmo123/p/14626460.html

踩

(0)

评论一句话评论（0）

分享档案

更多>

2021年09月23日 (328)
2021年09月24日 (313)
2021年09月17日 (191)
2021年09月15日 (369)
2021年09月16日 (411)
2021年09月13日 (439)
2021年09月11日 (398)
2021年09月12日 (393)
2021年09月10日 (160)
2021年09月08日 (222)