色综合图-色综合图片-色综合图片二区150p-色综合图区-玖玖国产精品视频-玖玖香蕉视频

您的位置:首頁技術(shù)文章
文章詳情頁

Python如何爬取b站熱門視頻并導(dǎo)入Excel

瀏覽:5日期:2022-07-14 14:38:37

代碼如下

#encoding:utf-8import requestsfrom lxml import etreeimport xlwtimport os # 爬取b站熱門視頻信息def spider(): video_list = [] url = 'https://www.bilibili.com/ranking?spm_id_from=333.851.b_7072696d61727950616765546162.3' html = requests.get(url, headers={'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/75.0.3770.100 Safari/537.36'}).text html = etree.HTML(html) infolist = html.xpath('//li[@class=’rank-item’]') for item in infolist: rank = ''.join(item.xpath('./div[@class=’num’]/text()')) video_link = ''.join(item.xpath('.//div[@class=’info’]/a/@href')) title = ''.join(item.xpath('.//div[@class=’info’]/a/text()')) payinfo = ''.join(item.xpath('.//div[@class=’detail’]/span/text()')).split('萬') play = payinfo[0] + '萬' comment = payinfo[1] if comment.isdigit() == False: comment += '萬' upname = ''.join(item.xpath('.//div[@class=’detail’]/a/span/text()')) uplink = 'http://' + ''.join(item.xpath('.//div[@class=’detail’]/a/@href')) hot = ''.join(item.xpath('.//div[@class=’pts’]/div/text()')) video_list.append({ ’rank’: rank, ’videolink’: video_link, ’title’: title, ’play’: play, ’comment’: comment, ’upname’: upname, ’uplink’: uplink, ’hot’: hot }) return video_list def write_Excel(): # 將爬取的信息添加到Excel video_list = spider() workbook = xlwt.Workbook() # 定義表格 sheet = workbook.add_sheet('b站熱門視頻') # 添加sheet的name xstyle = xlwt.XFStyle() # 實例化表格樣式對象 xstyle.alignment.horz = 0x02 # 字體居中 xstyle.alignment.vert = 0x01 head = [’視頻名’, ’up主’,’排名’, ’熱度’,’播放量’,’評論數(shù)’] for h in range(len(head)): sheet.write(0, h, head[h], xstyle) i = 1 for item in video_list: # 向單元格(視頻名)添加該視頻的超鏈接 if ’'’ in item['title']: item['title'] = item['title'].split(’'’)[1] title_data = ’HYPERLINK('’+item['videolink']+’';'’+item['title']+’')’ # 設(shè)置超鏈接 sheet.col(0).width = int(256 * len(title_data) * 3/5) # 設(shè)置列寬 sheet.write(i, 0, xlwt.Formula(title_data), xstyle) name_data = ’HYPERLINK('’+item['uplink']+’';'’+item['upname']+’')’ sheet.col(1).width = int(256 * len(name_data) * 3/5) sheet.write(i, 1, xlwt.Formula(name_data), xstyle) sheet.write(i, 2, item['rank'], xstyle) sheet.write(i, 3, item['hot'], xstyle) sheet.write(i, 4, item['play'], xstyle) sheet.write(i, 5, item['comment'], xstyle) i += 1 # 如果文件存在,則將其刪除 file = 'b站熱門視頻信息.xls' if os.path.exists(file): os.remove(file) workbook.save(file) if __name__ == ’__main__’: write_Excel()

結(jié)果展示:

Python如何爬取b站熱門視頻并導(dǎo)入Excel

以上就是本文的全部內(nèi)容,希望對大家的學(xué)習(xí)有所幫助,也希望大家多多支持好吧啦網(wǎng)。

標(biāo)簽: b站 嗶哩嗶哩 Python
相關(guān)文章:
主站蜘蛛池模板: 免费一级毛片在播放视频 | 中国一级特黄视频 | 一区二区中文字幕在线观看 | 日韩aⅴ在线观看 | 欧美一级欧美一级高清 | 手机看a| 精品久久久久久久久久久久久久久 | 久草福利资源在线观看 | a级高清观看视频在线看 | 无码孕妇孕交在线观看 | 国产国产人免费视频成69堂 | 九九这里只精品视在线99 | 波多野结衣中文无毒不卡 | 手机在线观看黄色网址 | 国产成人一区二区三区高清 | 四川一级片 | 久久免费影院 | 91香蕉成人免费高清网站 | 欧美成人午夜影院 | 欧美一二三区视频 | 波多野结衣视频免费在线观看 | 毛片的网址 | 美女喷水网站 | 欧美午夜不卡 | 国产片一级aaa毛片视频 | 狠狠做久久深爱婷婷97动漫 | 亚洲aⅴ在线 | 特级片在线观看 | 亚洲在线日韩 | 国产在线观看免费 | 巨大热杵在腿间进进出出视频 | 真人一级毛片全部免 | 亚洲欧美性视频 | 亚洲天堂视频在线 | 成人夜色香网站在线观看 | 日韩欧美在线视频观看 | 久久久久久久久久免免费精品 | 国产精品久久久一区二区三区 | 日本人在线看片 | 欧美一级视频免费 | 精品欧美高清不卡在线 |