Python代码爬取持续创作，加速成长！这是我参与「掘金日新计划 · 10 月更文挑战」的第2天，点击查看活动详情今天

持续创作，加速成长！这是我参与「掘金日新计划 · 10 月更文挑战」的第2天，点击查看活动详情今天的内容稍显简单，不过对于新媒体创作的朋友们还是很有帮助的，你能用上的话记得给辣条三连！

爬取目标网站：站长素材

工具使用开发工具：pycharm

开发环境：python3.7， Windows10

使用工具包：requests，lxml

重点学习内容 1.requests的网络请求应用

2.获取全部音频的网络地址

3.设置数据保存文件

项目思路解析请求首页数据通过修改url的值来改变数据获取首页数据信息

获取到网页源代码通过xpath方式提取出对应的音乐播放地址提取出对应音频标题

保存对应音频数据信息

简易源码分享 import requests from lxml import etree for page in range(1, 2): url = 'http:/ headers = { 'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/81.0.4044.138 Safari/537.36' } response = requests.get(url=url, headers=headers).text html_data = etree.HTML(response) div_list = html_data.xpath('//div[@class="audio-item"]') for div in div_list: new_url = div.xpath('./audio/@src')[0] title = div.xpath('.//p[@class="name"]/text()')[0].strip() print(new_url, title) res = requests.get(url=new_url, headers=headers).content filename = '音效/' + title + '.mp3' with open(filename, 'wb') as f: f.write(res) print("下载完毕{}".format(title))

文章知识点与官方知识档案匹配，可进一步学习相关知识 Python入门技能树网络爬虫动态渲染页面发环境：python3.7， Windows10

使用工具包：requests，lxml

重点学习内容

1.requests的网络请求应用

2.获取全部音频的网络地址

3.设置数据保存文件

项目思路解析t etree

for page in range(1, 2): url = 'htp://s.chinaz.coao/iage) headers = { 'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/81.0.4044.138 Safari/537.36' } response = requests.get(url=url, headers=headers).text html_data = etree.HTML(response) div_list = html_data.xpath('//div[@class="audio-item"]') for div in div_list: new_url = div.xpath('./audio/@src')[0] title = div.xpath('.//p[@class="name"]/text()')[0].strip() print(new_url, title) res = requests.get(url=new_url, headers=headers).content filename = '音效/' + title + '.mp3'