Python3爬虫-05-爬取腾讯新闻

544 阅读1分钟

image.png

#coding:utf-8
import requests
from bs4 import BeautifulSoup

url = "http://news.qq.com/"

#请求腾讯新闻的URl,获取其text文本
wbdata = requests.get(url).text
#对获取的文本进行解析
soup = BeautifulSoup(wbdata,'lxml')
#从解析文件中通过select选择器定位指定的元素,返回一个列表 
news_titles = soup.select("div.text > em.f14 > a.linkto")

print(news_titles)

for n in news_titles:
    title = n.get_text()
    link = n.get("href")
    data = {
        '标题':title,
        '链接':link
    }
    print(data)

我的Python3爬虫系列