怎么利用Python爬取网页内容-创新互联

这篇文章主要讲解了“怎么利用Python爬取网页内容”,文中的讲解内容简单清晰,易于学习与理解,下面请大家跟着小编的思路慢慢深入,一起来研究和学习“怎么利用Python爬取网页内容”吧!

为若羌等地区用户提供了全套网页设计制作服务,及若羌网站建设行业解决方案。主营业务为成都网站建设、成都网站设计、若羌网站设计,以传统方式定制建设网站,并提供域名空间备案等一条龙服务,秉承以专业、用心的态度为用户提供真诚的服务。我们深信只要达到每一位用户的要求,就会得到认可,从而选择与我们长期合作。这样,我们也可以走得更远!

编写执行代码

首先,你要安装requests和BeautifulSoup4,然后执行如下代码.
 
import requests
 
from bs4 import BeautifulSoup
 
iurl = 'http://news.sina.com.cn/c/nd/2017-08-03/doc-ifyitapp0128744.shtml'
 
res = requests.get(iurl)
 
res.encoding = 'utf-8'
 
#print(len(res.text))
 
soup = BeautifulSoup(res.text,'html.parser')
 
#标题
 
H1 = soup.select('#artibodyTitle')[0].text
 
#来源
 
time_source = soup.select('.time-source')[0].text
 
#来源
 
origin = soup.select('#artibody p')[0].text.strip()
 
#原标题
 
oriTitle = soup.select('#artibody p')[1].text.strip()
 
#内容
 
raw_content = soup.select('#artibody p')[2:19]
 
content = []
 
for paragraph in raw_content:
 
content.append(paragraph.text.strip())
 
'@'.join(content)
 
#责任编辑
ae = soup.select('.article-editor')[0].text

感谢各位的阅读,以上就是“怎么利用Python爬取网页内容”的内容了,经过本文的学习后,相信大家对怎么利用Python爬取网页内容这一问题有了更深刻的体会,具体使用情况还需要大家实践验证。这里是创新互联,小编将为大家推送更多相关知识点的文章,欢迎关注!

网页标题:怎么利用Python爬取网页内容-创新互联
本文路径:https://www.cdcxhl.com/article28/coiicp.html

成都网站建设公司_创新互联,为您提供移动网站建设标签优化外贸网站建设App设计外贸建站用户体验

广告

声明:本网站发布的内容(图片、视频和文字)以用户投稿、用户转载内容为主,如果涉及侵权请尽快告知,我们将会在第一时间删除。文章观点不代表本网站立场,如需处理请联系客服。电话:028-86922220;邮箱:631063699@qq.com。内容未经允许不得转载,或转载时需注明来源: 创新互联

成都定制网站网页设计