这篇文章给大家分享的是有关怎样使用python爬虫新闻的内容。小编觉得挺实用的,因此分享给大家做个参考。一起跟随小编过来看看吧。
创新互联公司专注于宁夏企业网站建设,响应式网站开发,商城网站定制开发。宁夏网站建设公司,为宁夏等地区提供建站服务。全流程按需求定制制作,专业设计,全程项目跟踪,创新互联公司专业和态度为您提供的服务首先,打开开发者模式,分析网页。
具体做法:按F12,并用ctrl+f对elements进行搜索,关键字为新闻内容的几个字即可。
找到内容文字
利用这个方法,我们很轻松就找到了新闻文字内容的位置,通过分析发现其内容都为p标签下的字符串,并且其class="one-p",这可以作为定位该内容的特征。
通过以上的分析,我们确定了定位关键信息的方法,接下来就可以编写python程序了:
实例代码:
# -*- coding:utf-8 -*-import requests from bs4 import BeautifulSoup url = "/tupian/20230522/pgv_ref=apub rr = r.content bs = BeautifulSoup(rr,"lxml") news_contents = bs.find_all("p",{'class':'one-p'}) news_final = ""for i in news_contents: print(i.string) if i.string: news_final = news_final +i.string + "\n"f = open("news_contents.txt",'w') f.write(news_final) f.close()
最终打开保存的文件,里面就是获取的新闻内容了哦~
感谢各位的阅读!关于怎样使用python爬虫新闻就分享到这里了,希望以上内容可以对大家有一定的帮助,让大家可以学到更多知识。如果觉得文章不错,可以把它分享出去让更多的人看到吧!