最新公告
  • 欢迎您光临起源地模板网,本站秉承服务宗旨 履行“站长”责任,销售只是起点 服务永无止境!立即加入钻石VIP
  • 如何使用python爬虫新闻?

    正文概述    2020-08-19   946

    现在时事是人们最在意的话题,而且对于新闻行业来说,掌握第一手新闻资料,可是独家新闻,大爆炸,其他圈子小编不清楚,但是娱乐圈,想必大家都知道吧,像第一手资料的狗仔,一直是人们津津乐道的话题,所以怎么去获取第一手资料呢,大家可以跟着小编来学习下,最新新闻的获取内容哦~

    首先,打开开发者模式,分析网页。

    具体做法:按F12,并用ctrl+f对elements进行搜索,关键字为新闻内容的几个字即可。

    找到内容文字

    利用这个方法,我们很轻松就找到了新闻文字内容的位置,通过分析发现其内容都为p标签下的字符串,并且其class="one-p",这可以作为定位该内容的唯一特征。

    通过以上的分析,我们确定了定位关键信息的方法,接下来就可以编写python程序了:

    实例代码:

    # -*- coding:utf-8 -*-import requests
     
    from bs4 import BeautifulSoup
     
    url = "https://img.qiyuandi.com/images/10/rhsypnotfound.htm
     
    rr = r.content
     
    bs = BeautifulSoup(rr,"lxml")
     
    news_contents = bs.find_all("p",{'class':'one-p'})
     
    news_final = ""for i in news_contents:
     
    print(i.string)
     
    if i.string:
     
    news_final = news_final +i.string + "\n"f = open("news_contents.txt",'w')
     
    f.write(news_final)
     
    f.close()

    最终打开保存的文件,里面就是获取的新闻内容了哦~

    大家可以利用小编的这个方法,去找到想要找的内容文字,方法不仅简单,还很容易操作,直接复制粘贴即可哦~如果还想了解其他内容,可以到python学习网上去查询哦~


    起源地下载网 » 如何使用python爬虫新闻?

    常见问题FAQ

    免费下载或者VIP会员专享资源能否直接商用?
    本站所有资源版权均属于原作者所有,这里所提供资源均只能用于参考学习用,请勿直接商用。若由于商用引起版权纠纷,一切责任均由使用者承担。更多说明请参考 VIP介绍。
    提示下载完但解压或打开不了?
    最常见的情况是下载不完整: 可对比下载完压缩包的与网盘上的容量,若小于网盘提示的容量则是这个原因。这是浏览器下载的bug,建议用百度网盘软件或迅雷下载。若排除这种情况,可在对应资源底部留言,或 联络我们.。
    找不到素材资源介绍文章里的示例图片?
    对于PPT,KEY,Mockups,APP,网页模版等类型的素材,文章内用于介绍的图片通常并不包含在对应可供下载素材包内。这些相关商业图片需另外购买,且本站不负责(也没有办法)找到出处。 同样地一些字体文件也是这种情况,但部分素材会在素材包内有一份字体下载链接清单。
    模板不会安装或需要功能定制以及二次开发?
    请QQ联系我们

    发表评论

    还没有评论,快来抢沙发吧!

    如需帝国cms功能定制以及二次开发请联系我们

    联系作者

    请选择支付方式

    ×
    迅虎支付宝
    迅虎微信
    支付宝当面付
    余额支付
    ×
    微信扫码支付 0 元