[Python] Python爬取每日早报

说明:

每天早上自己搜新闻太麻烦了,找了个早报网页,直接Python获取就行.

暂时只是爬取到数据、未进行图片可视化操作、后期更新。

效果图:

代码如下:

'''
早报
早报地址:https://www.163.com/dy/media/T1603594732083.html
'''
import requests
from lxml import etree

def main():
    url="https://www.163.com/dy/media/T1603594732083.html"
    rsp=requests.get(url)
    html=etree.HTML(rsp.text)
    today_url=html.xpath("//h2[@class='media_article_title']/a/@href")[0]
    rsp=requests.get(today_url)
    html=etree.HTML(rsp.text)
    news_list=html.xpath("//div[@class='post_body']/p[2]//text()")
    news_list=news_list[1:]
    for news in news_list:
        print(news)
if __name__ == "__main__":
    main()
|| 版权声明
作者:云言
链接:https://yyink.cn/archives/66.html
声明:如无特别声明本文即为原创文章仅代表个人观点,版权归《云言博客》所有,欢迎转载,转载请保留原文链接。
THE END
分享
二维码
海报
[Python] Python爬取每日早报
说明: 每天早上自己搜新闻太麻烦了,找了个早报网页,直接Python获取就行. 暂时只是爬取到数据、未进行图片可视化操作、后期更新。 效果图: 代码如下: ''' ……
<<上一篇
下一篇>>