python json,python requests網頁爬取初探

 2023-11-12 阅读 28 评论 0

摘要:python開發過程中,有時候需要網頁的數據,這時用到網頁爬蟲模塊,減少重復性工作,python提供了requests 模塊,urllib2模塊,beautifulsoup bs4模塊。 軟件開發中能夠用腳本代替的工作盡量用腳本代替,我們專注于業務本身就好。

python開發過程中,有時候需要網頁的數據,這時用到網頁爬蟲模塊,減少重復性工作,python提供了requests 模塊,urllib2模塊,beautifulsoup bs4模塊。

軟件開發中能夠用腳本代替的工作盡量用腳本代替,我們專注于業務本身就好。

今天試了一下request模塊,Demo功能是下載網頁財經的年報,代碼如下:

import requests
import urllibnb_url='http://file.finance.sina.com.cn/211.154.219.97:9494/MRGG/CNSESH_STOCK/2020/2020-3/2020-03-23/5955888.PDF' ##這個鏈接需要在網站爬取,我直接找copy過來的down_res=requests.get(nb_url)
with open(r'E:\test.PDF',"wb") as code:code.write(down_res.content)

python json、挺方便的,以后要什么數據,爬到鏈接就可以下載到本地了

版权声明:本站所有资料均为网友推荐收集整理而来,仅供学习和研究交流使用。

原文链接:https://hbdhgg.com/4/172466.html

发表评论:

本站为非赢利网站,部分文章来源或改编自互联网及其他公众平台,主要目的在于分享信息,版权归原作者所有,内容仅供读者参考,如有侵权请联系我们删除!

Copyright © 2022 匯編語言學習筆記 Inc. 保留所有权利。

底部版权信息