亚洲乱码中文字幕综合,中国熟女仑乱hd,亚洲精品乱拍国产一区二区三区,一本大道卡一卡二卡三乱码全集资源,又粗又黄又硬又爽的免费视频

Python爬蟲之批量下載喜馬拉雅音頻

 更新時(shí)間:2021年05月18日 11:34:14   作者:wangzirui32  
今天教大家如何利用Python爬蟲批量下載喜馬拉雅音頻,文中有非常詳細(xì)的代碼示例,對正在學(xué)習(xí)python的小伙伴們很有幫助,需要的朋友可以參考下

一、解析網(wǎng)站

1.1 獲取音頻地址

在喜馬拉雅網(wǎng)站上,隨便點(diǎn)開一個(gè)音頻,打開“開發(fā)者工具”,再點(diǎn)擊播放按鈕,可以看到出現(xiàn)了多個(gè)請求:

請求

經(jīng)過排查,發(fā)現(xiàn)可疑url:

網(wǎng)址

查看它的響應(yīng)信息,發(fā)現(xiàn)音頻地址就在里面:

音頻地址

接下來,解析這個(gè)返回音頻地址的url:

https://www.ximalaya.com/revision/play/v1/audio?id=348451879&ptype=1

發(fā)現(xiàn)url中的id參數(shù)就決定了返回的音頻地址,而id參數(shù)是音頻的id號。

1.2 解析專欄網(wǎng)頁

我們已經(jīng)知道了獲取音頻url的網(wǎng)址,接下來要獲取一個(gè)專欄內(nèi)的音頻id和名稱,打開一個(gè)專欄,發(fā)現(xiàn):

li標(biāo)簽

所有的音頻存放在class為1F_的li標(biāo)簽中,再來解析li標(biāo)簽:

解析

在li標(biāo)簽中的第一個(gè)a標(biāo)簽存儲著我們所有需要的數(shù)據(jù),妙~?。?/p>

1.3 整理億下思路

思路:

1.獲取專欄內(nèi)的li標(biāo)簽

2.獲取li標(biāo)簽里的第一個(gè)a標(biāo)簽

3.讀取a標(biāo)簽的title和href屬性

4.將href解析成音頻id

5.將id帶入url請求音頻源地址

6.提取音頻源地址

7.請求音頻源地址

8.保存音頻(文件名為a的title屬性)

思路整理完了,開始編寫代碼。

二、編寫爬取代碼

代碼奉上——

import requests
from fake_useragent import UserAgent as ua
from bs4 import BeautifulSoup as bs

# 專欄地址
music_list_url = 'https://www.ximalaya.com/ertongjiaoyu/19702607/'
# 獲取音頻地址的url
get_link_url = "https://www.ximalaya.com/revision/play/v1/audio"

# UA偽裝
headers = {
    "User-Agent": ua().random
}

# 參數(shù)
params = {
    "id": None,    # id先設(shè)為None
    "ptype": "1",
}

# 獲取專欄HTML源碼
music_list_r = requests.get(music_list_url, headers=headers)
# 解析 獲取所有l(wèi)i標(biāo)簽
soup = bs(music_list_r.text, "lxml")
li = soup.find_all("li", {"class": "lF_"})

# for循序遍歷處理
for i in li:
    a = i.find("a")   # 找到a標(biāo)簽
    # 獲取href屬性
    # split("/")將字符串以"/"作為分隔符 從右往左數(shù)第一項(xiàng)是id號
    music_id = a.get("href").split("/")[-1]
    # 獲取title屬性 和“.m4a”拼接成文件名
    music_name = a.get("title") + ".m4a"

	# 修改請求參數(shù)id
    params['id'] = music_id

	# 獲得音頻源地址
    r = requests.get(get_link_url, headers=headers, params=params)
    link = r.json()['data']['src']

	# 獲取音頻文件并保存
    music_file = requests.get(link).content
    with open(music_name, "wb") as f:
        f.write(music_file)

print("下載完畢!")

運(yùn)行代碼,等待億會(真的要等億會),可以看到當(dāng)前目錄下已經(jīng)出現(xiàn)了音頻文件,如圖:

音頻文件

到此這篇關(guān)于Python爬蟲之批量下載喜馬拉雅音頻的文章就介紹到這了,更多相關(guān)Python下載喜馬拉雅音頻內(nèi)容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家!

相關(guān)文章

  • 3個(gè)用于數(shù)據(jù)科學(xué)的頂級Python庫

    3個(gè)用于數(shù)據(jù)科學(xué)的頂級Python庫

    今天小編就為大家分享一篇關(guān)于3個(gè)用于數(shù)據(jù)科學(xué)的頂級Python庫,小編覺得內(nèi)容挺不錯的,現(xiàn)在分享給大家,具有很好的參考價(jià)值,需要的朋友一起跟隨小編來看看吧
    2018-09-09
  • 淺談Django+Gunicorn+Nginx部署之路

    淺談Django+Gunicorn+Nginx部署之路

    這篇文章主要介紹了Django+Gunicorn+Nginx部署之路,文中通過示例代碼介紹的非常詳細(xì),對大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)值,需要的朋友們下面隨著小編來一起學(xué)習(xí)學(xué)習(xí)吧
    2019-09-09
  • 如何使用Python進(jìn)行OCR識別圖片中的文字

    如何使用Python進(jìn)行OCR識別圖片中的文字

    這篇文章主要介紹了使用Python進(jìn)行OCR識別圖片中的文字 ,本文通過實(shí)例代碼加文字說明的形式給大家介紹的非常詳細(xì),具有一定的參考借鑒價(jià)值,需要的朋友可以參考下
    2019-04-04
  • Python全棧之協(xié)程詳解

    Python全棧之協(xié)程詳解

    這篇文章主要為大家介紹了Python全棧之協(xié)程,具有一定的參考價(jià)值,感興趣的小伙伴們可以參考一下,希望能夠給你帶來幫助
    2021-12-12
  • YOLOv8訓(xùn)練自己的數(shù)據(jù)集(詳細(xì)教程)

    YOLOv8訓(xùn)練自己的數(shù)據(jù)集(詳細(xì)教程)

    YOLO是一種基于圖像全局信息進(jìn)行預(yù)測的目標(biāo)檢測系統(tǒng),YOLOv8 是ultralytics公司在2023年1月10號開源的YOLOv5的下一個(gè)重大更新版本,這篇文章主要給大家介紹了關(guān)于YOLOv8訓(xùn)練自己的數(shù)據(jù)集的相關(guān)資料,需要的朋友可以參考下
    2023-01-01
  • Python腳本開發(fā)漏洞的批量搜索與利用(GlassFish?任意文件讀取)

    Python腳本開發(fā)漏洞的批量搜索與利用(GlassFish?任意文件讀取)

    這篇文章主要介紹了Python?開發(fā)漏洞的批量搜索與利用(GlassFish?任意文件讀取),主要包括python開發(fā)學(xué)習(xí)的意義及測試漏洞是否存在的步驟,需要的朋友可以參考下
    2022-05-05
  • 初識Pytorch使用transforms的代碼

    初識Pytorch使用transforms的代碼

    tansforms功能類似于在計(jì)算機(jī)視覺流程里的圖像預(yù)處理部分的數(shù)據(jù)增強(qiáng),接下來通過代碼介紹下Pytorch使用transforms的詳細(xì)過程,感興趣的朋友一起看看吧
    2021-12-12
  • Python列表切片操作實(shí)例探究(提取復(fù)制反轉(zhuǎn))

    Python列表切片操作實(shí)例探究(提取復(fù)制反轉(zhuǎn))

    在Python中,列表切片是處理列表數(shù)據(jù)非常強(qiáng)大且靈活的方法,本文將全面探討Python中列表切片的多種用法,包括提取子列表、復(fù)制列表、反轉(zhuǎn)列表等操作,結(jié)合豐富的示例代碼進(jìn)行詳細(xì)講解
    2024-01-01
  • Python調(diào)用Tkinter示例淺析

    Python調(diào)用Tkinter示例淺析

    這篇文章主要介紹了Python調(diào)用Tkinter示例,通過在Python程序中設(shè)計(jì)按鈕,可以方便用戶調(diào)用Python程序,從而達(dá)到快速、自動化、高效的目的,提高用戶體驗(yàn)和工作效率
    2023-02-02
  • Python批量重命名同一文件夾下文件的方法

    Python批量重命名同一文件夾下文件的方法

    這篇文章主要介紹了Python批量重命名同一文件夾下文件的方法,涉及Python使用os模塊操作文件的相關(guān)技巧,需要的朋友可以參考下
    2015-05-05

最新評論