激情久久久_欧美视频区_成人av免费_不卡视频一二三区_欧美精品在欧美一区二区少妇_欧美一区二区三区的

腳本之家,腳本語言編程技術(shù)及教程分享平臺(tái)!
分類導(dǎo)航

Python|VBS|Ruby|Lua|perl|VBA|Golang|PowerShell|Erlang|autoit|Dos|bat|

服務(wù)器之家 - 腳本之家 - Python - Python爬蟲之批量下載喜馬拉雅音頻

Python爬蟲之批量下載喜馬拉雅音頻

2021-11-04 10:00wangzirui32 Python

今天教大家如何利用Python爬蟲批量下載喜馬拉雅音頻,文中有非常詳細(xì)的代碼示例,對(duì)正在學(xué)習(xí)python的小伙伴們很有幫助,需要的朋友可以參考下

一、解析網(wǎng)站

1.1 獲取音頻地址

在喜馬拉雅網(wǎng)站上,隨便點(diǎn)開一個(gè)音頻,打開“開發(fā)者工具”,再點(diǎn)擊播放按鈕,可以看到出現(xiàn)了多個(gè)請(qǐng)求:

Python爬蟲之批量下載喜馬拉雅音頻

經(jīng)過排查,發(fā)現(xiàn)可疑url:

Python爬蟲之批量下載喜馬拉雅音頻

查看它的響應(yīng)信息,發(fā)現(xiàn)音頻地址就在里面:

Python爬蟲之批量下載喜馬拉雅音頻

接下來,解析這個(gè)返回音頻地址的url:

https://www.ximalaya.com/revision/play/v1/audio?id=348451879&ptype=1

發(fā)現(xiàn)url中的id參數(shù)就決定了返回的音頻地址,而id參數(shù)是音頻的id號(hào)。

1.2 解析專欄網(wǎng)頁(yè)

我們已經(jīng)知道了獲取音頻url的網(wǎng)址,接下來要獲取一個(gè)專欄內(nèi)的音頻id和名稱,打開一個(gè)專欄,發(fā)現(xiàn):

Python爬蟲之批量下載喜馬拉雅音頻

所有的音頻存放在class為1F_的li標(biāo)簽中,再來解析li標(biāo)簽:

Python爬蟲之批量下載喜馬拉雅音頻

在li標(biāo)簽中的第一個(gè)a標(biāo)簽存儲(chǔ)著我們所有需要的數(shù)據(jù),妙~?。?/p>

1.3 整理億下思路

思路:

1.獲取專欄內(nèi)的li標(biāo)簽

2.獲取li標(biāo)簽里的第一個(gè)a標(biāo)簽

3.讀取a標(biāo)簽的title和href屬性

4.將href解析成音頻id

5.將id帶入url請(qǐng)求音頻源地址

6.提取音頻源地址

7.請(qǐng)求音頻源地址

8.保存音頻(文件名為a的title屬性)

思路整理完了,開始編寫代碼。

二、編寫爬取代碼

代碼奉上――

import requests
from fake_useragent import UserAgent as ua
from bs4 import BeautifulSoup as bs

# 專欄地址
music_list_url = "https://www.ximalaya.com/ertongjiaoyu/19702607/"
# 獲取音頻地址的url
get_link_url = "https://www.ximalaya.com/revision/play/v1/audio"

# UA偽裝
headers = {
    "User-Agent": ua().random
}

# 參數(shù)
params = {
    "id": None,    # id先設(shè)為None
    "ptype": "1",
}

# 獲取專欄HTML源碼
music_list_r = requests.get(music_list_url, headers=headers)
# 解析 獲取所有l(wèi)i標(biāo)簽
soup = bs(music_list_r.text, "lxml")
li = soup.find_all("li", {"class": "lF_"})

# for循序遍歷處理
for i in li:
    a = i.find("a")   # 找到a標(biāo)簽
    # 獲取href屬性
    # split("/")將字符串以"/"作為分隔符 從右往左數(shù)第一項(xiàng)是id號(hào)
    music_id = a.get("href").split("/")[-1]
    # 獲取title屬性 和“.m4a”拼接成文件名
    music_name = a.get("title") + ".m4a"

	# 修改請(qǐng)求參數(shù)id
    params["id"] = music_id

	# 獲得音頻源地址
    r = requests.get(get_link_url, headers=headers, params=params)
    link = r.json()["data"]["src"]

	# 獲取音頻文件并保存
    music_file = requests.get(link).content
    with open(music_name, "wb") as f:
        f.write(music_file)

print("下載完畢!")

運(yùn)行代碼,等待億會(huì)(真的要等億會(huì)),可以看到當(dāng)前目錄下已經(jīng)出現(xiàn)了音頻文件,如圖:

Python爬蟲之批量下載喜馬拉雅音頻

到此這篇關(guān)于Python爬蟲之批量下載喜馬拉雅音頻的文章就介紹到這了,更多相關(guān)Python下載喜馬拉雅音頻內(nèi)容請(qǐng)搜索服務(wù)器之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持服務(wù)器之家!

原文鏈接:https://blog.csdn.net/wangzirui32/article/details/116888540

延伸 · 閱讀

精彩推薦
主站蜘蛛池模板: 色屁屁xxxxⅹ免费视频 | 国产欧美日韩视频在线观看 | 成年免费大片黄在线观看岛国 | 色淫影院| xnxx 日本19| 黑人一区二区三区四区五区 | 毛片在线视频免费观看 | 成人毛片在线免费观看 | 日韩黄色片免费看 | 精品国产乱码久久久久久久久 | 久久精品视频亚洲 | 黄色的视频免费看 | 成人免费一区二区三区在线观看 | 色就操 | 国产高清美女一级毛片 | 九九热精品在线 | 97中文字幕第一一一页 | 成人午夜网址 | 中文字幕综合 | 国产美女视频一区二区三区 | 欧美一级黄色录相 | 99精品视频在线免费观看 | 92看片淫黄大片欧美看国产片 | 色综合777| 宅男噜噜噜66国产免费观看 | 日本大片在线播放 | 国产一区二区视频观看 | 欧美性色生活片免费播放 | 婷婷久久青草热一区二区 | 精品一区二区三区日本 | 99久久久久国产精品免费 | xxxx hd video 69| 91成人一区| 欧美顶级毛片在线播放小说 | 91久久国产露脸精品国产护士 | 成人在线视频免费 | 欧美视频在线一区二区三区 | 99久久精品免费看国产四区 | 久久精品.com| 国人精品视频在线观看 | 日韩中文字幕一区二区三区 |