Python request中文亂碼問題解決方案
Python request獲取網(wǎng)頁中文亂碼問題
r = requests.get(“http://www.baidu.com“)
**r.text返回的是Unicode型的數(shù)據(jù)。
使用r.content返回的是bytes型的數(shù)據(jù)。
也就是說,如果你想取文本,可以通過r.text。
如果想取圖片,文件,則可以通過r.content。**
方法1:使用r.text
Requests 會自動解碼來自服務(wù)器的內(nèi)容。大多數(shù) unicode 字符集都能被無縫地解碼。請求發(fā)出后,Requests 會基于 HTTP 頭部對響應(yīng)的編碼作出有根據(jù)的推測。當(dāng)你訪問 r.text 之時,Requests 會使用其推測的文本編碼。你可以找出 Requests 使用了什么編碼,并且能夠使用 r.encoding 屬性來改變它.
但是Requests庫的自身編碼為: r.encoding = ‘ISO-8859-1'
可以 r.encoding 修改編碼
url='http://music.baidu.com'
r=requests.get(url)
r.encoding='utf-8'
print(r.text)
方法2:使用r.content
使用r.content,得到的是bytes型,再轉(zhuǎn)為str
url='http://music.baidu.com'
r = requests.get(url)
html=r.content
html_doc=str(html,'utf-8') #html_doc=html.decode("utf-8","ignore")
print(html_doc)
以上就是本文的全部內(nèi)容,希望對大家的學(xué)習(xí)有所幫助,也希望大家多多支持腳本之家。
相關(guān)文章
Python實現(xiàn)二分法查找及優(yōu)化的示例詳解
二分查找法(Binary?Search)是一種在有序數(shù)組中查找某一特定元素的算法,在本文中,我們將使用?Python?實現(xiàn)二分查找算法,并深入探討算法的原理和實現(xiàn)細(xì)節(jié),感興趣的可以了解一下2023-04-04python 阿里云oss實現(xiàn)直傳簽名與回調(diào)驗證的示例方法
這篇文章主要介紹了python 阿里云oss實現(xiàn)直傳簽名與回調(diào)驗證,文中通過示例代碼介紹的非常詳細(xì),對大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價值,需要的朋友們下面隨著小編來一起學(xué)習(xí)學(xué)習(xí)吧2021-03-03使用Python中的reduce()函數(shù)求積的實例
今天小編就為大家分享一篇使用Python中的reduce()函數(shù)求積的實例,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧2019-06-06Python實現(xiàn)文件信息進(jìn)行合并實例代碼
這篇文章主要介紹了Python實現(xiàn)文件信息進(jìn)行合并實例代碼,具有一定借鑒價值,需要的朋友可以參考下2018-01-01