解決問題:UnicodeDecodeError utf-8 codec cant decode byte 0xb5 in position 116:

原創

2020-06-10 17:44

爬取的中文編碼格式不是UTF-8,無法正常顯示，查看編碼格式：

編碼格式爲ISO-8859-1（長見識啦~）
在使用urllib獲取reqest的response的時候，還要進行解碼。

解決方法：

txt.decode('utf8', 'ignore')

報錯是沒有了　　但是抓取的漢字　還是亂碼

解決辦法來了:

＃文字亂碼
req.encoding = 'GB2312'  # 需要添加這一行，告知html文件解碼方式 多種解析方式UTF-8 GB2312 ISO-8859-1 req.raise_for_status() html = req.text bf = BeautifulSoup(html)

發表評論

所有評論

還沒有人評論，想成為第一個評論的人麼? 請在上方評論欄輸入並且點擊發布.

10分鐘搞定Mysql主從部署配置

流程 Master數據庫安裝 Slave數據庫安裝配置Master數據庫配置Slave數據庫網絡信息 Master數據庫IP：192.168.198.133 Slave數據庫IP：192.168.198.132 配置Maste

zer0black

2024-05-17 14:31:12

無法AC，關於使用fgets碰到的問題——末尾多一個換行符

題目是輸入一串字符串，包含空格，裏面有多個單詞，將每個單詞翻轉輸出，並且單詞之間的空格要與原文一致。寫的時候沒有使用string的輸入，而是選擇了char數組的輸入。樣例測試hello world->olleh dlrow是沒有問題的，

Danlis

2024-05-17 14:30:52

lightdb秒級增加列和刪除列（not null帶默認值）

　　對數據量過億的大表而言，dba最頭疼的是隨着業務變化增加帶默認值的字段，以及修改字段的數據類型，在實現不好的數據庫中，動不動執行半天，中途失敗的話，還會卡半天。這在lightdb中是不會發生的。如下所示： lightdb@oradb=

zhjh256

2024-05-17 14:28:42

lightdb mysql 8.0兼容之不可見主鍵

　　數據庫設計通常需要滿足一定的範式要求，其中主鍵更是最基本的要求。不過，數據庫管理系統卻允許我們創建沒有主鍵的表。這樣的表在數據庫中會帶來查詢性能低下、複製延遲甚至無法實現高可用配置等問題。　　爲此，lightdb在22.1版本引入了一

zhjh256

2024-05-17 14:28:42

lightdb數據庫超時相關控制參數

　　在業務開發中，通常因爲代碼不規範、中間件缺陷、DBA誤提交批量SQL等原因，會導致服務端連接一直存在、但是實際上並未在執行的情況，從而導致數據庫連接泄露。爲了防止這種異常情況積壓，lightdb中包含了多個參數用於控制超時相關的行爲：

zhjh256

2024-05-17 14:28:42

如何使用 JS 判斷用戶是否處於活躍狀態

有時候，我們需要在網頁判斷用戶是否處與非活躍狀態，如果用戶長時間沒有在頁面上進行任何操作，我們則判定該用戶是非活躍的。在 javascript 中我們可以通過監聽某些鼠標或鍵盤相關的事件來判定用戶是否在活躍中。案例演示在線演示 - 使

劉漢貴

2024-05-17 14:26:51

使用 JS 實現在瀏覽器控制檯打印圖片 console.image()

在前端開發過程中，調試的時候，我門會使用 console.log 等方式查看數據。但對於圖片來說，僅靠展示的數據與結構，是無法想象出圖片最終呈現的樣子的。雖然我們可以把圖片數據通過 img 標籤展示到頁面上，或將圖片下載下來進行預覽。但這

劉漢貴

2024-05-17 14:26:51

基於Ubuntu-22.04安裝K8s-v1.28.2實驗（四）使用域名訪問網站應用

安裝負載均衡metalb 安裝metalb kubectl create namespace metallb-system 配置metalb #kubectl create secret generic -n metallb-system

hiningrise

2024-05-17 14:25:27

Flink的State

有狀態的計算是流式計算框架的一個重要功能，很多複雜的計算場景都需要記錄一下相關的狀態。Flink State一種爲了滿足算子計算時需要歷史數據需求的，使用 checkpoint 機制進行容錯，存儲在 state backend 的數

人不瘋狂枉一生

2024-05-17 14:23:00

ASP.NET Core Web中使用AutoMapper進行對象映射

前言在日常開發中，我們常常需要將一個對象映射到另一個對象，這個過程中可能需要編寫大量的重複性代碼，如果每次都手動編寫，不僅會影響開發效率，而且當項目越來越複雜、龐大的時候還容易出現錯誤。爲了解決這個問題，對象映射庫就隨之而出了，這些庫可以

追逐時光

2024-05-17 14:22:00

第四節：MySQL主從集羣搭建、擴容與數據遷移、半同步複製詳解

一. 二. 三. ! 作者 : Yaopengfei(姚鵬飛) 博客地址 : http://www.cnblogs.com

Yaopengfei

2024-05-17 14:21:40

RDLC降低使用內存

在Winform使用RDLC時，在批量打印情況下，內存隨着打印任務的數量逐漸增加。即便手動GC效果也不明顯。原因： localReport在創建時，每個實例都是一個應用程序域。租約的過期時間比較久，按照網上的資料，過期時間大約10分鐘左右

煙臺西炮臺

2024-05-17 14:21:20

❤️‍🔥 Solon Cloud Event 新的事務特性與應用

1、Solon Cloud Event？是 Solon 分佈式事件總線的解決方案。也是 Solon “最終一致性”分佈式事務的解決方案之一 2、事務特性事務？就是要求 Event 有原子性，當多個 Event 發佈時，要麼全成功，要麼

劉之西東

2024-05-17 14:21:09

AI-FastGPT安裝

最近開始體驗FastGPT知識庫問答系統，參考官方文檔，在自己的阿里雲服務器使用Docker Compose快速完成了部署。環境說明：阿里雲ECS，2核8G，X86架構，CentOS 7.9操作系統。 Docker與Docker-Com

2018

2024-05-17 14:14:58

matlab練習程序（線性常微分方程組矩陣解）

之前有通過ode和simulink解線性常微分方程組。除了上面兩種方法，線性常微分方程組還可以通過矩陣的方法求解。比如下面這個之前使用的方程組： x'' = x' - x + y' -z' y'' = y' - y - x' z'' =

Dsp Tian

2024-05-17 14:11:07

24小時熱門文章

通過HPA+CronHPA組合應對業務複雜彈性伸縮場景

解決問題:UnicodeDecodeError utf-8 codec cant decode byte 0xb5 in position 116:

通過HPA+CronHPA組合應對業務複雜彈性伸縮場景

Pytorch 損失函數之nn.CrossEntropyLoss()、nn.NLLLoss()、 nn.LogSoftmax()

Ubuntu18.04 安裝Matlab完成後License checkout failed Licensing error: -8,523.

numpy.ndarray 在求某個類別的mean，max，min的時候如何忽略跳過nan值，使用np.nanmean, np.nanmax

（牛客網刷題筆記：一）　Python數據結構之鏈表（linked list）

語義分割【論文解讀】新思路：幾何感知蒸餾 CVPR-2019

https://yachay.unat.edu.pe/blog/index.php?comment_area=format_blog&comment_component=blog&comment_co

linux以太網驅動總結