文章詳情頁

python - pythoh3 下 ’<abc>’ 遇到這樣的html轉義符如何自動轉義呢？

瀏覽：182日期：2022-06-28 18:47:10

問題描述

初學python，在使用scray 爬蟲時，遇到html的特殊字符，于是百度搜看了下文檔：

import HTMLParser html_parser = HTMLParser.HTMLParser() s = ’&l t;abc&g t;&nbs p;’ #避免網頁轉義留了個空格s = html_parser.unescape(s)

運行時提示：import markupbaseImportError: No module named ’markupbase’

借助翻譯軟件，看HTMLParser官方文檔找了第二種方法

from html.parser import HTMLParser

class MyHTMLParser(HTMLParser):

def handle_data(self, data): print(data) return data

parser = MyHTMLParser()s = ’&l t;abc&g t;&nbs p;’ #避免網頁轉義留了個空格ss=parser.feed(s)

第二種方法測試成功，遇到的問題是，return data 這一句，返回數據是無效的？

請問，有沒有就幾句代碼解決轉義的，如果沒有第二種方法里如何才有返回值？

問題解答

回答1：

from html.parser import HTMLParserhtml_parser = HTMLParser()s = ’<abc> ’txt = html_parser.unescape(s)print(txt)# 結果：<abc>

Python 編程

上一條：python - Django中如何使用異步下一條：python - ubuntu16.04 lxml的報錯

相關文章：

1. docker鏡像push報錯2. 關docker hub上有些鏡像的tag被標記““This image has vulnerabilities””3. html5 - datatables 加載不出來數據。4. Docker for Mac 創建的dnsmasq容器連不上/不工作的問題5. node.js - mongodb查找子對象的名稱為某個值的對象的方法6. docker 下面創建的IMAGE 他們的 ID 一樣？這個是怎么回事？？？？7. 運行python程序時出現“應用程序發生異常”的內存錯誤？8. html5和Flash對抗是什么情況？9. 測試自動化html元素選擇器元素ID或DataAttribute [關閉]10. 前端 - @media query 使用出現的問題？

排行榜

					
					Docker for Mac 創建的dnsmasq容器連不上/不工作的問題
html5 - datatables 加載不出來數據。
關docker hub上有些鏡像的tag被標記““This image has vulnerabilities””
docker鏡像push報錯
node.js - mongodb查找子對象的名稱為某個值的對象的方法
運行python程序時出現“應用程序發生異常”的內存錯誤？
javascript - QQ第三方登錄的問題
前端 - @media query 使用出現的問題？
javascript - 在 model里定義的 引用表模型時，model為undefined。
測試自動化html元素選擇器元素ID或DataAttribute [關閉]
利用IPMI遠程安裝centos報錯！
				

熱門標簽

午夜剧场伦理_日本一道高清_国产又黄又硬_91黄色网战_女同久久另类69精品国产_妹妹的朋友在线

python - pythoh3 下 ’&lt;abc&gt;’ 遇到這樣的html轉義符如何自動轉義呢？

python - pythoh3 下 ’<abc>’ 遇到這樣的html轉義符如何自動轉義呢？