午夜剧场伦理_日本一道高清_国产又黄又硬_91黄色网战_女同久久另类69精品国产_妹妹的朋友在线

您的位置:首頁技術文章
文章詳情頁

python - pythoh3 下 ’<abc>’ 遇到這樣的html轉義符如何自動轉義呢?

瀏覽:182日期:2022-06-28 18:47:10

問題描述

初學python,在使用scray 爬蟲時,遇到html的特殊字符,于是百度搜看了下文檔:

import HTMLParser html_parser = HTMLParser.HTMLParser() s = ’&l t;abc&g t;&nbs p;’ #避免網頁轉義留了個空格s = html_parser.unescape(s)

運行時提示:import markupbaseImportError: No module named ’markupbase’

借助翻譯軟件,看HTMLParser官方文檔找了第二種方法

from html.parser import HTMLParser

class MyHTMLParser(HTMLParser):

def handle_data(self, data): print(data) return data

parser = MyHTMLParser()s = ’&l t;abc&g t;&nbs p;’ #避免網頁轉義留了個空格ss=parser.feed(s)

第二種方法測試成功,遇到的問題是,return data 這一句,返回數據是無效的?

請問,有沒有就幾句代碼解決轉義的,如果沒有第二種方法里如何才有返回值?

問題解答

回答1:

from html.parser import HTMLParserhtml_parser = HTMLParser()s = ’&lt;abc&gt;&nbsp;’txt = html_parser.unescape(s)print(txt)# 結果:<abc>

標簽: Python 編程
相關文章:
主站蜘蛛池模板: 欧美精品久 | 久久久久a| 欧美一区二区三区在线播放 | 久久伊人精品 | 久久久美女视频 | 综合网久久 | 亚洲欧美国产精品久久久久久久 | 特级黄色网 | 欧美多人猛交狂配 | 亚洲人体视频 | 国产一区二区视频在线观看 | 四虎影院在线观看免费 | 日韩欧美毛片 | 国产欧美中文字幕 | 精品人人爽 | 国产日韩免费视频 | 成人国产免费视频 | 黄色一级片网站 | 午夜性福利视频 | 国产精品久久久久久99 | 中文字幕专区 | 午夜影院0606 | 国产一级片a | 免费黄色欧美 | 精品国产精品国产偷麻豆 | 欧美日一本 | 亚洲精品一级片 | 欧美国产另类 | 妇女毛片| 五月婷婷丁香 | 特级特黄aaaa免费看 | 在线观看亚洲大片短视频 | 亚洲欧美日本一区 | 日本美女毛片 | 草草影院国产第一页 | 亚洲欧美日韩一区 | 亚洲色图av在线 | 久久国产免费 | www性 | 一本一本久久a久久精品牛牛影视 | 91精品国产综合久久久久久久 |