python - pythoh3 下 ’<abc>’ 遇到這樣的html轉義符如何自動轉義呢?
問題描述
初學python,在使用scray 爬蟲時,遇到html的特殊字符,于是百度搜看了下文檔:
import HTMLParser html_parser = HTMLParser.HTMLParser() s = ’&l t;abc&g t;&nbs p;’ #避免網頁轉義留了個空格s = html_parser.unescape(s)
運行時提示:import markupbaseImportError: No module named ’markupbase’
借助翻譯軟件,看HTMLParser官方文檔找了第二種方法
from html.parser import HTMLParser
class MyHTMLParser(HTMLParser):
def handle_data(self, data): print(data) return data
parser = MyHTMLParser()s = ’&l t;abc&g t;&nbs p;’ #避免網頁轉義留了個空格ss=parser.feed(s)
第二種方法測試成功,遇到的問題是,return data 這一句,返回數據是無效的?
請問,有沒有就幾句代碼解決轉義的,如果沒有第二種方法里如何才有返回值?
問題解答
回答1:from html.parser import HTMLParserhtml_parser = HTMLParser()s = ’<abc> ’txt = html_parser.unescape(s)print(txt)# 結果:<abc>
相關文章:
1. docker綁定了nginx端口 外部訪問不到2. git - webstorm窗口中左側列表的文件名顏色怎么修改3. android權限被第三方安全軟件禁止,如何獲取該權限狀態4. javascript - 最近用echarts做統計圖時遇到兩個問題!!5. docker images顯示的鏡像過多,狗眼被亮瞎了,怎么辦?6. javascript - 深夜被問題困擾求解惑,rn的API之PermissionsAndroidd的問題7. mysql - 我的myeclipse一直連顯示數據庫連接失敗,不知道為什么8. tp 6.0 數據查詢,求教!9. Discuz! Q 有人用過嗎?10. javascript - onclick事件點擊不起作用

網公網安備