文章詳情頁

python - pythoh3 下 ’<abc>’ 遇到這樣的html轉義符如何自動轉義呢？

瀏覽：69日期：2022-06-28 18:47:10

問題描述

初學python，在使用scray 爬蟲時，遇到html的特殊字符，于是百度搜看了下文檔：

import HTMLParser html_parser = HTMLParser.HTMLParser() s = ’&l t;abc&g t;&nbs p;’ #避免網頁轉義留了個空格s = html_parser.unescape(s)

運行時提示：import markupbaseImportError: No module named ’markupbase’

借助翻譯軟件，看HTMLParser官方文檔找了第二種方法

from html.parser import HTMLParser

class MyHTMLParser(HTMLParser):

def handle_data(self, data): print(data) return data

parser = MyHTMLParser()s = ’&l t;abc&g t;&nbs p;’ #避免網頁轉義留了個空格ss=parser.feed(s)

第二種方法測試成功，遇到的問題是，return data 這一句，返回數據是無效的？

請問，有沒有就幾句代碼解決轉義的，如果沒有第二種方法里如何才有返回值？

問題解答

回答1：

from html.parser import HTMLParserhtml_parser = HTMLParser()s = ’<abc> ’txt = html_parser.unescape(s)print(txt)# 結果：<abc>

Python 編程

上一條：python - Django中如何使用異步下一條：python - ubuntu16.04 lxml的報錯

相關文章：

1. objective-c - ios百度地圖定位問題2. html5 - 如何解決bootstrap打開模態modal窗口引起頁面抖動?3. javascript - 求助關于js正則問題4. javascript - node.js服務端渲染解疑5. javascript - 求助這種功能有什么好點的插件？6. html5 - rudy編譯sass的時候有中文報錯7. html - css 如何添加這種邊框?8. 為何 localStorage、sessionStorage 屬于html5的范疇，但是為何 IE8卻支持？9. 微信開放平臺 - Android調用微信分享不顯示10. javascript - 關于定時器與防止連續點擊問題

排行榜

					
					html5 - 如何解決bootstrap打開模態modal窗口引起頁面抖動?
angular.js - angularjs中如何實現單擊一個span標簽之后，拿到span標簽中的內容?
java - tomcat服務經常晚上會掛，求解？
初學 node.js，讀取本地html文件報錯
android - SDK24怎么下載？
objective-c - ios百度地圖定位問題
jquery - angularjs如何做出導航效果？
javascript - 求助關于js正則問題
javascript - 手機版網站導航條水平滑動減速效果是如何實現的
android - 離線地圖的這種列表該怎么實現？
angular.js - angularjs requirejs karma directive templateUrl 測試失敗（哎呦喂）
				

熱門標簽

成人在线亚洲_国产日韩视频一区二区三区_久久久国产精品_99国内精品久久久久久久

python - pythoh3 下 ’&lt;abc&gt;’ 遇到這樣的html轉義符如何自動轉義呢？

python - pythoh3 下 ’<abc>’ 遇到這樣的html轉義符如何自動轉義呢？