日韩久久久精品,亚洲精品久久久久久久久久久,亚洲欧美一区二区三区国产精品 ,一区二区福利

python爬蟲 編碼問題

系統 1767 0

一、往文件中寫入數據

往TXT文件寫入的時候報錯? 'gbk' codec can't encode character '\xXX' in position XX

打開文件時,增加一個選項:

            
              def wirteFile(content):
    path = os.getcwd()
    a_path = os.path.join(path, "content.txt")
    f = open(a_path, "w+", encoding="utf-8")
    f.write(content)
    f.close()
            
          

open()中添加編碼類型

?

二、lxml etree 顯示爬取的內容時,中文亂碼

            
              session = requests.Session()                                                             
res = session.get('https://seat.lib.whu.edu.cn/login?targetUri=%2F', headers = headers)  
html = etree.HTML(res.text)  # 轉換成element對象,構建成xpath解析對象                                 
result = etree.tostring(html, encoding='utf-8')  # bytes類型 這里需要增加編碼方式                               
print(result.decode("UTF-8"))                                                            
            
          

?


更多文章、技術交流、商務合作、聯系博主

微信掃碼或搜索:z360901061

微信掃一掃加我為好友

QQ號聯系: 360901061

您的支持是博主寫作最大的動力,如果您喜歡我的文章,感覺我的文章對您有幫助,請用微信掃描下面二維碼支持博主2元、5元、10元、20元等您想捐的金額吧,狠狠點擊下面給點支持吧,站長非常感激您!手機微信長按不能支付解決辦法:請將微信支付二維碼保存到相冊,切換到微信,然后點擊微信右上角掃一掃功能,選擇支付二維碼完成支付。

【本文對您有幫助就好】

您的支持是博主寫作最大的動力,如果您喜歡我的文章,感覺我的文章對您有幫助,請用微信掃描上面二維碼支持博主2元、5元、10元、自定義金額等您想捐的金額吧,站長會非常 感謝您的哦!??!

發表我的評論
最新評論 總共0條評論
主站蜘蛛池模板: 东辽县| 尉氏县| 华蓥市| 曲阳县| 绿春县| 通辽市| 吉林省| 安庆市| 清徐县| 西和县| 孟津县| 盘山县| 揭阳市| 克什克腾旗| 黄山市| 迭部县| 社会| 深州市| 剑川县| 邢台市| 吉首市| 镇原县| 文登市| 金堂县| 阆中市| 中西区| 石景山区| 章丘市| 龙海市| 响水县| 白山市| 唐山市| 都兰县| 岗巴县| 安阳市| 集贤县| 库车县| 永城市| 青龙| 嘉善县| 阿瓦提县|