报错'gb2312' codec can't decode byte 0x9e in position 4100: illegal multibyte sequence,“gb2312”编解码器无法解码位置4100中的字节0x9e:非法的多字节序列

“gb2312”编解码器无法解码位置4100中的字节0x9e:非法的多字节序列。

处理方式: with open(path, encoding="utf8", errors='ignore') as f:

使用errors='ignore'去掉(忽略)字符并返回不带字符的字符串。

点赞
收藏

评论区

加载中...

相关推荐

Python中文转换报错 'ascii' codec can't decode byte 0xe8 in position

 脚本报错:!(https://oscimg.oschina.net/oscnet/5b8eaa4be291c9583f3fac05a59733caabf.png)脚本代码:!(https://oscimg.oschina.net/oscnet/3bbeff251f60674ece9d67de1e68463fbb1.png)报错原因:

Python Challenge Level 18

初学Python,挑战一下流行的PythonChallenge,很不幸,卡在了18关~~被字符字节码之间的转换搞得焦头烂额,不过终于搞定了还是很happy的~~~主要的问题就是16进制形式的字符如何转成字节码(注意:不是encoding)如:\'89','50','4e','47','0d','0a','1a','0a','00

Django基础介绍

Djangoweb应用的本质socket网络编程:​架构:C/S架构​协议:TCP/UDP协议​传输层web应用:​架构:B/S架构​协议:Http协议​应用层字符串转字节:bytes('hfihajfaiuu',encoding'utf8')字节转字符串:str(res,

Node.js 12中的ES模块[每日前端夜话0x9E]

每日前端夜话0x9E每日前端夜话,陪你聊前端。每天晚上18:00准时推送。正文共:2552字预计阅读时间:10 分钟作者:BrianDeSousa翻译:疯狂的技术宅来源:logrocket!(https://oscimg.oschina.net/oscnet/2ccaf94cecd3

PHP 截取字符串

1.截取GB2312中文字符串<?php//截取中文字符串functionmysubstr($str,$start,$len){$tmpstr"";$strlen$start$len;for($i0;

PHP检测当前字符编码并转码

一、检测当前字符串编码并将编码改为utf81获取当前字符串的编码$encodemb\_detect\_encoding($str,array("ASCII",'UTF8',"GB2312","GBK",'BIG5')); 2将字符编码改为utf8$str\_encodemb\_convert\_encoding($st