py爬取的html中文乱码 py爬取的html中文乱码

今天从美剧天堂爬取网页时，中文出现乱码，从网站代码看是Charest=gb2312，所以对爬取的html进行处理。
【py爬取的html中文乱码】html = unicode(html, "gb2312").encode("utf8")可得到正常的中文编码。

py爬取的html中文乱码