python中如何获得html中变量使用unicode编码方式存储的数据

小可_乐 2016-01-19 04:57:11
最近在使用 requests+BeautifulSoup 进行爬虫,但遇到了类似这样的存储方式{"COMPNAME":"\u9e3f\u946b"
在使用 正则re.compile(r'\\u.+?"', re.UNICODE) 获取后, 结果变成了 '\\u9e3f\\u946b' 导致我无法正确解析.
请问 我如何才能正确的得到 '\u9e3f\u946b'(鸿鑫) 的结果?
http://www.sanban18.com/stock/835574/profile.html 的931行
...全文
284 5 打赏 收藏 举报
写回复
用AI写文章
5 条回复
切换为时间正序
请发表友善的回复…
发表回复
coderCold 2016-01-26
  • 打赏
  • 举报
回复
嗯,再补充一下: a = "\\u9e3f\\u946b" b = a.decode('unicode-escape') print repr(b), b 结果如下: u'\u9e3f\u946b' 鸿鑫
coderCold 2016-01-26
  • 打赏
  • 举报
回复
你问的问题是什么我不清楚,但是打印\\u9e3f\\u946b这个的话 print u"\u9e3f\u946b" 这样就可以了啊
小可_乐 2016-01-25
  • 打赏
  • 举报
回复
没人 遇到过这种问题吗? 比如 如何 打印 \\u9e3f\\u946b 的 值?
小可_乐 2016-01-22
  • 打赏
  • 举报
回复
利用 beatifullsoap ,是无法直接找到用js定义的方法的~
ppchaos 2016-01-20
  • 打赏
  • 举报
回复
beatifullsoap

37,737

社区成员

发帖
与我相关
我的任务
社区描述
JavaScript,VBScript,AngleScript,ActionScript,Shell,Perl,Ruby,Lua,Tcl,Scala,MaxScript 等脚本语言交流。
社区管理员
  • 脚本语言(Perl/Python)社区
  • WuKongSecurity@BOB
加入社区
  • 近7日
  • 近30日
  • 至今

试试用AI创作助手写篇文章吧