import urllib import lxml.html down='http://blog.sina.com.cn/s/blog_71f3890901017hof.html' file=urllib.urlopen(down).read() root=lxml.html.document_fromstring(file) body=root.xpath('//div[@class="articalContent "]')[0] print body.text_content()
解决方法
使用
html = lxml.html.tostring(node)
并请:先阅读您正在使用的工具的基本文档.