第一句子网 - 唯美句子、句子迷、好句子大全
第一句子网 > python xpath提取td标签_Python Xpath 提取html整个元素(标签与内容)

python xpath提取td标签_Python Xpath 提取html整个元素(标签与内容)

时间:2023-12-05 06:25:38

相关推荐

python xpath提取td标签_Python Xpath 提取html整个元素(标签与内容)

提取html某标签中文字时,文字中含有:“2O5”,导致提取的文字不符合预期。

解决方法:

#coding=utf-8

from lxml import etree

from HTMLParser import HTMLParser

html = u'''

退火对Nb2O5薄膜的折射率和厚度的影响

'''

tree = etree.HTML(html)

# 结果为:退火对Nb

content1 = tree.xpath("//span[@id='chTitle']/text()")[0]

print content1

# 结果为:退火对Nb2O5薄膜的折射率和厚度的影响

table = tree.xpath("//span[@id='chTitle']")[0]

content2 = etree.tostring(table, method='html')

print HTMLParser().unescape(content2)[19:-8]

来源:/zhangtianyuan/p/8297117.html

本内容不代表本网观点和政治立场,如有侵犯你的权益请联系我们处理。
网友评论
网友评论仅供其表达个人看法,并不表明网站立场。