

转为TEXT文本
from lxml import etree
wb_data = open('KeePass - Browser.html','r', encoding='utf-8').read() #str(in unicode)dd
html = etree.HTML(wb_data)
elements = html.xpath('//tr')
elements.pop(0)
out = open('KeePass - Browser.txt', 'w', encoding='utf-8')
for i in elements:
Title = i.xpath('td[1]')[0].text; print(Title)
UserName = i.xpath('td[2]')[0].text; print(UserName)
Password = i.xpath('td[3]')[0].xpath('code')[0].text; print(Password)
Notes = i.xpath('td[4]')[0].text; print(Notes)
out.write('\n\n====<' + Title + '>====\n' + UserName + '\n' + Password + '\n' + Notes)
out.close()
本文介绍了一种使用Python的lxml库从HTML文件中抓取数据并将其转换为文本文件的方法。具体步骤包括读取HTML文件、解析HTML结构、提取表格中的数据,并将这些数据写入TXT文本文件。


被折叠的 条评论
为什么被折叠?



