BeautifulSoup4的使用-读取html文件的信息

📅 2026/8/27 11:35:45
BeautifulSoup4的使用-读取html文件的信息
1、 BeautifulSoup4python提供的用于解析HTML/XML文件、读取他们的数据内容的2、安装核验pip install BeautifulSoup4pip show BeautifulSoup4frombs4importBeautifulSoup html html head meta charsetUTF-8 title我是title01/title /head body p idtest01font size6 colorred我是body/font/p p idtest02font size8 colorgreen我是body/font/p a href/api.html接口测试/a a href/web.htmlWeb自动化测试/a a href/app.htmlAPP自动化测试/a h1一级标题/h1 /body /html soupBeautifulSoup(html,html.parser)#获取title的对象print(soup.title)#获取title对象title我是title01/title#获取title的名称print(soup.title.name)#获取title的标签名title#title的值print(soup.title.string)#获取title的值我是title01#获取标签p的对象,第一个匹配第一个p标签print(soup.p)#获取p标签的第一个#获取所有的p的对象,返回list列表print(soup.find_all(p))#获取所有p标签对象list表示print(soup.find_all(p)[0])#获取list第一个 p idtest01font colorred size6我是body/font/pprint(soup.p[id])#获取id属性值 test01print(-----)#一次打印所有p标签中的id值和p标签的文本内容foriinsoup.find_all(p):print(i[id],i.string)#test01 我是bodyprint(id{} text{}.format(i[id],i.string))#格式化idtest01 text我是body