美丽的汤-从<ul>中的所有<li>元素获取文本

问题描述

使用以下代码：

match_url = f'https://interativos.globoesporte.globo.com/cartola-fc/mais-escalados/mais-escalados-do-cartola-fc'

browser.visit(match_url)
browser.find_by_tag('li[class="historico-rodadas__rodada historico-rodadas__rodada--ativa"]').click()

soup = BeautifulSoup(browser.html,'html.parser')
innerContent = soup.findAll('ul',class_="field__players")

print (innerContent)

我设法获取了<ul>：

[<ul class="field__players"><li class="player"...]

现在如何为列表中的所有玩家访问player__name和player__value的文本？

解决方法

这对您有帮助：

from selenium import webdriver
from bs4 import BeautifulSoup

driver = webdriver.Chrome()

driver.get('https://interativos.globoesporte.globo.com/cartola-fc/mais-escalados/mais-escalados-do-cartola-fc')

src = driver.page_source

driver.close()

soup = BeautifulSoup(src,'html5lib')

innerContent = soup.find('ul',class_="field__players")

li_items = innerContent.find_all('li')

for li in li_items:
    p_tags = li.find_all('p')[:-1] #The [:-1] removes the last p tag from the list,which is player__label

    for p in p_tags:
        print(p.text)

输出：

Keno
2.868.755
Pedro
2.483.069
Bruno Henrique
1.686.894
Hugo Souza
809.186
Guilherme Arana
1.314.769
Filipe Luís
776.147
Thiago Galhardo
2.696.853
Vinícius
1.405.012
Nenê
1.369.209
Jorge Sampaoli
1.255.731
Réver
1.505.522
Víctor Cuesta
1.220.451

我应该把它放在这里告诉你他想要什么。

@State

beautifulsoup beautifulsoup selenium selenium splinter

美丽的汤-从<ul>中的所有<li>元素获取文本

问题描述

解决方法

相关问答