嘗試使用 BeautifulSoup 在 Python 中獲取 span 的內容

Question

from bs4 import BeautifulSoup

url = 'C:\\Users\\Zandrio\\Documents\\Python-Selexion\\HTML-localhost\\Selexion.html'

page = open(url)
soup = BeautifulSoup(page.read(), features="lxml")
prettify = soup.prettify
Model = "".join([div.text for div in soup.find_all('div', {'class' : 'title-options'})])
print(Model)

輸出：

PS C:\Users\Zandrio> & C:/Users/Zandrio/AppData/Local/Programs/Python/Python38/python.exe c:/Users/Zandrio/Documents/Requests/selexion.py

                                        SQQE55Q90R

                    Merk:
                    Samsung                  Afdrukken

HTML：

<div class="title-options">
<span>
 SQQE55Q90R
</span>
<span>
  Merk: Samsung                
</span>
<span class="print"> <a href="/nl/pr/samsung-qled-qe55q90r/product-sheet" class="product-file-pdf" target="_blank" title="Afdrukken">Afdrukken</a>
</span>
</div>

在這種情況下，我只想要型號，這里是 SQQE55Q90R。 請提出任何解決方案。

Answer 1

from bs4 import BeautifulSoup
url = 'C:\\Users\\Zandrio\\Documents\\Python-Selexion\\HTML-localhost\\Selexion.html'

page = open(url)
soup = BeautifulSoup(page.read(), features="lxml")
div = soup.body.find('div', attrs={'class': 'title-options'})
model_number = div.span.text.strip()  # text of first span

print(model_number)

Answer 2

from bs4 import BeautifulSoup

path = 'C:\\Users\\Zandrio\\Documents\\Python-Selexion\\HTML-localhost\\Selexion.html'

with open(path) as f:
    content = f.read()
soup = BeautifulSoup(content, 'html.parser')

divs = soup.find_all('div', {'class':'title-options'})
for div in divs:
    spans = div.find_all('span')
    sp1, sp2, sp3 = spans
    print(sp1.text.strip())
    print(sp1.text.strip())
    print(sp1.text.strip())

嘗試使用 BeautifulSoup 在 Python 中獲取 span 的內容

問題描述

2 個解決方案

解決方案1
1 已采納 2020-02-26 05:37:36

解決方案2
0 2020-02-26 05:47:55

嘗試使用 BeautifulSoup 在 Python 中獲取 span 的內容

問題描述

2 個解決方案

解決方案1 1 已采納 2020-02-26 05:37:36

解決方案2 0 2020-02-26 05:47:55

解決方案1
1 已采納 2020-02-26 05:37:36

解決方案2
0 2020-02-26 05:47:55