Aprenda Navegação em Documento HTML | Decodificando HTML com Beautiful Soup

Deslize para mostrar o menu

Após ler o documento HTML, é possível navegá-lo de diferentes maneiras. Para explorá-lo mais a fundo, especifique uma tag como um atributo. Por exemplo, examine o elemento <head> e exiba-o em um formato estruturado utilizando o método .prettify().


              123456789101112
            
# Importing libraries
from bs4 import BeautifulSoup
from urllib.request import urlopen

# Reading web page
url = "https://codefinity-content-media.s3.eu-west-1.amazonaws.com/18a4e428-1a0f-44c2-a8ad-244cd9c7985e/jesus.html"
page = urlopen(url)
html = page.read().decode("utf-8")

# Reading HTML with BeautifulSoup
soup = BeautifulSoup(html, "html.parser")
print(soup.head.prettify())

Sinta-se à vontade para experimentar substituindo o atributo .head por .body, por exemplo. Como mostrado acima, o elemento <head> abrange vários filhos. É possível iterar por todos os filhos dos elementos utilizando um laço for e o atributo .children.


              1234567891011121314
            
# Importing libraries
from bs4 import BeautifulSoup
from urllib.request import urlopen

# Reading web page
url = "https://codefinity-content-media.s3.eu-west-1.amazonaws.com/18a4e428-1a0f-44c2-a8ad-244cd9c7985e/jesus.html"
page = urlopen(url)
html = page.read().decode("utf-8")

# Reading HTML with BeautifulSoup
soup = BeautifulSoup(html, "html.parser")
# Iterating over all element children
for child in soup.head.children:
  print(child)

Tudo estava claro?

Obrigado pelo seu feedback!

Seção 2. Capítulo 2

Pergunte à IA

Pergunte o que quiser ou experimente uma das perguntas sugeridas para iniciar nosso bate-papo

Seção 2. Capítulo 2