Leer AI met Python · Les

Webscraping met BeautifulSoup

Begrijp hoe u met Python data uit websites extraheert.

Les 5 van 511 stappen

Webscraping met BeautifulSoup is een gratis Leer AI met Python-les op CoddyKit. Dit is les 5 van 5. Je kunt 3 lessen uit dit leerpad gratis volledig lezen — daarna ontgrendelt CoddyKit PRO alle lessen, plus praktische oefeningen met een ingebouwde code-editor en een AI-tutor die 24/7 beschikbaar is. Deze les maakt deel uit van het leertraject Leer AI met Python. Je voortgang wordt gesynchroniseerd op het web en in de CoddyKit-app. De cursus Leer AI met Python bevat in totaal 5 lessen.

Inleiding in webscraping

Webscraping is het proces waarbij gegevens van websites worden gehaald. De Python-bibliotheek BeautifulSoup maakt het eenvoudig om HTML- of XML-documenten te parseren en erdoorheen te navigeren.

In deze les leer je hoe je BeautifulSoup gebruikt voor webscraping.

Webscraping met BeautifulSoup — illustratie 1

BeautifulSoup installeren

Gebruik de volgende opdrachten om BeautifulSoup en de vereiste bibliotheek requests te installeren:

pip install beautifulsoup4
pip install requests

Na de installatie kun je ze in je Python-scripts importeren:

# Importing BeautifulSoup
from bs4 import BeautifulSoup
import requests

print("BeautifulSoup imported successfully")

Een webpagina ophalen

Je kunt een webpagina ophalen met de requests-bibliotheek:

# Fetching a web page
response = requests.get("https://example.com")
print(response.text)  # Outputs the HTML content

HTML parseren met BeautifulSoup

BeautifulSoup biedt methoden om HTML-documenten te parseren en erdoorheen te navigeren:

# Parsing HTML
html_content = "<html><body><h1>Hello, World!</h1></body></html>"
soup = BeautifulSoup(html_content, "html.parser")
print(soup.h1.text)  # Outputs: Hello, World!

Elementen vinden

BeautifulSoup biedt methoden zoals find() en find_all() om elementen te vinden:

# Finding elements
soup = BeautifulSoup("<html><body><p class='content'>Hello!</p><p>World!</p></body></html>", "html.parser")
element = soup.find("p", class_="content")
print(element.text)  # Outputs: Hello!

Koppelingen extraheren

Je kunt alle koppelingen (<a>-tags) van een webpagina extraheren:

# Extracting links
html = "<html><body><a href='https://example.com'>Example</a></body></html>"
soup = BeautifulSoup(html, "html.parser")
links = soup.find_all("a")
for link in links:
    print(link['href'])  # Outputs: https://example.com

Tabellen extraheren

Met BeautifulSoup kun je eenvoudig gegevens uit HTML-tabellen extraheren:

# Extracting table data
html = "<table><tr><td>Row 1</td></tr><tr><td>Row 2</td></tr></table>"
soup = BeautifulSoup(html, "html.parser")
rows = soup.find_all("tr")
for row in rows:
    print(row.text)  # Outputs: Row 1, Row 2

Ontbrekende elementen verwerken

BeautifulSoup biedt methoden om veilig om te gaan met ontbrekende elementen:

# Handling missing elements
soup = BeautifulSoup("<html><body></body></html>", "html.parser")
element = soup.find("p")
print(element)  # Outputs: None

Veelgemaakte fouten met BeautifulSoup

Dit zijn enkele fouten die je moet vermijden:

  • Geen geschikte HTML-parser gebruiken (bijvoorbeeld html.parser of lxml).
  • Inhoud ophalen van geblokkeerde of beveiligde websites zonder de juiste headers.
  • Te vaak scrapen, waardoor je IP-adres geblokkeerd kan worden.

Wat hebben we geleerd?

In deze les heb je geleerd:

  • Hoe je BeautifulSoup en requests installeert en importeert.
  • Hoe je HTML-inhoud ophaalt, parseert en navigeert.
  • Hoe je specifieke elementen, zoals koppelingen en tabellen, extraheert.
  • Hoe je ontbrekende elementen veilig afhandelt.

Goed gedaan! Laten we doorgaan naar het volgende onderwerp.

Webscraping met BeautifulSoup — illustratie 11
Gratis beginnen

Leer Python met een AI-tutor — gratis

Schrijf echte code en voer die uit in je browser, krijg direct hulp van een AI-tutor die 24/7 beschikbaar is en ga verder waar je gebleven bent op het web of in de app.

Cursussen
53
Lessen
225

Veelgestelde vragen

Is de les “Webscraping met BeautifulSoup” gratis?

Ja — je kunt hier op het web alle 3 lessen van het leerpad Leer AI met Python, waaronder “Webscraping met BeautifulSoup”, gratis volledig lezen. Daarna ontgrendelt CoddyKit PRO alle lessen, plus interactieve oefeningen met een ingebouwde code-editor en een AI-tutor die 24/7 beschikbaar is. De cursus Leer AI met Python bevat in totaal 5 lessen.

Wat leer ik in “Webscraping met BeautifulSoup”?

Begrijp hoe u met Python data uit websites extraheert. Je oefent met Leer AI met Python door code rechtstreeks in de browser uit te voeren. Een AI-begeleider die 24/7 beschikbaar is beantwoordt je vragen terwijl je de les doorwerkt.

Heb ik ervaring nodig om met Leer AI met Python te beginnen?

Ervaring vooraf is niet nodig. Leer AI met Python op CoddyKit is opgebouwd voor beginners tot gevorderden, zodat je hier of bij het begin kunt starten en in je eigen tempo kunt leren. Dit is les 5 van 5.

Hoe lang duurt de les “Webscraping met BeautifulSoup”?

De meeste lessen van CoddyKit duren ongeveer 5–10 minuten. Elke les is kort en interactief, zodat je gestaag vooruitgaat en op het web en in de app precies verdergaat waar je was gebleven.

Kan ik code schrijven en uitvoeren in deze les over Leer AI met Python?

Ja. Elke les over Leer AI met Python bevat een ingebouwde code-editor, zodat je rechtstreeks in je browser echte code kunt schrijven en uitvoeren en direct feedback van AI krijgt — lokale installatie is niet nodig.

Alle lessen in deze cursus

  1. Data-analyse met Pandas
  2. Datavisualisatie met Matplotlib
  3. NumPy voor numerieke berekeningen
  4. API's gebruiken met requests
  5. Webscraping met BeautifulSoup
← Terug naar Leer AI met Python