WikiDer > Schaben
kratzen (Englisch: Web-Scraping) ist eine Computertechnik, die Software verwendet, um Informationen aus Webseiten zu extrahieren und zu analysieren. Normalerweise probiert die Software einen Teil der weltweites Netz durch die Verwendung des codebasierten . zu erkunden Hypertext Transfer Protocol (HTTP) oder durch Surfverhalten mit a Webbrowser wie Mozilla Firefox simulieren.
Scraping hängt stark mit dem Web zusammenIndizierung, mit dem a Knochen oder ein Webcrawler sammelt und kategorisiert die Informationen automatisch, eine Technik, die von den meisten universell angewendet wird Suchmaschinen. Scraping hingegen konzentriert sich hauptsächlich auf die Konvertierung von unstrukturierten Daten, meist in HTMLFormat, in strukturierte Daten, die an einem zentralen Ort gespeichert und analysiert werden können Datenbank oder Kalkulationstabelle.
Neben Suchmaschinen wird die Technik auch häufig zum Sammeln von Daten verwendet, wenn der Anbieter diese nicht verschenkt oder strukturiert verkauft, wie z API. Beispiele für Scraping sind Online-Preisvergleiche, Kontakterfassung, Nachrichtenartikel, Wetterdatenüberwachung, Erkennung von Änderungen an Websites, Recherche, Web-Mashup und Webdatenintegration.