HTML-Dokumente abrufen und gezielt auswerten, ohne fragile Selektoren zu bauen. robots.txt, Nutzungsbedingungen, Lastbegrenzung und der Unterschied zwischen statischen und dynamischen Seiten gehören zur verantwortlichen Praxis.