Der HTML-Parser erzeugt aus Quelltext einen DOM-Baum, korrigiert bestimmte Fehler und beachtet Inhaltsmodelle. Dieses Modell hilft, überraschende Verschachtelungen und Unterschiede zwischen Quelltext und DOM zu erklären.