HTML-Parser Library
-
Mahlzeit die Herren und Damen!
Ich suche eine HTML-Parser Library, die aus einem HTML-Code mir die einzelnen Attribute der Tags zurückgeben kann.
htmlcxx war auf den ersten Blick sehr gut, auf den zweiten Blick war es einfach nur grotten schlecht.
Zudem weil der Typ bei jeder Änderung die API bricht und keine Tests vorhanden sind, die die Stabilität der Bibliothek gewährleisten.Webkit ist recht nett, aber der Speicherbedarf ist mir einfach ein Overkill, da ich mehrere HTML-Dateien parsen muss.
XML-Libraries und Regex kommen natürlich nicht in Frage.
Hoffe eine Antwort zu finden.
Danke!