HTML parsen -> Denkanstoß ;)



  • Und wie komm ich an die (Web-)Seite?

    Imo hab ich eine Indo Komponente IDHTTP oder so ähnlich.

    thx



  • Hallo

    Was für eine Website? Bis jetzt hast du nach dem Parsen einer HTML-Datei gefragt, nicht nach dem Herunterladen einer solchen 🙄

    Ja du kannst TIdHTTP benutzen um per HTTP-Protokoll Dateien zu transferieren.

    bis bald
    akari



  • Ja, schon Gut 😉

    Aber das eine hängt doch irgendwie am anderen 😃



  • Hallo,

    einen Weg, den ich mal mit Java beschritten habe, ist:
    HTML --> XML --> mit XPath auswerten

    Dazu gibt es unter Java natürlich jede Menge Bibliotheken,
    möglicherweise gibt es sowas auch für C++.
    Eine mögliche Anlaufstelle wäre vielleicht Tidy.
    Als XML-Komponente könntest Du die Standardkomponente vom BCB
    verwenden, und zum Herunterladen die Indy-Komponente.
    Anstatt XPath zu verwenden, kannst Du natürlich auch einfach
    selbst die Knoten abklappern.

    Gruß

    Alexander



  • Danke! Ich werds mal ausprobieren



  • Dragonfire schrieb:

    Danke! Ich werds mal ausprobieren

    Schon aufgegeben?



  • Ach Quatsch 😃

    Bin grad am Überlegen ob dieser Weg der Sinvollste ist um eine Art Client für ein Online Game zu machen das auf Basis von MySQL funzt...

    🤡



  • Definitiv nicht. Willst du einen Client dafür bauen (was ich ehrlich gesagt unsinnig finde; ein Browserspiel läuft im Browser, daher der Name 🙄 ), dann pack dir 'ne Instanz bon der OCX-Komponente des Internet Explorers auf dein Form und fertig. Sieht aus wie ein Programm und du brauchst nicht überflüssigerweise Daten filtern 😉

    Ansonsten:
    HTML dürfte sich nicht so ohne Weiteres in XML umwandeln lassen. Da wäre also das nächste Problem 😉



  • árn[y]ék schrieb:

    HTML dürfte sich nicht so ohne Weiteres in XML umwandeln lassen. Da wäre also das nächste Problem 😉

    Ich stimme zu, dass es nicht "ohne Weiteres" geht. Aber die Applikation,
    die ich letztes Jahr erstellt habe, läuft noch heute. Und dort habe ich
    das so gemacht, wie beschrieben (also HTML --> XML). Natürlich ist XML
    wesentlicher strenger als HTML, so dass öfters Daten umgebaut und vielleicht
    sogar weggeschmissen werden. Aber in meinem Fall haben mich nur wenige
    Daten im HTML interessiert, da war es nicht schlimm, dass einiges flach-
    geklopft wurde.

    Im Falle eines Online-Spiels sind aber wahrscheinlich ganz andere Sachen
    nötig, als "nur" ein paar Daten aus der Web-Seite auszulesen.

    Gruß

    Alexander



  • Genau das meinte ich 🙂

    Wobei sich das Problem natürlich z.T. umgehen ließe, indem man das Browserspiel einfach auf XHTML schaltete.


Anmelden zum Antworten