<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title><![CDATA[bestimmten inhalt aus html code auslesen]]></title><description><![CDATA[<p>Hallo!</p>
<p>Ich hab ein problem. Und zwar will ich eine art programm schreiben, dass mir aus HTML code bestimmte sachen raussucht, ein wenig bearbeitet und die dann zusammen in eine neue Datei schreibt.<br />
Kurz gesagt, ich will ein programm schreiben, dass html code durchsucht und bestimmte dinge in BB-Code umwandelt. (diesen dann in eine textdatei oder was auch immer).<br />
So, das auslesen der HTML datei ist mir gelungen (mithilfe von libcurl). Jetzt hab ich den ganzen code in einer String.<br />
Aber ich weis einfach nicht wie ich das lösen soll, dass er den code nach bestimmten sachen absucht (z.B. eine bestimmte div) und diesen dann z.B. in ein neuen String kopiert <img
      src="https://www.c-plusplus.net/forum/plugins/nodebb-plugin-emoji/emoji/emoji-one/1f615.png?v=ab1pehoraso"
      class="not-responsive emoji emoji-emoji-one emoji--confused_face"
      title=":confused:"
      alt="😕"
    /></p>
<p>Wüsste da jemand eine möglichkeit?<br />
Ich hoffe ihr wisst was ich meine <img
      src="https://www.c-plusplus.net/forum/plugins/nodebb-plugin-emoji/emoji/emoji-one/1f603.png?v=ab1pehoraso"
      class="not-responsive emoji emoji-emoji-one emoji--grinning_face_with_big_eyes"
      title=":D"
      alt="😃"
    /></p>
<p>lg</p>
<p>P.S.: So sieht bisher mein grabbing code aus, vielleicht hilf es ja bei der Hilfe <img
      src="https://www.c-plusplus.net/forum/plugins/nodebb-plugin-emoji/emoji/emoji-one/1f603.png?v=ab1pehoraso"
      class="not-responsive emoji emoji-emoji-one emoji--grinning_face_with_big_eyes"
      title=":D"
      alt="😃"
    /></p>
<pre><code class="language-cpp">std::string get_page( const char* url) 
{ 

std::string result;
CURL* easyhandle = curl_easy_init() ; 

curl_easy_setopt( easyhandle, CURLOPT_URL, url ) ; 
curl_easy_setopt(easyhandle, CURLOPT_WRITEDATA,&amp;result);
curl_easy_setopt(easyhandle,   CURLOPT_WRITEFUNCTION,&amp;write_data);

curl_easy_setopt(easyhandle, CURLOPT_TIMEOUT, 200);

curl_easy_perform( easyhandle ); 
curl_easy_cleanup( easyhandle ); 

return result;
}
</code></pre>
]]></description><link>https://www.c-plusplus.net/forum/topic/268353/bestimmten-inhalt-aus-html-code-auslesen</link><generator>RSS for Node</generator><lastBuildDate>Tue, 01 Sep 2026 20:09:02 GMT</lastBuildDate><atom:link href="https://www.c-plusplus.net/forum/topic/268353.rss" rel="self" type="application/rss+xml"/><pubDate>Mon, 07 Jun 2010 22:25:58 GMT</pubDate><ttl>60</ttl><item><title><![CDATA[Reply to bestimmten inhalt aus html code auslesen on Mon, 07 Jun 2010 22:25:58 GMT]]></title><description><![CDATA[<p>Hallo!</p>
<p>Ich hab ein problem. Und zwar will ich eine art programm schreiben, dass mir aus HTML code bestimmte sachen raussucht, ein wenig bearbeitet und die dann zusammen in eine neue Datei schreibt.<br />
Kurz gesagt, ich will ein programm schreiben, dass html code durchsucht und bestimmte dinge in BB-Code umwandelt. (diesen dann in eine textdatei oder was auch immer).<br />
So, das auslesen der HTML datei ist mir gelungen (mithilfe von libcurl). Jetzt hab ich den ganzen code in einer String.<br />
Aber ich weis einfach nicht wie ich das lösen soll, dass er den code nach bestimmten sachen absucht (z.B. eine bestimmte div) und diesen dann z.B. in ein neuen String kopiert <img
      src="https://www.c-plusplus.net/forum/plugins/nodebb-plugin-emoji/emoji/emoji-one/1f615.png?v=ab1pehoraso"
      class="not-responsive emoji emoji-emoji-one emoji--confused_face"
      title=":confused:"
      alt="😕"
    /></p>
<p>Wüsste da jemand eine möglichkeit?<br />
Ich hoffe ihr wisst was ich meine <img
      src="https://www.c-plusplus.net/forum/plugins/nodebb-plugin-emoji/emoji/emoji-one/1f603.png?v=ab1pehoraso"
      class="not-responsive emoji emoji-emoji-one emoji--grinning_face_with_big_eyes"
      title=":D"
      alt="😃"
    /></p>
<p>lg</p>
<p>P.S.: So sieht bisher mein grabbing code aus, vielleicht hilf es ja bei der Hilfe <img
      src="https://www.c-plusplus.net/forum/plugins/nodebb-plugin-emoji/emoji/emoji-one/1f603.png?v=ab1pehoraso"
      class="not-responsive emoji emoji-emoji-one emoji--grinning_face_with_big_eyes"
      title=":D"
      alt="😃"
    /></p>
<pre><code class="language-cpp">std::string get_page( const char* url) 
{ 

std::string result;
CURL* easyhandle = curl_easy_init() ; 

curl_easy_setopt( easyhandle, CURLOPT_URL, url ) ; 
curl_easy_setopt(easyhandle, CURLOPT_WRITEDATA,&amp;result);
curl_easy_setopt(easyhandle,   CURLOPT_WRITEFUNCTION,&amp;write_data);

curl_easy_setopt(easyhandle, CURLOPT_TIMEOUT, 200);

curl_easy_perform( easyhandle ); 
curl_easy_cleanup( easyhandle ); 

return result;
}
</code></pre>
]]></description><link>https://www.c-plusplus.net/forum/post/1908672</link><guid isPermaLink="true">https://www.c-plusplus.net/forum/post/1908672</guid><dc:creator><![CDATA[C0dR]]></dc:creator><pubDate>Mon, 07 Jun 2010 22:25:58 GMT</pubDate></item><item><title><![CDATA[Reply to bestimmten inhalt aus html code auslesen on Mon, 07 Jun 2010 22:30:25 GMT]]></title><description><![CDATA[<p>bei sowas hilft dir denke ich &quot;substring&quot; weiter</p>
<pre><code class="language-cpp">pos = str.find(&quot;live&quot;);    // position of &quot;live&quot; in str
  str3 = str.substr (pos);   // get from &quot;live&quot; to the end
</code></pre>
<p>hier mal nen link dazu</p>
<p><a href="http://www.cplusplus.com/reference/string/string/substr/" rel="nofollow">http://www.cplusplus.com/reference/string/string/substr/</a></p>
]]></description><link>https://www.c-plusplus.net/forum/post/1908673</link><guid isPermaLink="true">https://www.c-plusplus.net/forum/post/1908673</guid><dc:creator><![CDATA[DNKpp]]></dc:creator><pubDate>Mon, 07 Jun 2010 22:30:25 GMT</pubDate></item><item><title><![CDATA[Reply to bestimmten inhalt aus html code auslesen on Mon, 07 Jun 2010 23:14:55 GMT]]></title><description><![CDATA[<p>Hi!</p>
<p>Wenn das KEINE Programmierübung sein soll (um C++ zu lernen), dann würd ich dir abraten, das in C++ zu realisieren. Sowas geht viel schneller und einfacher in Perl, Ruby, Python... Die haben eine mächtige Regex-Engine zum parsen von Strings.</p>
<p>Wollte nur meinen Senf dazugeben... <img
      src="https://www.c-plusplus.net/forum/plugins/nodebb-plugin-emoji/emoji/emoji-one/1f609.png?v=ab1pehoraso"
      class="not-responsive emoji emoji-emoji-one emoji--winking_face"
      title=";)"
      alt="😉"
    /></p>
<p>mfg bernd</p>
]]></description><link>https://www.c-plusplus.net/forum/post/1908688</link><guid isPermaLink="true">https://www.c-plusplus.net/forum/post/1908688</guid><dc:creator><![CDATA[bauerb]]></dc:creator><pubDate>Mon, 07 Jun 2010 23:14:55 GMT</pubDate></item><item><title><![CDATA[Reply to bestimmten inhalt aus html code auslesen on Tue, 08 Jun 2010 18:20:52 GMT]]></title><description><![CDATA[<p>ja sollte sowohl c++ übung sein (weil ich in diesem bereich bisher noch nicht sehr viel gemacht habe) als auch als normale exe verfügbar sein, weil es auch auf PC laufen wird, die warscheinlich kein perl, python etc haben.</p>
]]></description><link>https://www.c-plusplus.net/forum/post/1909114</link><guid isPermaLink="true">https://www.c-plusplus.net/forum/post/1909114</guid><dc:creator><![CDATA[C0dR]]></dc:creator><pubDate>Tue, 08 Jun 2010 18:20:52 GMT</pubDate></item><item><title><![CDATA[Reply to bestimmten inhalt aus html code auslesen on Tue, 08 Jun 2010 21:18:47 GMT]]></title><description><![CDATA[<p>Hy</p>
<p>C0dR schrieb:</p>
<blockquote>
<p>ja sollte sowohl c++ übung sein (weil ich in diesem bereich bisher noch nicht sehr viel gemacht habe) als auch als normale exe verfügbar sein, weil es auch auf PC laufen wird, die warscheinlich kein perl, python etc haben.</p>
</blockquote>
<p>Da es ja eine C++ Übung ist, weiß ich leider nicht wie weit du bist, aber zum einen musst du auf RegEx nicht verzichtet, da könntest du dir die Boost.Regex-Klasse mal anschauen. Bzw. für solche &quot;einfachen&quot; Sachen benutzt ich Standardmässig sed und awk, sehr mächtige Werkzeuge und gibts auch als Windowsportierungen.</p>
<p>Mfg Marco</p>
]]></description><link>https://www.c-plusplus.net/forum/post/1909220</link><guid isPermaLink="true">https://www.c-plusplus.net/forum/post/1909220</guid><dc:creator><![CDATA[Marc-O]]></dc:creator><pubDate>Tue, 08 Jun 2010 21:18:47 GMT</pubDate></item><item><title><![CDATA[Reply to bestimmten inhalt aus html code auslesen on Tue, 08 Jun 2010 23:21:48 GMT]]></title><description><![CDATA[<p>ok, die klassen kannte ich bisher noch nicht, werde ich mir aber angucken.</p>
<p>Habe es jetzt die ganze zeit mit den string funktionen (find, replace, etc) versucht, allerdings merke ich jetz, dass es nicht sehr einfach ist, einen teilbereich, z.B. innerhalb eines Divs, richtig zu erkennen und rauszulesen. Den anfang kann man ja noch identifizieren, da die divs benannt sind, aber das ende ist schwer, da es ja einfach mit &lt;/div&gt; endet und das kommt öfters vor, so dass mir .find() recht wenig hilft.</p>
]]></description><link>https://www.c-plusplus.net/forum/post/1909237</link><guid isPermaLink="true">https://www.c-plusplus.net/forum/post/1909237</guid><dc:creator><![CDATA[C0dR]]></dc:creator><pubDate>Tue, 08 Jun 2010 23:21:48 GMT</pubDate></item><item><title><![CDATA[Reply to bestimmten inhalt aus html code auslesen on Tue, 08 Jun 2010 23:30:45 GMT]]></title><description><![CDATA[<p>Wie tief ist die Verschachtelung denn?</p>
<pre><code>&lt;div id=&quot;one&quot;&gt;One&lt;div id=&quot;two&quot;&gt;Two&lt;/div&gt;&lt;/div&gt;
</code></pre>
<p>Wenn du in dem Fall den Inhalt von one haben willst, musst du eben bis zum <strong>zweiten</strong> div lesen. Oder rückwärts lesen oder was weiß ich. Hängt vom konkreten Fall ab.</p>
]]></description><link>https://www.c-plusplus.net/forum/post/1909238</link><guid isPermaLink="true">https://www.c-plusplus.net/forum/post/1909238</guid><dc:creator><![CDATA[uiuiuiuiuiu]]></dc:creator><pubDate>Tue, 08 Jun 2010 23:30:45 GMT</pubDate></item><item><title><![CDATA[Reply to bestimmten inhalt aus html code auslesen on Wed, 09 Jun 2010 06:35:29 GMT]]></title><description><![CDATA[<p>ja ist eigentlich immer nur ein div, keine verschachtelung <img
      src="https://www.c-plusplus.net/forum/plugins/nodebb-plugin-emoji/emoji/emoji-one/1f61e.png?v=ab1pehoraso"
      class="not-responsive emoji emoji-emoji-one emoji--disappointed_face"
      title=":("
      alt="😞"
    /> das ist das problem</p>
]]></description><link>https://www.c-plusplus.net/forum/post/1909277</link><guid isPermaLink="true">https://www.c-plusplus.net/forum/post/1909277</guid><dc:creator><![CDATA[C0dR]]></dc:creator><pubDate>Wed, 09 Jun 2010 06:35:29 GMT</pubDate></item></channel></rss>