<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title><![CDATA[Spider bzw. in HTML Datei Metatag suchen]]></title><description><![CDATA[<p>Hallo</p>
<p>Ich bin gerade mal wieder an meinem Spider zu gange. Also ich habe folgendes Problem.<br />
Alles läuft bisher so:<br />
Seite wird runtergeladen und nach Links durchsucht danach werden die Links in einer Datenbank gespeichert und der nächste Link ist dran.<br />
Mein Prob ist jetzt das das mit den Links alles funzt aber nun kommt das nächste Problem: Die Metatags!<br />
Ich will jetzt auch noch die Metatags auslesen um genau zu sein die Keywords um später besser die Links in meinen Katalog einzupflgen. Aber wie mache ich das? Ein Typischer Metagtag wäre ja dieser:<br />
&lt;meta name=&quot;keywords&quot; content=&quot;key1, key2, key3,key4&quot;&gt;<br />
Mein Problem sind eigentlich nur die &quot; die da drinnen sind wäre die nicht wäre alles kein Problem.<br />
Ich lese eigentlich immer alles so aus:</p>
<pre><code>start = zeile.Find(&quot;href=&quot;);
			if(start != -1)
			{
				start +=6;
				end = zeile.Find('&quot;',start);
				zahl = end - start;
				adresse = zeile.Mid(start,zahl);
				http = adresse.Find(&quot;http://www&quot;);

				if(http != -1){

					m_url.AddString(adresse);
				        eintragen();

				}

			}
</code></pre>
<p>Was jetzt nicht mehr geht wegen den ganzen &quot; da drinnen. Ich habe Probleme wowohl beim auslesen des ersten Teils und des auslesen des endes.</p>
<p>Wäre gut wenn mir da einer mal eine Tipp geben könnte!</p>
<p>MFG<br />
Jens</p>
]]></description><link>https://www.c-plusplus.net/forum/topic/159041/spider-bzw-in-html-datei-metatag-suchen</link><generator>RSS for Node</generator><lastBuildDate>Tue, 28 Jul 2026 01:41:08 GMT</lastBuildDate><atom:link href="https://www.c-plusplus.net/forum/topic/159041.rss" rel="self" type="application/rss+xml"/><pubDate>Mon, 11 Sep 2006 13:43:42 GMT</pubDate><ttl>60</ttl><item><title><![CDATA[Reply to Spider bzw. in HTML Datei Metatag suchen on Mon, 11 Sep 2006 13:43:42 GMT]]></title><description><![CDATA[<p>Hallo</p>
<p>Ich bin gerade mal wieder an meinem Spider zu gange. Also ich habe folgendes Problem.<br />
Alles läuft bisher so:<br />
Seite wird runtergeladen und nach Links durchsucht danach werden die Links in einer Datenbank gespeichert und der nächste Link ist dran.<br />
Mein Prob ist jetzt das das mit den Links alles funzt aber nun kommt das nächste Problem: Die Metatags!<br />
Ich will jetzt auch noch die Metatags auslesen um genau zu sein die Keywords um später besser die Links in meinen Katalog einzupflgen. Aber wie mache ich das? Ein Typischer Metagtag wäre ja dieser:<br />
&lt;meta name=&quot;keywords&quot; content=&quot;key1, key2, key3,key4&quot;&gt;<br />
Mein Problem sind eigentlich nur die &quot; die da drinnen sind wäre die nicht wäre alles kein Problem.<br />
Ich lese eigentlich immer alles so aus:</p>
<pre><code>start = zeile.Find(&quot;href=&quot;);
			if(start != -1)
			{
				start +=6;
				end = zeile.Find('&quot;',start);
				zahl = end - start;
				adresse = zeile.Mid(start,zahl);
				http = adresse.Find(&quot;http://www&quot;);

				if(http != -1){

					m_url.AddString(adresse);
				        eintragen();

				}

			}
</code></pre>
<p>Was jetzt nicht mehr geht wegen den ganzen &quot; da drinnen. Ich habe Probleme wowohl beim auslesen des ersten Teils und des auslesen des endes.</p>
<p>Wäre gut wenn mir da einer mal eine Tipp geben könnte!</p>
<p>MFG<br />
Jens</p>
]]></description><link>https://www.c-plusplus.net/forum/post/1135193</link><guid isPermaLink="true">https://www.c-plusplus.net/forum/post/1135193</guid><dc:creator><![CDATA[Jens Bond]]></dc:creator><pubDate>Mon, 11 Sep 2006 13:43:42 GMT</pubDate></item><item><title><![CDATA[Reply to Spider bzw. in HTML Datei Metatag suchen on Mon, 11 Sep 2006 14:25:10 GMT]]></title><description><![CDATA[<p>naja nichts leichter als das oder?<br />
bau dir ne neue funktion die nur die Metatags ausliest. in dieser suchste dann halt nicht nach anführungszeichen sondern nach pfeilen von &lt; bis &gt;. alles was dann zwischen von &lt; bis &gt; ausgegeben wird ist Metatag.</p>
<p>kuck dir die stringfunction Mid mal genauer an <img
      src="https://www.c-plusplus.net/forum/plugins/nodebb-plugin-emoji/emoji/emoji-one/1f609.png?v=ab1pehoraso"
      class="not-responsive emoji emoji-emoji-one emoji--winking_face"
      title=";)"
      alt="😉"
    /></p>
<p>mfg<br />
LowFly</p>
]]></description><link>https://www.c-plusplus.net/forum/post/1135225</link><guid isPermaLink="true">https://www.c-plusplus.net/forum/post/1135225</guid><dc:creator><![CDATA[LowFly]]></dc:creator><pubDate>Mon, 11 Sep 2006 14:25:10 GMT</pubDate></item><item><title><![CDATA[Reply to Spider bzw. in HTML Datei Metatag suchen on Mon, 11 Sep 2006 14:46:43 GMT]]></title><description><![CDATA[<p>ach ich soll nach &lt; suchen? na klar dann bekomme ich aber auch &lt;br&gt; &lt;html&gt; &lt;a&gt; usw!</p>
]]></description><link>https://www.c-plusplus.net/forum/post/1135244</link><guid isPermaLink="true">https://www.c-plusplus.net/forum/post/1135244</guid><dc:creator><![CDATA[Jens Bond]]></dc:creator><pubDate>Mon, 11 Sep 2006 14:46:43 GMT</pubDate></item><item><title><![CDATA[Reply to Spider bzw. in HTML Datei Metatag suchen on Tue, 12 Sep 2006 07:20:54 GMT]]></title><description><![CDATA[<p>Hi,<br />
macht nichts wenn du auch die anderen einliest, wenn dein tag nicht mit einem &lt;meta beginnt, kannst ihn auch ignorieren, und um nicht wirklich alles lesen zu müssen<br />
kannst auch noch sagen das nur solange gelesen wird bis der &lt;/head&gt; oder &lt;body&gt;<br />
gefunden wurde! Fallst du für das lesen der meta-tags eine eigene funktion schreibst!</p>
<p>lg<br />
pixel</p>
]]></description><link>https://www.c-plusplus.net/forum/post/1135580</link><guid isPermaLink="true">https://www.c-plusplus.net/forum/post/1135580</guid><dc:creator><![CDATA[pixel]]></dc:creator><pubDate>Tue, 12 Sep 2006 07:20:54 GMT</pubDate></item><item><title><![CDATA[Reply to Spider bzw. in HTML Datei Metatag suchen on Tue, 12 Sep 2006 16:53:26 GMT]]></title><description><![CDATA[<p>stimmt das mit dem &lt;/head&gt; is ne gute idee</p>
]]></description><link>https://www.c-plusplus.net/forum/post/1136041</link><guid isPermaLink="true">https://www.c-plusplus.net/forum/post/1136041</guid><dc:creator><![CDATA[Jens Bond]]></dc:creator><pubDate>Tue, 12 Sep 2006 16:53:26 GMT</pubDate></item><item><title><![CDATA[Reply to Spider bzw. in HTML Datei Metatag suchen on Wed, 13 Sep 2006 14:20:33 GMT]]></title><description><![CDATA[<p>Hi,<br />
folgt dein spider den links oder parst du nur die eine seite die eingegeben wird?<br />
Vergiss nicht das es seiten gibt die kein &lt;html&gt; haben, die frames!<br />
Hast du da auch was gemacht?</p>
<p>lg<br />
pixel</p>
]]></description><link>https://www.c-plusplus.net/forum/post/1136361</link><guid isPermaLink="true">https://www.c-plusplus.net/forum/post/1136361</guid><dc:creator><![CDATA[pixel]]></dc:creator><pubDate>Wed, 13 Sep 2006 14:20:33 GMT</pubDate></item></channel></rss>