<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title><![CDATA[Encoding&#x2F;Unicode der Quelldatei auslesen]]></title><description><![CDATA[<p>Hallo zusammen.</p>
<p>Kann ich herausfinden, in welchem Encoding (z.B. ISO-8859-1) die Sourcedatei vorliegt? Oder ob es sich um Unicode handelt?</p>
<p>Angenommen eine Datei wurde in ISO-8859-1 geschrieben, dann wäre \xFC in einem String ein 'ü'. Ist die Datei dagegen ISO-8859-7 wäre \xFC ein griechischer Buchstabe. Damit ich diese Strings korrekt in Unicode umwandeln kann, muss ich wissen, in welchem Format die Quelldatei geschrieben wurde.</p>
<p>Grüße,<br />
Neku</p>
]]></description><link>https://www.c-plusplus.net/forum/topic/141486/encoding-unicode-der-quelldatei-auslesen</link><generator>RSS for Node</generator><lastBuildDate>Mon, 31 Aug 2026 14:17:36 GMT</lastBuildDate><atom:link href="https://www.c-plusplus.net/forum/topic/141486.rss" rel="self" type="application/rss+xml"/><pubDate>Wed, 22 Mar 2006 13:59:08 GMT</pubDate><ttl>60</ttl><item><title><![CDATA[Reply to Encoding&#x2F;Unicode der Quelldatei auslesen on Wed, 22 Mar 2006 13:59:08 GMT]]></title><description><![CDATA[<p>Hallo zusammen.</p>
<p>Kann ich herausfinden, in welchem Encoding (z.B. ISO-8859-1) die Sourcedatei vorliegt? Oder ob es sich um Unicode handelt?</p>
<p>Angenommen eine Datei wurde in ISO-8859-1 geschrieben, dann wäre \xFC in einem String ein 'ü'. Ist die Datei dagegen ISO-8859-7 wäre \xFC ein griechischer Buchstabe. Damit ich diese Strings korrekt in Unicode umwandeln kann, muss ich wissen, in welchem Format die Quelldatei geschrieben wurde.</p>
<p>Grüße,<br />
Neku</p>
]]></description><link>https://www.c-plusplus.net/forum/post/1021710</link><guid isPermaLink="true">https://www.c-plusplus.net/forum/post/1021710</guid><dc:creator><![CDATA[Neku]]></dc:creator><pubDate>Wed, 22 Mar 2006 13:59:08 GMT</pubDate></item><item><title><![CDATA[Reply to Encoding&#x2F;Unicode der Quelldatei auslesen on Wed, 22 Mar 2006 14:09:23 GMT]]></title><description><![CDATA[<p>Du kannst mit Glück herausfinden, ob eine Datei Unicode ist oder nicht, aber zwischen den unterschiedlichen Encodierungen zu unterscheiden ist nicht möglich, da die Datei keine Informationen darüber in sich trägt.</p>
<p>Ein Ansatz wäre zum Beispiel, diverse Codierungen zu testen und dann mit einem Wörterbuch abzugleichen, dann kannst Du das feststellen.</p>
<p>Aus diesem Grund tragen die (meisten) XML-Dateien ja die Codierung im Header.</p>
]]></description><link>https://www.c-plusplus.net/forum/post/1021721</link><guid isPermaLink="true">https://www.c-plusplus.net/forum/post/1021721</guid><dc:creator><![CDATA[Marc++us]]></dc:creator><pubDate>Wed, 22 Mar 2006 14:09:23 GMT</pubDate></item><item><title><![CDATA[Reply to Encoding&#x2F;Unicode der Quelldatei auslesen on Wed, 22 Mar 2006 14:42:55 GMT]]></title><description><![CDATA[<p>Danke.<br />
Dann wäre die einzig sinnvolle Lösung, nur ASCII zu erlauben und Sonderzeichen somit auszuschließen.</p>
]]></description><link>https://www.c-plusplus.net/forum/post/1021738</link><guid isPermaLink="true">https://www.c-plusplus.net/forum/post/1021738</guid><dc:creator><![CDATA[Neku]]></dc:creator><pubDate>Wed, 22 Mar 2006 14:42:55 GMT</pubDate></item><item><title><![CDATA[Reply to Encoding&#x2F;Unicode der Quelldatei auslesen on Wed, 22 Mar 2006 15:14:58 GMT]]></title><description><![CDATA[<p>Bei Unicode sind die ersten zwei Byte ein Header, wenn das erste Byte 0xFF ist und das zweite 0xFE ist die Datei ne Unicode-Datei im little-endian-format</p>
]]></description><link>https://www.c-plusplus.net/forum/post/1021778</link><guid isPermaLink="true">https://www.c-plusplus.net/forum/post/1021778</guid><dc:creator><![CDATA[Unicode]]></dc:creator><pubDate>Wed, 22 Mar 2006 15:14:58 GMT</pubDate></item><item><title><![CDATA[Reply to Encoding&#x2F;Unicode der Quelldatei auslesen on Wed, 22 Mar 2006 16:08:13 GMT]]></title><description><![CDATA[<p>Und wenn's mit FE FF losgeht ist es big endian...</p>
<p>(Ich wieß aber nicht ob das &quot;Standard&quot; ist oder nur eine Windows-Konvention)</p>
]]></description><link>https://www.c-plusplus.net/forum/post/1021860</link><guid isPermaLink="true">https://www.c-plusplus.net/forum/post/1021860</guid><dc:creator><![CDATA[peterchen]]></dc:creator><pubDate>Wed, 22 Mar 2006 16:08:13 GMT</pubDate></item><item><title><![CDATA[Reply to Encoding&#x2F;Unicode der Quelldatei auslesen on Wed, 22 Mar 2006 17:38:46 GMT]]></title><description><![CDATA[<p>Unicode schrieb:</p>
<blockquote>
<p>Bei Unicode sind die ersten zwei Byte ein Header, wenn das erste Byte 0xFF ist und das zweite 0xFE ist die Datei ne Unicode-Datei im little-endian-format</p>
</blockquote>
<p>Unicode != UTF-16</p>
]]></description><link>https://www.c-plusplus.net/forum/post/1021914</link><guid isPermaLink="true">https://www.c-plusplus.net/forum/post/1021914</guid><dc:creator><![CDATA[finix]]></dc:creator><pubDate>Wed, 22 Mar 2006 17:38:46 GMT</pubDate></item><item><title><![CDATA[Reply to Encoding&#x2F;Unicode der Quelldatei auslesen on Wed, 22 Mar 2006 18:53:59 GMT]]></title><description><![CDATA[<p>Fand ich einen guten Einstieg: <a href="http://www.codeproject.com/file/textfiledocument.asp" rel="nofollow">http://www.codeproject.com/file/textfiledocument.asp</a></p>
<p><a class="plugin-mentions-user plugin-mentions-a" href="https://www.c-plusplus.net/forum/uid/4239">@finix</a>: ..was für ein wertvoller Beitrag</p>
]]></description><link>https://www.c-plusplus.net/forum/post/1021949</link><guid isPermaLink="true">https://www.c-plusplus.net/forum/post/1021949</guid><dc:creator><![CDATA[peterchen]]></dc:creator><pubDate>Wed, 22 Mar 2006 18:53:59 GMT</pubDate></item><item><title><![CDATA[Reply to Encoding&#x2F;Unicode der Quelldatei auslesen on Wed, 22 Mar 2006 19:26:51 GMT]]></title><description><![CDATA[<p>peterchen schrieb:</p>
<blockquote>
<p><a class="plugin-mentions-user plugin-mentions-a" href="https://www.c-plusplus.net/forum/uid/4239">@finix</a>: ..was für ein wertvoller Beitrag</p>
</blockquote>
<p>Heh. Du bist putzig.</p>
<p>1. ist Unicode ein Standard, auch wenn du diese Bezeichnung in Anführungszeichen setzt<br />
2. ist deine Anmerkung bezüglich &quot;Windows-Konvention?&quot; relativ hohl<br />
3. steht es im &quot;Standard&quot;</p>
<p>Wahrscheinlich hast du meinen Beitrag nicht einmal verstanden... <img
      src="https://www.c-plusplus.net/forum/plugins/nodebb-plugin-emoji/emoji/emoji-one/1f644.png?v=ab1pehoraso"
      class="not-responsive emoji emoji-emoji-one emoji--face_with_rolling_eyes"
      title=":rolling_eyes:"
      alt="🙄"
    /></p>
]]></description><link>https://www.c-plusplus.net/forum/post/1021970</link><guid isPermaLink="true">https://www.c-plusplus.net/forum/post/1021970</guid><dc:creator><![CDATA[finix]]></dc:creator><pubDate>Wed, 22 Mar 2006 19:26:51 GMT</pubDate></item><item><title><![CDATA[Reply to Encoding&#x2F;Unicode der Quelldatei auslesen on Wed, 22 Mar 2006 23:15:34 GMT]]></title><description><![CDATA[<p>Dein Beitrag hilft weder jemandem, der den Unterschied kennt, noch jemandem, der ihn nicht kennt. Und für die vorliegende Frage ist der Unterschied zwischen Standard und Kodierung fast schon akademisch (denk' ich zumindest, aber vielleicht irre ich mich da)</p>
]]></description><link>https://www.c-plusplus.net/forum/post/1022060</link><guid isPermaLink="true">https://www.c-plusplus.net/forum/post/1022060</guid><dc:creator><![CDATA[peterchen]]></dc:creator><pubDate>Wed, 22 Mar 2006 23:15:34 GMT</pubDate></item><item><title><![CDATA[Reply to Encoding&#x2F;Unicode der Quelldatei auslesen on Thu, 23 Mar 2006 11:32:10 GMT]]></title><description><![CDATA[<p>peterchen schrieb:</p>
<blockquote>
<p>Dein Beitrag hilft weder jemandem, der den Unterschied kennt, noch jemandem, der ihn nicht kennt. Und für die vorliegende Frage ist der Unterschied zwischen Standard und Kodierung fast schon akademisch (denk' ich zumindest, aber vielleicht irre ich mich da)</p>
</blockquote>
<p>Ich war ein wenig in Eile - ansonsten hätte ich vielleicht noch erläutert was ich meinte.<br />
Dass z.B. eine UTF-8 kodierte Datei nicht zwangsläufig ein BOM hat, es wenn vorhanden anders aussieht und euer Tipp (bzw die Basis der Lösung &quot;Unicode == 2-Byte-Zeichen&quot;) bei UTF-32LE eher in die Irre führt.<br />
Und genau dadurch ist mein Einwurf eben nicht rein 'akademisch'...</p>
]]></description><link>https://www.c-plusplus.net/forum/post/1022286</link><guid isPermaLink="true">https://www.c-plusplus.net/forum/post/1022286</guid><dc:creator><![CDATA[finix]]></dc:creator><pubDate>Thu, 23 Mar 2006 11:32:10 GMT</pubDate></item><item><title><![CDATA[Reply to Encoding&#x2F;Unicode der Quelldatei auslesen on Thu, 23 Mar 2006 15:49:31 GMT]]></title><description><![CDATA[<p>schon ok <img
      src="https://www.c-plusplus.net/forum/plugins/nodebb-plugin-emoji/emoji/emoji-one/1f642.png?v=ab1pehoraso"
      class="not-responsive emoji emoji-emoji-one emoji--slightly_smiling_face"
      title=":)"
      alt="🙂"
    /></p>
]]></description><link>https://www.c-plusplus.net/forum/post/1022450</link><guid isPermaLink="true">https://www.c-plusplus.net/forum/post/1022450</guid><dc:creator><![CDATA[peterchen]]></dc:creator><pubDate>Thu, 23 Mar 2006 15:49:31 GMT</pubDate></item></channel></rss>