Wie kann man das Format eines Textes erkennen?
-
Wie die Frage schon sagt: Gibt es eine Möglichkeit mittels einer Funktion/Methode, mir ganze einfach True/False auszugeben, ob ein Text UTF-8 kodiert ist bzw. mir generell den Kodierungstyp als Wert ausgibt?
Danke im voraus!
-
du kannst ja versuchen, ihn mit verschiedenen verfahren auszulesen, und wenn da, wo du normale zeichen erwartest, nur komische sachen rauskommen, wars der falsche

-
Klingt etwas "unsportlich"...aber was mir da vorschwebt wäre sowas wie eine erkennung, ob da z.B. keryllische Buchstaben drinn sind. Wie wäre das denn machbar?
-
http://msdn2.microsoft.com/en-us/library/ms776429.aspx
im prinzip liegt so eine byteorder mark am anfang eines unicode dokuments, daran kann man das format erkennen.