ASCII-Tabelle

krgewb

Top Contributor
Ich habe mir mit folgendem Programm die Zahlen ausgeben lassen:
Java:
public class Hauptprogramm {

	public static void main(String[] args) {

		for (int i = 32; i <= 400; i++) {
			System.out.println(i + ": " + (char) i);
		}
		
		System.out.println("");
	}
}
Danach bemerkte ich, dass meine Tabelle falsch ist. Muss ich also eine andere Tabelle verwenden?

Beispiele:
§ = 167 (lt. Tabelle 245)
ß = 223 (lt. Tabelle 225)
Ä = 196 (lt. Tabelle 142)
Ö = 214 (lt. Tabelle 153)
Ü = 220 (lt. Tabelle 154)
ä = 228 (lt. Tabelle 132)
ö = 246 (lt. Tabelle 148)
ü = 252 (lt. Tabelle 129)
 
Wenn ihr die Tabellen von Torsten Horn als Referenz nutzt, seht euch bitte den Zeichensatz zur Tabelle an. Und zusätzlich muss der Zeichensatz zum Java-Programm gesetzt oder überprüft werden.
Java nutzt als Standard UTF-8, wenn nichts anderes definiert wurde (starke Behauptung, hab jetzt kein Beweis).
 
Verzeihung. Hier ein Link zu der Tabelle auf die ich mich im Eingangsbeitrag beziehe:
http://www.chip.de/news/ASCII-Tabelle-Alle-ASCII-Codes-im-ueberblick-51205777.html

Der Artikel ist ja völlig daneben. Auch wenn Wikipedia keine wissenschaftliche Quelle ist, steckt sehr viel Gutes drin. Das reine ASCII hat nur 127 Zeichen (7 Bit). Alle weiteren 8-Bit Codierungen, die mit ASCII kompatibel sind, heißen etwas anders (UTF-8, ISO-8859-1, CodePage-850 oder was auch immer).
Deshalb muss festgestellt werden, welche Codierung als Standard genutzt wird oder sie muss explizit festgelegt werden über das file.encoding

Ich denke, du siehst das UTF-8. Das ist ASCII-kompatibel. Die ersten 127 Zeichen stimmen mit der ASCII-Tabelle überein.
 
What ever, nur kein reines ASCII. Auch die 437 ist ASCII kompatibel. Sobald die Tabelle >127 ist sie nicht mehr nur ASCII.

Krass, stimmt. Das wird ja immer schlimmer.

Die Ausgabe, die oben steht ist ISO-8859-1 West Europe
 
Und zusätzlich muss der Zeichensatz zum Java-Programm gesetzt oder überprüft werden.
Java nutzt als Standard UTF-8, wenn nichts anderes definiert wurde (starke Behauptung, hab jetzt kein Beweis).
Der Zeichensatz von Strings ist intern immer UTF-16, nicht UTF-8, und kann auch nicht angepasst werden (außer man missbraucht String).

Die Ausgabe, die oben steht ist ISO-8859-1 West Europe

Nein - weder das, auch wenn es in dem Bereiche noch kompatibel ist, noch ASCII, noch UTF-8 - einfach nur UTF-16
 
Stimmt, API lesen hilft (manchmal):

The native character encoding of the Java programming language is UTF-16. A charset in the Java platform therefore defines a mapping between sequences of sixteen-bit UTF-16 code units (that is, sequences of chars) and sequences of bytes.

Aber UTF-16 ist auch ASCII-kompatibel.
 

Zurück
Oben