Zifferngruppierung
die Gruppierung der Ziffern in längeren Zahlen
From Wikipedia, the free encyclopedia
Zifferngruppierung bezeichnet die Gruppierung der Ziffern in längeren Zahlen. In den meisten heutigen Sprachen werden größere Zahlen in einem Stellenwertsystem zur Basis Tausend gesprochen. Dort erleichtern Tausendertrennzeichen das Lesen großer Zahlen, mit deren Hilfe die Ziffern einer Zahl, bei der niedrigsten Stelle beginnend, in Dreiergruppen zusammengefasst werden. Historisch werden bei Verwendung von arabischen Ziffern die arabischen Trennzeichen verwendet: ein Hochkomma für Tausender und ein Komma für Dezimal. Heute üblich sind jedoch auch, je nach Region und Art der Schrift (beispielsweise Buchdruck vs. Handschrift), spezielle Leerzeichen, Punkt und Komma in unterschiedlicher Anordnung.
Das Internationale Einheitensystem SI verbietet die Verwendung von Punkt und Komma zur Zifferngruppierung und schreibt stattdessen ein dünnes Leerzeichen vor, um eine Verwechselung mit dem Dezimaltrennzeichen zu verhindern. Bei nur vier Ziffern vor oder nach dem Dezimaltrennzeichen sollte keine Gruppierung erfolgen.[1][2] In Unicode bietet sich das Narrow No-Break Space „ “ an, da es nicht nur schmaler als ein normales Leerzeichen ist, sondern auch einen Zeilenumbruch zwischen den Ziffern unterdrückt. (z. B. 123 456 789)
Methoden der Zifferngruppierung
Tausendertrennung
Überblick
Weit verbreitet ist die Gruppierung der Stellen in einem Stellenwertsystem der Zahlendarstellung in Dreierblöcken, im Dezimalsystem also in Potenzen von Tausend (Tausendertrennung).
Neben den Ziffern links des Dezimaltrennzeichens können auch die Ziffern rechts des Dezimaltrennzeichens, also die Nachkommastellen, gruppiert werden:
- 1 987 654 321,123 456 7
- 87 654 321,123 456 78
Die Gliederung von Zahlen in Zifferngruppen dient der besseren Lesbarkeit. Sie vereinfacht außerdem im Deutschen und z. B. im Englischen das Sprechen, da auch hier Zahlen in Dreiergruppen eingeteilt werden:
Die Zahl 123 456 789 wird ausgesprochen als
- einhundertdreiundzwanzig Millionen vierhundertsechsundfünfzigtausendsiebenhundertneunundachtzig
Die Einteilung in Dreiergruppen erleichtert auch das Arbeiten mit den Vorsätzen für Maßeinheiten, also den Präfixen Mikro, Milli, Kilo, Mega usw. Jede Dreiergruppe einer Zahl entspricht hier einem Vorsatz:
- 123 456 789 Watt = 123 456,789 Kilowatt = 123,456 789 Megawatt.
Auch die Umwandlung in die Exponentialschreibweise fällt leicht:
- 10 000 m = 10 km = 10e3 m = 10 × 103 m = = 1 × 104 m
Ausnahmen
Ausnahmen von der Einteilung in Dreiergruppen bilden beispielsweise Jahreszahlen (keine Einteilung), deutsche fünfstellige Postleitzahlen (keine Einteilung) oder Rufnummern (nach DIN 5008 Einteilung in Landesvorwahl, Ortsvorwahl und Rufnummer). Britische Postcodes werden abgeteilt: W1A 1AA.
Regelung in den Ländern
Relevante deutsche Normen sind DIN 1333, DIN 5008, international ISO 31 und ihr Nachfolger ISO 80000. Für Österreich gilt das Österreichische Wörterbuch.
- Deutschland/Österreich:
- Normaler Text: Punkt, Leerzeichen oder schmales Leerzeichen (
 ): 32.678 oder 32 678 - Mathematischer Formelsatz/TeX: Punkt oder schmales Leerzeichen: oder
- Vorkomma in Dreiergruppen, Nachkomma meist in Dreiergruppen: 31.415,926.535.897.932.384 oder 31.415,926 535 897 932 384
- Mitunter wird auch im deutschen Sprachraum die im englischen Sprachraum anzutreffende Komma-Notation verwendet, was zu Missverständnissen führen kann.
- Normaler Text: Punkt, Leerzeichen oder schmales Leerzeichen (
- Schweiz:
- Normaler Text: gerades Hochkomma: 31'415,926 beziehungsweise 31'415.926 (zu den unterschiedlichen Schreibweisen des Dezimalpunktes siehe Dezimaltrennzeichen#Schweiz)
- Amtliche Texte des Bundes:
- Festabstand: 1 222 333[3]
- Dezimalkomma wie in Deutschland 3,14159, bei Währung aber ein Punkt: CHF 29.95
- Englischer Sprachraum:
- Normaler Text: Komma, Leerzeichen oder schmales Leerzeichen: 32,768 oder 32 768
- Mathematischer Formelsatz/TeX: Komma oder schmales Leerzeichen: oder
- Vorkomma in Dreiergruppen, Nachkomma meist in Fünfergruppen: 31,415.92653,58979,32384 oder 31 415.92653 58979 32384
- Historische Schreibweisen (Euler, Laplace, Gauss, teilweise bis in die 1950er Jahre)
- unüblich oder schmales Leerzeichen
- Nachkommastellen häufig hochgestellt oder als Bruch: 3,14159, oder 3,14159 oder 3
Zifferngruppierung in der numerischen Mathematik
Abweichend von den Tausenderblöcken werden lange Ziffernreihen auch in Fünferblöcken gruppiert, so wie beispielsweise bei der Eulerschen Zahl: e = 2,71828 18284 59045 23536 02874 71352 7…
In der Astronomie gibt es ebenfalls lange Zahlenreihen, vor allem zur Berechnung der Umlaufbahnen (zudem genauer einzelner Bahnelemente oder auch sogenannter Ephemeriden), wie beispielsweise bei den Pariser Mond-Ephemeriden[Anm. 1] oder (allgemeiner) in den Variations séculaires des orbites planétaires sowie in den Berechnungen des JPL.[Anm. 2]
Andere Zahlensysteme
Im chinesischen Zahlensystem sowie bei Kulturen, die dieses übernommen haben (japanisches und koreanisches Zahlensystem), ist die Myriade (zehntausend, 1×104, chinesisch 萬 / 万, Pinyin wàn, kant./jap./kor. man) das größte elementare Zahlwort und damit Basiszahl für die Angabe größerer Zahlwerte. Große Zahlen werden daher in Blöcken zu je vier Ziffern gelesen. Eine Gliederung in Dreierblöcken hilft in solchen Sprachen in keiner Weise beim Lesen. Das hat zur Folge, dass auch für Mehrsprachler das simultane Übersetzen großer Zahlen z. B. zwischen Chinesisch und Englisch nicht einfach ist.
Im indischen Zahlensystem ist es üblich, zunächst die drei niedrigsten Stellen und anschließend jeweils zwei Stellen zu gruppieren sowie den Zahlen eigenständige Elementarnamen zu geben. So werden etwa für eine Million die Schreibweise 10'00'000 und die Bezeichnung 10 Lakh verwendet.
Binär- oder Hexadezimalzahlen: Vierergruppen: 0100 0001 oder FFFF FFFF. In Programmiersprachen sind ' und _ anzutreffen.
Schriftzeichen für die Zifferngruppierung
Als Gruppierungszeichen wurden und werden in verschiedenen Ländern und Sprachen unterschiedliche Zeichen benutzt:
- Leerraum
- 12 345: gewöhnliches Leerzeichen
- 12 345: Sechstelgeviert
- 12 345: schmales geschütztes Leerzeichen
- 12 345: punktbreites Leerzeichen
- 12 345: geschütztes Leerzeichen
- 12.345: Punkt
- 12,345: Komma
- 12′345: Minutenzeichen, Prime, Hochstrich
- 12'345: gerades Hochkomma
- 12’345: Apostroph, Hochkomma
Zur Problematik von Punkt und Komma für Tausender- und Dezimaltrennzeichen
Auch innerhalb des deutschen Sprachraums kann es ein Problem sein, dass die Zeichen Punkt und Komma optisch ähnlich sind. Dadurch entsteht die Möglichkeit von Verwechselungen etwa bei Zahlen, die mit nur einem Tausendertrennzeichen und ohne Nachkommastellen notiert wurden. Bei Verwendung eines Leerzeichens als Tausendertrennzeichen wird dieses Problem vermieden.
In Deutschland, Österreich und Frankreich wird das Komma als Dezimaltrennzeichen verwendet, während traditionell meist der Punkt als Tausendertrennzeichen dient. Das schmale Leerzeichen findet sich aber auch schon in Veröffentlichungen aus dem Anfang des 20. Jahrhunderts. Dagegen werden etwa in englischsprachigen Ländern die beiden Zeichen genau umgekehrt eingesetzt:
- Kontinentaleuropa, Russland, Südamerika: 123.456.789,123
- Vereinigtes Königreich, Irland, Vereinigte Staaten, Australien: 123,456,789.123
Eine Zahl wie etwa 12,345 kann daher nicht ohne weiteres korrekt interpretiert werden. Aus diesem Grund sehen Normen die Verwendung eines Leerzeichens als Tausendertrennzeichen vor (DIN 1333, DIN 5008 und ISO 80000).
In der Schweiz und in der Programmmiersprache C++ werden die Ziffern mit einem Hochstrich voneinander getrennt.
- Beispiel: 123'456'789.123 bzw. 123'456'789,123
Zu Problemen in Typografie und Computersatz
Für die Zifferngruppierung verwendet man typografischen Weißraum, der schmaler als der normale Wortabstand sein sollte. Oft wird ein Sechstelgeviert (six-per-em) empfohlen. Sofern das verwendete Computersystem Unicode richtig umsetzt, können dafür entsprechende Leerzeichen aus dem Unicodeblock Allgemeine Interpunktion verwendet werden.
Wird mit Leerzeichen gruppiert, ist ein geschütztes Leerzeichen notwendig, um einen Zeilenumbruch innerhalb der Ziffernkolonne zu vermeiden. Ebenso beim schmalen Leerzeichen, hier ist das schmale umbruchgeschützte Leerzeichen zu bevorzugen. Alternativ kann umbrechender Leerraum durch Zuweisen einer entsprechenden Formatierungseigenschaft vor dem Umbruch geschützt werden. Die Breite des Leerraums (mit normalem Leerzeichen) kann auch durch Skalierung, Spationierung, negativen Sperrsatz bzw. Verringerung des Wortabstands verändert werden.
Unter TeX und LaTeX stehen großer (5/18 Geviert) und kleiner Zwischenraum (3/18 Geviert) in der Form a\;b bzw. a\,b zur Verfügung.
Zu Problemen bei der Darstellung in der Programmierung
Nur wenige Programmiersprachen unterstützen das Gruppieren von Ziffern zur Erhöhung der Lesbarkeit und Vereinfachung der Fehlersuche (0xFFFFFFFFFFFFFFF != 0xFFFFFFFFFFFFFFFF vs. 0xFFF'FFFF'FFFF'FFFF != 0xFFFF'FFFF'FFFF'FFFF).
So ist es beispielsweise in Ada, D, Perl, Ruby, Rust, Java, C# und Verilog und VHDL möglich, Zahlen bei Bedarf mit dem Unterstrich _ zu gruppieren, in Algol 68 ist die Verwendung von Leerzeichen möglich, in den meisten anderen Programmiersprachen ist eine Entsprechung jedoch nicht zu finden. In C++14 wurde der einfache Apostroph ' als Gruppierungszeichen eingeführt.[4]
Siehe auch
Anmerkungen
- … im Französischen Éphéméride Lunaire Parisienne, zudem kurz ELP genannt; …
- … letztgenannte (Bahn-)Berechnungen sind (im Amerikanischen) auch bekannt als Jet Propulsion Laboratory Development Ephemeris. …