Wenn Sie hreflang für Kasachstan einrichten, ist der erste Instinkt, KZ einzugeben. Dies ist der Ländercode gemäß ISO 3166-1. Der Sprachcode stammt aus einem anderen Standard, ISO 639-1, und für Kasachisch ist er kk. Für Armenisch ist es hy, für Georgisch ka, für Tadschikisch tg. Keiner stimmt mit dem Ländercode überein.
Die Verwirrung entsteht, weil die Codes ähnlich sind: KZ und kk, AM und hy, GE und ka. Dies ist die Hauptfalle bei der Einrichtung von hreflang, Sprachumschaltern und der Übergabe von Lokalisierungen an Zahlungssysteme.
Wie man Sprachen im Umschaltmenü schreibt
„Kasachisch“ oder „Kazakh“ im Menü sieht genauso seltsam aus, als ob in der englischen Benutzeroberfläche „Russian“ anstelle von „Русский“ stünde.
Redaktionelle Websites verwenden fast immer vollständige native Namen. tengrinews.kz – „Қазақша / Русский / English“, khovar.tj – „Тоҷикӣ / Русский / English“, armenpress.am – „Հայերեն“ neben dem Globus-Symbol. Kurze Codes (2–3 Zeichen) sind nur dort gerechtfertigt, wo wenig Platz ist: Bedienfelder, mobile Menüs, kompakte SaaS-Oberflächen.
Native Namen und Abkürzungen
Für jede Sprache separat
Kasachisch. Ein Entwickler ohne Kasachischkenntnisse tippt im Code K statt Қ – einfach weil es Қ auf der russischen Tastatur nicht gibt. Im Umschalter erscheint „Казакша“ statt „Қазақша“. Das sieht aus wie ein Tippfehler, ist aber technisch gesehen eine andere Zeichenfolge: Die Website-Suche funktioniert nicht mehr, die Sortierung verschiebt sich. Die Abkürzung „КЗ“ ist aus demselben Grund falsch, richtig ist „ҚЗ“.
„Қазақша“ bedeutet „auf Kasachisch“ – eine umgangssprachliche, gebräuchliche Form. Auf offiziellen Websites wird manchmal „Қазақ тілі“ (kasachische Sprache) geschrieben, aber im Menü ist „Қазақша“ kürzer. Vergleichen Sie: „Казак“ (Kosak, Person) und „Қазақ“ (kasachisches Volk) – das zweite Wort kann einfach nicht mit russischen Buchstaben geschrieben werden.
Kirgisisch. Hier gibt es selbst auf offiziellen Websites keinen einheitlichen Standard. kabar.kg schreibt „Кыр“, andere Regierungsressourcen – „Кырг“. Beide Varianten sind korrekt. Praktischer Tipp: Wählen Sie eine und halten Sie sich im gesamten Interface daran. „Кырг“ ist etwas eindeutiger, wenn Ihr Menü mehrere Abkürzungen mit „К“ enthält (Kasachisch, Kirgisisch, Russisch).
Sowohl „Кыргызча“ als auch „Кыргыз тили“ sind korrekt: Ersteres ist umgangssprachlicher („Kirgisisch sprechen“), Letzteres offizieller („kirgisische Sprache“). Für einen Umschalter ist „Кыргызча“ gebräuchlicher.
Armenisch. Dies ist die einzige Sprache in der Liste, bei der die Wahl des nativen Namens davon abhängt, wo das Publikum lebt – denn Armenisch existiert in zwei Varianten mit unterschiedlicher Orthographie (Wikipedia):
- Հայերեն – Ostarmenisch. Staatssprache Armeniens, reformierte sowjetische Orthographie. Wird in Armenien, Russland, Georgien, Iran gesprochen.
- Հայերէն – Westarmenisch. Klassische Orthographie, die in der Diaspora nach 1915 erhalten geblieben ist. Libanon, Frankreich, USA, Argentinien.
Der Unterschied liegt in einem Buchstaben: „ե“ im Ostarmenischen und „է“ im Westarmenischen. Aber auch der Wortschatz unterscheidet sich: „Flugzeug“ ist im Ostarmenischen „ինքնաթիռ“, im Westarmenischen „օդանաւ“. Eine Website für Armenien – Հայերեն. Für die armenische Diaspora – Հայերէն. Der ISO-Code ist für beide derselbe – hy, aber ISO 639-3 unterscheidet: hye (Ost) und hyw (West). Die Abkürzung „ՀԱՅ“ – von armenisch „Հայ“ (Armenier): „ՀԱ“ ohne den dritten Buchstaben ist als Wort nicht lesbar.
Tadschikisch. Das Problem ist dasselbe wie beim Kasachischen, aber sofort sichtbar: Ҷ steht im Namen der Sprache selbst. Wenn der Entwickler „ТЧ“ anstelle von „ТҶ“ eingibt, ist der Fehler direkt im Umschalter. Ҷ ist nicht „Ч“: Der Klang ist näher am englischen „j“ in „jump“, etwas zwischen „dsch“ und einem weichen „sch“. Das Außenministerium Tadschikistans schreibt auf mfa.tj genau „Ҷ“. Im Wort „Тоҷикӣ“ gibt es auch Ӣ (ein langes „i“), das ebenfalls nicht auf der russischen Tastatur zu finden ist.
Georgisch. Entwickler versuchen oft, „ქართული“ auf „Geo“ oder „GE“ zu kürzen – einfach weil sie nicht wissen, wie man mit nicht-lateinischen Schriftzeichen in der Benutzeroberfläche umgeht oder Angst vor Rendering-Problemen haben. Georgier erkennen das sofort: „GE“ wird als fremder technischer Code wahrgenommen, nicht als Muttersprache. Mchedruli – eine 1600 Jahre alte Schrift, die isoliert entstanden ist. „გამარჯობა“ bedeutet „Hallo“. Schreiben Sie „ქართული“ vollständig, auch in kompakten Benutzeroberflächen.
Gebietsschemas und Währungen
Ein Gebietsschema ist eine Kombination aus „Sprache + Land“. Es definiert das Format von Zahlen und Daten, das Währungssymbol und die Sortierreihenfolge. Im Gebietsschema wird der Sprachcode und nicht der Ländercode verwendet: kk_KZ, nicht kz_KZ. hy_AM, nicht am_AM. Die gleiche Logik wie bei ISO 639-1.
Währungscodes sind ein separater Standard, ISO 4217. Einige Nuancen:
Usbekischer So'm – offizielle Abkürzung, wird kleingeschrieben mit Apostroph. In Benutzeroberflächen wird oft einfach „Sum“ oder „UZS“ verwendet – beide Varianten sind akzeptiert.
Kasachstan und Russland teilen sich die Telefonvorwahl +7. Wenn in einem Registrierungsformular das Land automatisch anhand der Telefonnummer ermittelt wird, führt dies zu Problemen: +7 701 kann sowohl Moskau als auch Almaty sein. Fragen Sie das Land in einem separaten Feld ab oder ermitteln Sie es über die IP-Adresse.
In Georgien gibt es zwei Amtssprachen: Georgisch und Abchasisch. Für eine kommerzielle Website ist dies fast nie notwendig, aber wenn das Projekt staatlich ist oder auf Abchasien ausgerichtet ist, sollten Sie dies berücksichtigen.
Schriftarten und Schriftsysteme
Wenn Google Font nur mit dem kyrillischen Bereich verbunden ist, wird der armenische und georgische Text nicht in der gewünschten Schriftart angezeigt – der Browser verwendet einen System-Fallback, und die Seite sieht inkonsistent aus. Der armenische Unicode-Block ist U+0530–U+058F, der georgische U+10A0–U+10FF. Noto Sans von Google deckt beide ab – verwenden Sie es als Ersatzschriftart für diese Sprachen.
Die meisten GUS-Sprachen verwenden das kyrillische Alphabet, aber drei Länder sind nach dem Zerfall der UdSSR zum lateinischen Alphabet übergegangen: Usbekistan 1993, Aserbaidschan 1991. Dort findet man Kyrillisch noch in alten Dokumenten und bei der älteren Generation, aber neue Inhalte sind in Latein. Kasachstan begann den Übergang 2017, die neue Orthographie wurde 2023 genehmigt. Dies ist bereits der dritte Alphabetwechsel in hundert Jahren: arabische Schrift, dann Jaŋalif (sowjetisches Latein in den 1930er Jahren), dann Kyrillisch, jetzt wieder Latein.
Usbekisch benötigt keine separate Schriftart – es verwendet das Standard-Latein plus einen Apostroph in O'zbekcha. Die meisten lateinischen Schriftarten decken dies ab. Überprüfen Sie nur das Zeichen ʻ (U+02BB) – es ist nicht überall vorhanden.
Armenisch und Georgisch sind völlig eigenständige Systeme, die weder mit dem kyrillischen noch mit dem lateinischen Alphabet oder miteinander verwandt sind. Das armenische Alphabet wurde 405 von dem Mönch Mesrop Maschtoz zur Übersetzung der Bibel geschaffen. Das georgische Mchedruli ist ungefähr gleich alt.
Buchstaben, die nicht auf der russischen Tastatur vorhanden sind
Kasachisch und Tadschikisch enthalten Buchstaben, die auf dem Bildschirm leicht mit russischen verwechselt werden können, aber technisch sind es unterschiedliche Unicode-Zeichen. Die Suche auf der Website findet das Wort nicht, die Sortierung wird durcheinandergebracht, und Muttersprachler werden es sofort bemerken.
Im Kasachischen gibt es 42 Buchstaben – 33 Standard- plus 9 spezielle: Ә, Ғ, Қ, Ң, Ө, Ұ, Ү, Һ, І. Im Tadschikischen gibt es eigene 6 zusätzliche: Ғ, Ҳ, Қ, Ҷ, Ӣ, Ӯ.
Қ und К unterscheiden sich bei genauer Betrachtung (Қ hat einen kleinen Schwanz unten) – aber auf einer russischen Tastatur gibt es Қ einfach nicht. Jemand tippt „Kasakscha“ statt „Қазақша“, nicht weil er unaufmerksam ist, sondern weil die benötigte Taste nicht verfügbar ist. Oder er kopiert aus einer Quelle, in der eine solche Ersetzung bereits vorgenommen wurde, und bemerkt es nicht.
Praktisch wichtig sind die Buchstaben in Sprachnamen und Abkürzungen: Қ in „Қазақша“ und „ҚЗ“, Ҷ und Ӣ in „Тоҷикӣ“ und „ТҶ“, І in kasachischen Wörtern. Wenn Sie Text aus einer externen Quelle einfügen – überprüfen Sie ihn. Fügen Sie das verdächtige Zeichen auf unicode.org ein und Sie werden sofort sehen, was dieser Punkt ist.
Häufig gestellte Fragen
Welche Sprache soll für Kasachstan standardmäßig eingestellt werden – Russisch oder Kasachisch?
Für die meisten kommerziellen Websites ist Russisch als Standard sicherer, besonders wenn die Zielgruppe über 35 ist oder es sich um B2B handelt. Laut der Volkszählung von 2021 beherrschen etwa 80 % der Bevölkerung Kasachisch, etwa 70 % Russisch, und diese überschneiden sich stark. Für eine junge oder staatliche Zielgruppe ist Kasachisch besser geeignet.
Wird eine separate Website-Version für Westarmenisch benötigt?
Nur wenn Sie gezielt mit der armenischen Diaspora im Libanon, Frankreich oder den USA arbeiten. Für ein auf Armenien ausgerichtetes Projekt ist Ostarmenisch (hye) ausreichend. Der allgemeine Code hy wird technisch für beide Varianten akzeptiert.
Wie setze ich hreflang für Armenisch?
hreflang="hy" – für Ostarmenisch (Armenien). Für die westarmenische Diaspora theoretisch hyw, aber das ist ein nicht standardisierter Tag, und nicht alle Crawler verarbeiten ihn. Eine Version auf hy, die auf Armenien ausgerichtet ist, ist einfacher.
Was ist mit Kasachisch jetzt – Kyrillisch oder Lateinisch?
Kyrillisch. Offizieller Dokumentenfluss und die meisten Websites sind immer noch auf Kyrillisch. Die neue lateinische Orthographie wurde 2023 genehmigt, aber es gibt noch keinen Massenübergang. Die Situation wird von gov.kz überwacht.
Warum stimmen der Ländercode und der Sprachcode nicht überein – zum Beispiel Armenien AM, aber Armenisch hy?
Das sind zwei unabhängige Standards. ISO 3166-1 kodiert politische Einheiten (Länder), ISO 639-1 – linguistische (Sprachen). Armenisch erhielt den Code hy von dem latinisierten „Hayastan“ – der Eigenbezeichnung Armeniens. Georgisch – ka von „Kartuli“. Manchmal stimmen die Codes überein (ru/RU, uz/UZ), manchmal nicht (hy/AM, ka/GE, kk/KZ). Eine Übereinstimmung ist Zufall, keine Regel.