Atlas der Sprachen

Über die Daten und die Entstehung des Atlas

Der Atlas beruht auf offenen Datenbanken, die Sprachwissenschaftler aus aller Welt zusammengetragen haben. Hier steht, woher alles stammt, was gesichert ist und was nur eine Schätzung.

Was auf dem Globus zu sehen ist

Jeder Punkt ist eine Sprache. Die Liste der Sprachen stammt aus Glottolog, einer offenen Datenbank der Sprachen der Welt, die vom Max-Planck-Institut für evolutionäre Anthropologie in Leipzig betrieben wird. Der Atlas übernimmt alles, was Glottolog als Sprache führt und mit einer Position versieht: 7.967 Sprachen.

Ein Punkt steht dort, wo Glottolog die Sprache verortet, meist in der Mitte des Gebiets, in dem sie gesprochen wird. Selbst eine Sprache, die auf der ganzen Welt gesprochen wird, hat nur einen Punkt – in ihrer Heimat.

Ausgelassen sind nur die Sonderkategorien von Glottolog: Verwaltungseinträge, Sprachen, die nur dem Namen nach bekannt sind, und Sprachen, über die so wenig bekannt ist, dass sie sich nicht klassifizieren lassen. Esperanto, Interlingua und Interslawisch haben keinen Punkt, weil sie nicht an einem bestimmten Ort entstanden sind; in der Liste und in der Suche sind sie dennoch enthalten.

Sprache oder Dialekt?

Zwischen Sprache und Dialekt gibt es keine scharfe Grenze, und oft spielen Geschichte und Politik mit hinein. Der Atlas folgt den Entscheidungen von Glottolog. Deshalb hat das Bairische einen Punkt, das australische Englisch aber nicht – Glottolog zählt es als Varietät des Englischen. Dialekte sind im Steckbrief der Sprache aufgeführt, und die Suche nach einem Dialekt findet seine Sprache.

Serbisch, Kroatisch, Bosnisch und Montenegrinisch sind für die Sprecher der jeweils anderen sehr leicht verständlich und beruhen auf derselben Dialektgrundlage, dem Štokavischen. Sprachwissenschaftlich sind sie einander nahestehende Standardvarietäten einer gemeinsamen Sprache; amtlich und gesellschaftlich sind sie heute eigenständige Sprachen. Glottolog führt sie als eine Sprache, Serbokroatisch, die einen Punkt auf dem Globus hat. Der Atlas enthält Serbisch und Kroatisch zusätzlich als eigene Sprachen mit Gruß, doch sie haben keinen eigenen Punkt. Das Hmong hingegen umfasst in Glottolog mehrere Sprachen und ist im Atlas ein Eintrag. Deshalb hat die Liste 7.970 Einträge und der Globus 7.967 Punkte.

164 Sprachen mit ausführlichem Steckbrief

Für 164 ausgewählte Sprachen bietet der Atlas einen Gruß, eine ungefähre Aussprache, eine Anmerkung, die Zahl der Sprecher und das Verbreitungsgebiet. Diese Angaben sind von Hand zusammengestellt, die Anmerkungen auf ihre Richtigkeit geprüft.

Die Ausspracheangabe ist nur ungefähr. Die Sprecherzahlen sind gerundete Schätzungen, die Zweitsprachler einschließen.

Die orangefarbene Fläche auf dem Globus ist von Hand gezeichnet und ungefähr, nicht gemessen. Offene Daten mit genauen Sprachgrenzen für die ganze Welt gibt es nicht.

Die Schaltfläche Aussprache abspielen nutzt die Sprachsynthese des Geräts; für manche Sprachen hat das Gerät keine Stimme.

Die Illustrationen zeigen die typische Landschaft und traditionelle Bauweise der Region, aus der die Sprache stammt. Sie stellen keine bestimmten Orte dar.

Angaben zu den übrigen Sprachen

Vitalität: die UNESCO-Skala (von sicher bis ausgestorben) auf Grundlage der Daten von Glottolog.

Typologie (Wortstellung, Kasus, Ton, Konsonanteninventar … – 24 Merkmale): WALS Online, der World Atlas of Language Structures (Dryer & Haspelmath 2013). WALS beschreibt eine Stichprobe von etwa 2600 Sprachen; die übrigen haben keinen Wert. Für die Karte sind manche Werte zu Gruppen zusammengefasst; der Steckbrief der Sprache zeigt immer den genauen WALS-Wert.

Zahl der Laute: PHOIBLE. Textprobe: Artikel 1 der Allgemeinen Erklärung der Menschenrechte (UDHR in Unicode).

Sprecherzahlen: Wikidata; wo diese fehlen, eine Schätzung von Unicode CLDR.

Schrift und Amtssprachenstatus: Unicode CLDR (languageData, territoryInfo). Der Status ist landesweit, de facto oder regional; CLDR verzeichnet ihn nur für Sprachen, deren Länderdaten es erfasst, daher fehlt er bei Minderheitensprachen oft, selbst wo sie einen gewissen amtlichen Status haben. Für die übrigen Sprachen verwendet die Schriftenkarte (Karten › Schrift) die Schätzung der Schrift aus CLDR likelySubtags, sodass die Karte insgesamt für etwa 6800 Sprachen eine Schrift zeigt. Der Steckbrief der Sprache kennzeichnet eine Schätzung als solche.

Verwandte und Stammbaum: der Baum von Glottolog mit den Zweignamen von Glottolog.

Nichts ist erfunden: Hat eine Quelle keine Daten, zeigt der Steckbrief sie nicht an.

Sprachen der Antike und Geschichten der Sprachen

Der Atlas verfasst die Seiten über antike Kulturen und die Geschichten der Sprachen auf Grundlage der am Ende jeder Seite aufgeführten Fachliteratur und prüft die Fakten vor der Veröffentlichung. Die Fotografien stammen aus Wikimedia Commons und stehen unter freien Lizenzen (CC BY, CC BY-SA, CC0 oder gemeinfrei); Urheber und Lizenz sind bei jedem Bild angegeben. Keilschriftzeichen und anatolische Hieroglyphen werden mit den Noto-Schriften dargestellt (SIL Open Font License).

Fragen an die KI

Versteht die Suche eine Frage nicht, können Sie eine KI fragen (Claude Sonnet 5.5 von Anthropic). Der Text der Frage wird über den Server des Atlas (Netlify) an Anthropic gesendet; der Atlas speichert keine Fragen. Die KI sucht nur in den Daten des Atlas (Glottolog, Unicode CLDR, Texte des Atlas) und baut ihre Antwort daraus auf; dennoch kann sie sich irren, deshalb trägt jede Antwort einen Hinweis. Sie beantwortet nur Fragen zu Sprachen, Schriften und Sprachfamilien.

Karte

Staatsgrenzen und Landflächen stammen aus Natural Earth (vereinfacht, Maßstab 1:110 Millionen). Relief und Meeresboden stammen aus Natural Earth und NOAA ETOPO1.

Datenversionen und Lizenzen

Glottolog – Sprachen, Familien, Vitalität, Dialekteheruntergeladen am 22. September 2026CC BY 4.0
WALS Online (2013) – Grammatikheruntergeladen am 26. September 2026CC BY 4.0
PHOIBLE 2.0 – Lauteheruntergeladen am 26. September 2026CC BY-SA 3.0
Wikidata – Sprecherzahlenheruntergeladen am 22. September 2026CC0
Unicode CLDR 48 – Sprachnamen, Schrift, Amtssprachenstatus, SchätzungenUnicode License
UDHR in Unicode – TextprobenPaket udhr 6.0.0MIT
Wikimedia Commons – Fotografien für die Seiten zu den Kulturenbei jedem BildCC BY, CC BY-SA, CC0
Natural Earth, NOAA ETOPO1 – Karte und Reliefgemeinfrei