ForHosting KIT · Entwickler-Tools

Lexikalische Dichte berechnen

Die lexikalische Dichte zeigt, welcher Anteil eines Textes auf Inhaltswörter und nicht hauptsächlich auf grammatische Bindeglieder entfällt.

● BetaKostenlos · im Browser
Nutzen Sie es über WebAPIE-MailTelegramApp bald

Dieser Rechner zerlegt einen englischen Text in Wörter, trennt häufige Funktionswörter von wahrscheinlichen Substantiven, Verben, Adjektiven und Adverbien und teilt die Zahl der Inhaltswörter durch die Gesamtwortzahl. Die ausgegebenen Zählwerte machen die Schätzung nachvollziehbar und erleichtern Textvergleiche.

Was die lexikalische Dichte erkennen lässt

Die lexikalische Dichte ist ein kompakter Hinweis darauf, wie stark Informationen in einem Text konzentriert sind. Inhaltswörter tragen gewöhnlich das Thema, indem sie Personen, Gegenstände, Handlungen, Eigenschaften und Umstände benennen. Artikel, Pronomen, Konjunktionen, Hilfsverben und Präpositionen verbinden diese Gedanken zu grammatischen Sätzen. Ein hoher Anteil kann einen Text verdichtet, technisch oder formell wirken lassen; ein niedrigerer Anteil passt oft zu Gesprächen oder schrittweisen Erklärungen. Keine Richtung ist grundsätzlich besser. Vergleichen Sie Entwürfe für dieselbe Zielgruppe, Abschnitte desselben Dokuments oder Fassungen vor und nach einer Überarbeitung. Die Zählwerte zeigen, wie der Prozentwert zustande kommt, ersetzen jedoch nicht die inhaltliche Prüfung. Satzbau, Fachsprache, Kontext und Vorwissen der Leserschaft bleiben entscheidend, wenn Sie den tatsächlichen Überarbeitungsbedarf beurteilen.

Wie der Rechner Inhaltswörter schätzt

Das Werkzeug liefert eine deterministische Schätzung für englische Texte und keine vollständige grammatische Analyse. Es normalisiert Unicode-Text, erkennt alphabetische Wörter mit möglichen Apostrophen im Wortinneren, wandelt sie in Kleinbuchstaben um und gleicht sie mit einer festen Liste häufiger englischer Funktionswörter ab. Listeneinträge zählen als Funktionswörter; alle übrigen Treffer gelten als wahrscheinliche Inhaltswörter. Die Dichte ist deren Anteil an der Gesamtwortzahl und wird als Verhältnis sowie als Prozentwert ausgegeben. Das Verfahren ist schnell und wiederholbar, doch manche Wörter wechseln ihre grammatische Rolle je nach Zusammenhang. Namen, Fachbegriffe, seltene Kurzformen und Rechtschreibfehler werden meist als Inhalt eingestuft. Einzelne Zahlen und Satzzeichen zählen nicht als Wörter. Nutzen Sie für verlässliche Vergleiche dieselbe Sprache und einheitlich vorbereitete Texte.

Das Ergebnis richtig einordnen und nutzen

Beginnen Sie mit einer konkreten Frage und nicht mit einem vermeintlich idealen Prozentwert. Wirkt ein Absatz schwer, vergleichen Sie ihn mit einem klareren Absatz für dieselbe Leserschaft. Eine deutlich höhere Dichte kann auf gehäufte Fachbegriffe, stark verkürzte Erklärungen oder fehlende Verbindungen hinweisen. Wirkt eine Zusammenfassung vage, kann eine geringe Dichte zu viel Einleitung und zu wenig Sachgehalt anzeigen. Beachten Sie besonders bei kurzen Proben auch die Zählwerte, da dort ein einzelnes Wort den Prozentwert stark verändert. Halten Sie Überschriften, Zitate und Quellen zwischen Fassungen konsistent. Lexikalische Dichte misst weder Richtigkeit und Kohärenz noch Lesbarkeit, Satzkomplexität oder Wortschatzvielfalt. Die Wiederholung desselben Inhaltsworts kann die Dichte erhalten, ohne neue Information beizutragen. Verbinden Sie das Ergebnis deshalb mit menschlicher Prüfung und gegebenenfalls mit Satzlänge oder Type-Token-Verhältnis. Eine API-Anfrage kostet $0.002; im Browser sind schnelle Prüfungen möglich, ohne den Text anderweitig zu übermitteln.

Wissenschaftliche Abschnitte vergleichen

Finden Sie übermäßig verdichtete Absätze, indem Sie den Inhaltswortanteil in Abschnitten für dieselbe Zielgruppe vergleichen.

Lehrmaterial überarbeiten

Prüfen Sie, ob eine Erklärung nach der Bearbeitung dichter wurde, und stellen Sie anschließend ihre Verständlichkeit sicher.

Überarbeitungen dokumentieren

Halten Sie Zählwerte und Prozentangaben zweier Fassungen als Ergänzung zu einer menschlichen Stilprüfung fest.

Wie lautet die Formel für lexikalische Dichte?

Die Zahl der Inhaltswörter wird durch die Gesamtzahl der Wörter geteilt. Der Rechner multipliziert dieses Verhältnis außerdem mit 100 und gibt einen Prozentwert aus.

Was gilt als Inhaltswort?

Dazu zählen wahrscheinliche Substantive, Vollverben, Adjektive und Adverbien. Das Werkzeug schätzt sie, indem es eine feste Liste englischer Funktionswörter ausschließt.

Ist eine höhere lexikalische Dichte immer besser?

Nein. Sie kann zu knappen Fachtexten passen, aber die Leserschaft auch belasten. Zweck und Zielgruppe bestimmen, welcher Wert angemessen ist.

Führt das Werkzeug eine vollständige Wortartenanalyse durch?

Nein. Es nutzt eine nachvollziehbare Funktionswort-Heuristik; kontextabhängige Wortrollen können daher gelegentlich ungenau eingeordnet werden.

Werden Zahlen bei der Wortzahl berücksichtigt?

Nein. Erkannt werden alphabetische Wörter einschließlich innerer Apostrophe; alleinstehende Zahlen und Satzzeichen bleiben unberücksichtigt.

Was kostet die Berechnung über die API?

Jede API-Anfrage kostet $0.002. Die Berechnung ist deterministisch und verwendet weder externe Dienste noch Sprachmodelle.

Alles auf dieser Seite ist auch per API verfügbar. Dieser Abschnitt richtet sich an Teams, die es in ihre eigenen Systeme einbinden möchten; alle anderen nutzen einfach das Tool oben.

POSThttps://api.kit.forhosting.com/edu/lexical-density

Authentifizierung per Bearer-Token. Ein einziger POST stellt die Aufgabe in die Warteschlange; das Ergebnis erhalten Sie per Webhook oder über einen signierten Link.

curl -X POST https://api.kit.forhosting.com/edu/lexical-density \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"text":"The curious students carefully examined the ancient map in the quiet library."}'
{
  "text": "The curious students carefully examined the ancient map in the quiet library."
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "edu.lexical_density",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

Die API arbeitet asynchron: Sie erhalten sofort eine task_id. Polling ist mit 1 Anfrage pro Sekunde erlaubt.

pro Anfrage$0.002

Der Preis steht auf der Seite – keine Tokens, keine Credits. Fehlgeschlagene Aufgaben werden nicht berechnet.

max_chars100000
HTTPCodeBedeutung
401unauthorizedDer API-Schlüssel fehlt oder ist ungültig – prüfen Sie den Authorization-Header (Bearer).
402insufficient_balanceIhr Guthaben reicht für diese Aufgabe nicht aus – Aufladungen verfallen nicht.
404unknown_typeUnbekannter Aufgabentyp – prüfen Sie das Feld „type“ gegen den Katalog.
429rate_limitedZu viele Anfragen – warten Sie kurz; Polling ist mit 1 Anfrage pro Sekunde erlaubt.

Vollständige KIT-Dokumentation lesen →