ForHosting KIT · Outils pour développeurs

Calculateur de densité lexicale

La densité lexicale indique quelle part d’un passage repose sur des mots de contenu plutôt que sur des éléments principalement grammaticaux.

● BetaGratuit · dans votre navigateur
Utilisez-le depuis WebAPIE-mailTelegramApp bientôt

Ce calculateur segmente un texte anglais, distingue les mots-outils courants des noms, verbes, adjectifs et adverbes probables, puis divise le nombre de mots de contenu par le nombre total de mots. Les comptes fournis rendent l’estimation transparente et facilitent la comparaison de plusieurs textes.

Ce que révèle la densité lexicale

La densité lexicale donne un aperçu synthétique de la concentration d’information dans un passage. Les mots de contenu portent généralement le sujet : ils désignent des personnes, des objets, des actions, des qualités et des circonstances. Les articles, pronoms, conjonctions, auxiliaires et prépositions relient ces idées pour former des phrases. Une proportion élevée peut produire un style compact, technique ou formel, tandis qu’une proportion plus faible peut convenir à une conversation ou à une explication progressive. Aucune valeur n’est intrinsèquement meilleure. Comparez des brouillons destinés au même public, des sections d’un même document ou des versions antérieures et postérieures à une révision. Les comptes expliquent la formation du pourcentage, mais celui-ci ne remplace pas votre lecture. La syntaxe, la terminologie, le contexte et les connaissances du lectorat restent essentiels pour décider si une modification est souhaitable.

Comment les mots de contenu sont estimés

L’outil fournit une estimation déterministe pour l’anglais et non une analyse grammaticale complète. Il normalise le texte Unicode, reconnaît les mots alphabétiques comportant éventuellement une apostrophe interne, les convertit en minuscules et les confronte à une liste fixe de mots-outils fréquents. Les éléments de cette liste sont classés comme fonctionnels ; les autres deviennent des mots de contenu probables. La densité correspond au quotient du nombre de mots de contenu par le total, présenté sous forme de proportion et de pourcentage. Cette méthode est rapide et reproductible, mais certains mots changent de rôle selon le contexte. Les noms propres, termes spécialisés, contractions rares et fautes d’orthographe sont généralement considérés comme du contenu. Les nombres et signes de ponctuation isolés sont exclus. Pour comparer des résultats, utilisez la même langue et des règles de préparation identiques.

Interpréter et exploiter le résultat

Partez d’une question concrète plutôt que d’un pourcentage idéal. Si un paragraphe semble lourd, comparez-le à un passage plus clair destiné aux mêmes lecteurs. Une densité nettement supérieure peut signaler une accumulation de termes, des explications trop comprimées ou trop peu de liaisons. Si un résumé paraît vague, une densité faible peut révéler un excès de cadrage et trop peu de matière. Examinez aussi les comptes, surtout pour les courts extraits où un seul mot modifie fortement le résultat. Conservez citations, titres et références de façon cohérente entre les versions. La densité lexicale ne mesure ni l’exactitude, ni la cohérence, ni la lisibilité, ni la complexité syntaxique, ni la diversité du vocabulaire. Répéter un même mot de contenu peut maintenir la densité sans enrichir l’information. Associez donc ce résultat à une relecture humaine et, si nécessaire, à la longueur des phrases ou au rapport type-occurrence. L’API coûte $0.002 par requête ; le calcul dans le navigateur permet des vérifications rapides sans envoyer le passage ailleurs.

Comparer des sections universitaires

Repérez les paragraphes trop concentrés en comparant la part des mots de contenu dans des sections destinées au même public.

Réviser des supports pédagogiques

Vérifiez si une explication s’est densifiée après révision, puis assurez-vous qu’elle reste accessible aux apprenants.

Suivre les révisions

Consignez les comptes et le pourcentage de deux versions afin de compléter une appréciation humaine du style.

Quelle est la formule de la densité lexicale ?

Il s’agit du nombre de mots de contenu divisé par le nombre total de mots. Le calculateur multiplie aussi cette proportion par 100 pour fournir un pourcentage.

Qu’est-ce qu’un mot de contenu ?

Il s’agit probablement d’un nom, d’un verbe principal, d’un adjectif ou d’un adverbe. L’outil les estime en excluant une liste fixe de mots-outils anglais.

Une densité supérieure est-elle toujours préférable ?

Non. Elle peut convenir à un texte technique concis, mais aussi surcharger le lecteur. L’objectif et le public déterminent la valeur appropriée.

L’outil effectue-t-il un étiquetage grammatical complet ?

Non. Il emploie une heuristique transparente fondée sur les mots-outils ; certains rôles dépendant du contexte peuvent donc être classés imparfaitement.

Les nombres sont-ils inclus dans le compte ?

Non. Le segmenteur compte les mots alphabétiques, y compris ceux avec une apostrophe interne, mais exclut les nombres et la ponctuation isolée.

Quel est le prix du calcul par API ?

Chaque requête API coûte $0.002. Le calcul est déterministe et n’utilise ni service externe ni modèle de langue.

Tout sur cette page est disponible par programmation. Cette section s'adresse aux équipes qui veulent l'intégrer à leurs systèmes ; les autres peuvent simplement utiliser l'outil ci-dessus.

POSThttps://api.kit.forhosting.com/edu/lexical-density

Authentification par jeton Bearer : un seul POST met la tâche en file d’attente, et le résultat vous parvient par webhook ou lien signé.

curl -X POST https://api.kit.forhosting.com/edu/lexical-density \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"text":"The curious students carefully examined the ancient map in the quiet library."}'
{
  "text": "The curious students carefully examined the ancient map in the quiet library."
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "edu.lexical_density",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

L’API est asynchrone : chaque appel renvoie un task_id immédiatement, puis vous interrogez l’état à raison d’une requête par seconde.

par requête$0.002

Le prix est publié, sans tokens ni crédits. Une tâche qui échoue n’est pas facturée.

max_chars100000
HTTPCodeSignification
401unauthorizedClé API absente ou invalide : vérifiez l’en-tête Authorization.
402insufficient_balanceSolde insuffisant : rechargez votre compte pour lancer cette tâche.
404unknown_typeType de tâche inconnu : vérifiez le champ type de votre requête.
429rate_limitedTrop de requêtes : ralentissez la cadence, puis réessayez.

Consulter la documentation complète du KIT →