Classez le vocabulaire par fréquence pour mieux l’enseigner
Ce classement par fréquence transforme une liste de mots envisagée en un ordre pédagogique exploitable.
Lancer gratuitement
Fournissez les mots à étudier et une table de fréquence générale issue d’un corpus adapté à vos apprenants. Le résultat place les mots référencés de la fréquence la plus élevée à la plus faible, conserve l’ordre initial en cas d’égalité et relègue à la fin les mots absents de la référence. Chaque résultat indique si une correspondance a été trouvée et la fréquence retenue, afin que les enseignants, concepteurs de programmes et équipes de produits éducatifs puissent vérifier le classement plutôt que d’accepter un score inexpliqué.
Choisissez une référence adaptée à vos apprenants
Un classement par fréquence n’est pertinent que si son corpus de référence l’est aussi. Commencez par une table étendue provenant de la langue et du registre dont vos apprenants ont besoin : conversation courante, anglais écrit général, manuels scolaires ou toute autre collection clairement définie. Chaque entrée doit comporter un mot et une fréquence positive ou nulle. Cette valeur peut être un nombre brut, un nombre d’occurrences par million de mots ou un autre taux cohérent, car le classement compare les valeurs sans imposer d’unité. Ne mélangez pas dans une table des chiffres issus de corpus différents : le nombre brut d’une source très vaste écraserait un taux normalisé provenant d’une source plus petite. Par défaut, la recherche ignore la casse et retire les espaces extérieurs ; « Water » peut donc correspondre à « water ». N’activez la sensibilité à la casse que si les majuscules distinguent des éléments importants du cours. Après cette normalisation, les clés doivent être uniques. Les doublons sont refusés au lieu d’être fusionnés silencieusement, ce qui garantit une origine claire à chaque fréquence et évite un ordre pédagogique arbitraire.
Interprétez le classement et les mots non trouvés
La réponse classe le vocabulaire trouvé de la fréquence de référence la plus élevée à la plus faible. Un mot grammatical courant peut ainsi précéder un mot de contenu familier, tandis qu’un terme spécialisé peut se retrouver beaucoup plus bas. Lorsque deux éléments ont exactement la même fréquence, ils conservent leur ordre dans la liste initiale. Le résultat reste donc stable d’une exécution à l’autre. Les mots absents de la table sont placés après tous les mots trouvés et gardent eux aussi leur ordre relatif. Leur fréquence vaut zéro et found_in_reference vaut false : ce champ booléen permet de ne pas les confondre avec de véritables correspondances. Les totaux indiquent combien d’éléments ont été trouvés ou non. La capacité conserve les répétitions de votre liste, car chaque position peut représenter un choix pédagogique intentionnel ; elle ne déduplique pas les mots et ne corrige pas leur orthographe. Considérez le rang comme un indice de priorité, non comme une mesure de difficulté. La fréquence décrit l’apparition d’une forme dans le corpus choisi, mais ne mesure ni sa complexité conceptuelle, ni sa prononciation, ni les besoins des apprenants, ni les prérequis pédagogiques.
Transformez les données du corpus en progression pédagogique
Servez-vous du classement comme première étape de la planification, puis exercez votre jugement professionnel. Les mots fréquents offrent généralement une forte exposition et une utilité précoce ; ils conviennent donc aux cours d’introduction, aux exercices de rappel ou à un espace limité de cartes mémoire. Toutefois, un mot moins fréquent peut être indispensable à un chapitre scientifique, une tâche professionnelle, un objectif d’examen ou une consigne de sécurité. Examinez séparément les éléments non trouvés : leur absence peut signaler un terme rare, mais aussi une variante orthographique, une forme fléchie, une expression de plusieurs mots ou une lacune du corpus. Pour rendre votre planification reproductible, consignez avec le résultat le nom, la version, la date et l’unité de fréquence du corpus, même si le calcul ne les exige pas. Le navigateur convient aux listes ponctuelles, tandis qu’un système automatisé peut appeler la même opération déterministe par l’API pour $0.002 par requête. Comme aucune consultation réseau n’a lieu, vous maîtrisez la référence et pouvez reproduire exactement la comparaison. Une méthode solide classe la liste, étudie les absences, ajoute l’importance curriculaire et le niveau, puis documente tout écart volontaire par rapport à l’ordre de fréquence.
Cas d’usage
Préparez un premier ensemble de mots
Placez les mots les plus largement rencontrés en premier lorsque le temps de cours ou le nombre de cartes est limité.
Auditez une liste de programme
Comparez les termes proposés à un corpus documenté et signalez les mots absents de la référence.
Priorisez le contenu linguistique
Obtenez un premier ordre stable avant que les éditeurs appliquent leurs critères de niveau, de thème et de pédagogie.
Questions fréquentes
Quels types de fréquences puis-je utiliser ?
Utilisez des nombres, des occurrences par million ou toute mesure numérique positive ou nulle, à condition que chaque ligne repose sur la même unité et le même corpus.
Que deviennent les mots absents de la table ?
Ils suivent tous les mots trouvés, avec found_in_reference à false et une fréquence nulle, tout en conservant l’ordre fourni.
Comment les égalités sont-elles départagées ?
Les mots ayant le même état de correspondance et la même fréquence gardent l’ordre de la liste initiale.
La recherche respecte-t-elle la casse ?
Pas par défaut. Elle retire les espaces extérieurs et ignore la casse, sauf si case_sensitive vaut true.
Quel est le prix d’une requête API ?
Chaque requête API coûte $0.002. Le même classement déterministe peut aussi être exécuté dans le navigateur.
Pour les développeurs — accès API
Tout sur cette page est disponible par programmation. Cette section s'adresse aux équipes qui veulent l'intégrer à leurs systèmes ; les autres peuvent simplement utiliser l'outil ci-dessus.
Endpoint
Authentification par jeton Bearer : un seul POST met la tâche en file d’attente, et le résultat vous parvient par webhook ou lien signé.
Appeler depuis votre stack
curl -X POST https://api.kit.forhosting.com/edu/vocabulary-list-frequency-rank \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"words":["photosynthesis","water","ecosystem","the"],"frequency_table":[{"word":"the","frequency":22038615},{"word":"water","frequency":31245},{"word":"ecosystem","frequency":2310}]}'const res = await fetch("https://api.kit.forhosting.com/edu/vocabulary-list-frequency-rank", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"words": [
"photosynthesis",
"water",
"ecosystem",
"the"
],
"frequency_table": [
{
"word": "the",
"frequency": 22038615
},
{
"word": "water",
"frequency": 31245
},
{
"word": "ecosystem",
"frequency": 2310
}
]
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/edu/vocabulary-list-frequency-rank",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"words": [
"photosynthesis",
"water",
"ecosystem",
"the"
],
"frequency_table": [
{
"word": "the",
"frequency": 22038615
},
{
"word": "water",
"frequency": 31245
},
{
"word": "ecosystem",
"frequency": 2310
}
]
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/edu/vocabulary-list-frequency-rank", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"words":["photosynthesis","water","ecosystem","the"],"frequency_table":[{"word":"the","frequency":22038615},{"word":"water","frequency":31245},{"word":"ecosystem","frequency":2310}]}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"words":["photosynthesis","water","ecosystem","the"],"frequency_table":[{"word":"the","frequency":22038615},{"word":"water","frequency":31245},{"word":"ecosystem","frequency":2310}]}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/edu/vocabulary-list-frequency-rank", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Exemple de requête
{
"words": [
"photosynthesis",
"water",
"ecosystem",
"the"
],
"frequency_table": [
{
"word": "the",
"frequency": 22038615
},
{
"word": "water",
"frequency": 31245
},
{
"word": "ecosystem",
"frequency": 2310
}
]
}Exemple de réponse
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "edu.vocabulary_list_frequency_rank",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}L’API est asynchrone : chaque appel renvoie un task_id immédiatement, puis vous interrogez l’état à raison d’une requête par seconde.
Tarifs
Le prix est publié, sans tokens ni crédits. Une tâche qui échoue n’est pas facturée.
Erreurs
| HTTP | Code | Signification |
|---|---|---|
401 | unauthorized | Clé API absente ou invalide : vérifiez l’en-tête Authorization. |
402 | insufficient_balance | Solde insuffisant : rechargez votre compte pour lancer cette tâche. |
404 | unknown_type | Type de tâche inconnu : vérifiez le champ type de votre requête. |
429 | rate_limited | Trop de requêtes : ralentissez la cadence, puis réessayez. |