ForHosting KIT · Utilidades de desarrollo

Ordene vocabulario por frecuencia para priorizar la enseñanza

Este clasificador de frecuencia convierte una lista de palabras propuesta en un orden práctico para la enseñanza.

● BetaGratis · en su navegador
Úselo desde WebAPIEmailTelegramApp pronto

Proporcione las palabras que está considerando y una tabla de frecuencia general procedente de un corpus adecuado para sus estudiantes. El resultado coloca primero las palabras encontradas, de mayor a menor frecuencia, conserva el orden original cuando hay empates y lleva al final las ausentes de la referencia. Cada resultado indica si hubo coincidencia y qué frecuencia se utilizó, para que docentes, autores de currículos y equipos de productos educativos puedan revisar la clasificación en lugar de aceptar una puntuación sin explicación.

Elija una referencia de frecuencia adecuada para sus estudiantes

Una clasificación por frecuencia solo es pertinente si también lo es su corpus de referencia. Empiece con una tabla amplia obtenida de la lengua y del registro que sus estudiantes necesiten: conversación cotidiana, inglés escrito general, textos escolares u otra colección claramente definida. Cada entrada de la tabla debe incluir una palabra y un valor de frecuencia no negativo. Puede utilizar un recuento bruto, apariciones por millón de palabras u otra tasa coherente, porque el clasificador compara magnitudes y no presupone una unidad concreta. No mezcle recuentos de corpus distintos en una misma tabla: un recuento bruto de una fuente muy grande dominaría una tasa normalizada de otra menor. De forma predeterminada, las coincidencias no distinguen mayúsculas y eliminan espacios exteriores, por lo que «Water» puede coincidir con «water». Active la distinción de mayúsculas solo cuando estas separen elementos importantes para la lección. Las claves deben ser únicas después de normalizarlas; las duplicadas se rechazan en vez de combinarse silenciosamente. Así, cada frecuencia devuelta conserva un origen claro y las filas contradictorias no producen un orden arbitrario.

Interprete la lista ordenada y las palabras sin coincidencia

La respuesta ordena el vocabulario encontrado desde la frecuencia de referencia más alta hasta la más baja. Por ello, una palabra funcional común puede preceder a una palabra de contenido familiar, mientras que un término especializado puede aparecer mucho después. Si dos elementos tienen exactamente la misma frecuencia, mantienen el orden de la lista original, lo que ofrece un resultado estable entre ejecuciones. Las palabras que no figuran en la tabla se colocan después de todas las coincidentes y también conservan su orden relativo. Reciben frecuencia cero y el campo found_in_reference vale false, de modo que el campo booleano permite distinguirlas de coincidencias reales. Los totales indican cuántos elementos se encontraron y cuántos no. La capacidad conserva las repeticiones de la lista porque cada posición puede representar un elemento curricular deliberado; no elimina duplicados ni corrige la ortografía. Considere la posición una señal para priorizar, no una medida de dificultad. La frecuencia expresa cuántas veces aparece una forma en el corpus elegido, pero no mide complejidad conceptual, pronunciación, necesidad del estudiante ni requisitos pedagógicos previos.

Convierta la evidencia del corpus en una secuencia didáctica

Utilice la clasificación como primera aproximación al plan curricular y aplique después su criterio profesional. Las palabras frecuentes suelen ofrecer mayor exposición y utilidad temprana, por lo que son buenas candidatas para lecciones iniciales, prácticas de recuperación o espacios limitados de tarjetas. Sin embargo, una palabra menos frecuente puede ser imprescindible para una unidad de ciencias, una tarea laboral, un objetivo de examen o una instrucción de seguridad. Revise por separado los elementos no encontrados: su ausencia puede indicar rareza, pero también una variante ortográfica, una forma flexionada, una expresión de varias palabras o una carencia del corpus. Para reproducir la planificación, registre junto al resultado el nombre, la versión, la fecha y la unidad del corpus, aunque el cálculo no los necesite. El navegador resulta apropiado para listas individuales, mientras que los flujos curriculares automatizados pueden solicitar la misma operación determinista mediante la API por $0.002 por petición. Como no hay consultas de red, usted controla la referencia y puede repetir exactamente la comparación. Un proceso sólido ordena la lista, investiga las ausencias, incorpora importancia curricular y nivel, y documenta cualquier desviación deliberada del orden de frecuencia.

Planifique un conjunto inicial de palabras

Coloque primero las palabras de exposición más amplia cuando el tiempo de clase o el espacio para tarjetas sea limitado.

Audite una lista curricular

Compare los términos propuestos con un corpus documentado y señale los que no aparecen en la referencia.

Priorice contenido para aprender idiomas

Obtenga un primer orden estable antes de aplicar criterios de nivel, tema y metodología didáctica.

¿Qué valores de frecuencia puedo utilizar?

Use recuentos, apariciones por millón u otra medida numérica no negativa, siempre que todas las filas compartan la misma unidad y base de corpus.

¿Qué ocurre con las palabras ausentes de la tabla?

Aparecen después de todas las coincidencias, con found_in_reference en false y frecuencia cero, y conservan el orden enviado.

¿Cómo se resuelven los empates?

Las palabras con el mismo estado de coincidencia y la misma frecuencia mantienen el orden de la lista original.

¿Se distinguen mayúsculas y minúsculas?

No de forma predeterminada. Se eliminan los espacios exteriores y no se distingue el uso de mayúsculas, salvo que case_sensitive sea true.

¿Cuánto cuesta una petición a la API?

Cada petición a la API cuesta $0.002. La misma clasificación determinista también puede ejecutarse en el navegador.

Todo lo de esta página está disponible por programación. Esta sección es para equipos que quieren integrarlo en sus sistemas; el resto puede usar la herramienta de arriba sin más.

POSThttps://api.kit.forhosting.com/edu/vocabulary-list-frequency-rank

¿Prefiere automatizarlo? Un POST autenticado crea la tarea; el resultado llega por webhook o enlace firmado. La misma capacidad también se ejecuta aquí en la web, por email y desde Telegram — y pronto también desde nuestra app.

curl -X POST https://api.kit.forhosting.com/edu/vocabulary-list-frequency-rank \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"words":["photosynthesis","water","ecosystem","the"],"frequency_table":[{"word":"the","frequency":22038615},{"word":"water","frequency":31245},{"word":"ecosystem","frequency":2310}]}'
{
  "words": [
    "photosynthesis",
    "water",
    "ecosystem",
    "the"
  ],
  "frequency_table": [
    {
      "word": "the",
      "frequency": 22038615
    },
    {
      "word": "water",
      "frequency": 31245
    },
    {
      "word": "ecosystem",
      "frequency": 2310
    }
  ]
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "edu.vocabulary_list_frequency_rank",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

La API es asíncrona: la llamada devuelve un task_id al instante y el resultado llega por webhook. El polling está limitado a 1 req/s por tarea.

Por solicitud$0.002

Precio publicado — sin tokens ni créditos inventados. Una tarea fallida no se cobra.

HTTPCódigoSignificado
401unauthorizedAPI key ausente o inválida.
402insufficient_balanceEl saldo no cubre el precio de la tarea.
404unknown_typeEl tipo de tarea no existe.
429rate_limitedDemasiadas peticiones. Use el webhook en vez de sondear.

Ver la documentación completa del KIT →