ForHosting KIT · Texto e IA

Eliminar palabras vacías de un texto en línea

Las palabras vacías son términos estructurales frecuentes, como artículos, conjunciones, pronombres y preposiciones breves.

● BetaGratis · en su navegador
Úselo desde WebAPIEmailTelegramApp pronto

Resultan necesarias en la escritura corriente, pero suelen añadir ruido al preparar búsquedas, revisar temas o crear un flujo sencillo de procesamiento textual. Esta herramienta selecciona una lista revisada según el código de idioma que usted indique, tokeniza el contenido de forma coherente, elimina las coincidencias sin alterar la grafía de las palabras conservadas y devuelve el texto depurado junto con recuentos útiles para comprobar el resultado.

Seleccione el idioma correspondiente al texto

Las palabras vacías dependen del idioma, por lo que el código lingüístico forma parte de la operación y no es un simple ajuste visual. El inglés repite con mucha frecuencia términos como «the», «is» y «and», mientras que el español, el francés, el alemán, el italiano y el portugués emplean artículos, pronombres, contracciones y preposiciones diferentes. Indique uno de los códigos de dos letras admitidos: en, es, fr, de, it o pt. La capacidad utilizará únicamente la lista revisada que corresponda. No intenta adivinar el idioma, ya que un texto breve puede ser ambiguo y una deducción incorrecta podría borrar términos relevantes sin avisar. Un código no admitido genera un error de entrada explícito, en vez de aplicar el inglés como alternativa. Si el material mezcla idiomas, separe primero los pasajes y procese cada uno con su código real. Así, el resultado será explicable, repetible y no descartará una palabra solo porque se parezca a una palabra vacía de otra lengua. Conserve el original siempre que la salida vaya a orientar decisiones editoriales o analíticas.

Comprenda cómo se seleccionan y devuelven las palabras

El algoritmo normaliza la entrada a una forma Unicode estable y extrae secuencias de letras o números, incluidas las palabras con apóstrofo recto o curvo en su interior. La comparación con la lista no distingue mayúsculas de minúsculas, pero los elementos conservados mantienen la grafía y el uso de mayúsculas del original. La puntuación no aparece en el texto depurado, porque la salida buscada es una secuencia de palabras relevantes y no una frase reescrita. La respuesta incluye una matriz ordenada de palabras, esas mismas palabras unidas en una cadena práctica y recuentos de términos de entrada, eliminados y restantes. Estos datos facilitan la comprobación de procesos por lotes y permiten medir cuánto afectó la lista a cada pasaje. El método es deliberadamente determinista: una entrada idéntica produce siempre la misma salida, sin modelos, detectores de idioma, solicitudes de red, azar ni contexto oculto. Una lista de palabras vacías es una convención útil, no una ley lingüística universal; revise por ello los términos cuando el vocabulario especializado sea importante.

Aplique las palabras depuradas a flujos de trabajo reales

Las secuencias depuradas sirven como transformación inicial cuando un paso posterior debe destacar el tema por encima de la estructura gramatical. Usted puede enviarlas a un contador de frecuencias, comparar el vocabulario de varios documentos, preparar etiquetas candidatas, revisar temas recurrentes en encuestas o reducir ruido en un índice de búsqueda sencillo. La salida no sustituye la obtención de raíces, la lematización, el reconocimiento de entidades, el análisis de sentimiento ni un sistema completo de lenguaje natural. Tampoco agrupa variantes de una palabra, decide su sentido por contexto ni reconstruye una prosa gramatical después del filtrado. Trate el resultado como un conjunto transparente de rasgos que conserva el orden de la fuente. En automatizaciones, valide los recuentos y guarde el código de idioma para poder reproducir la transformación. El procesamiento mediante API comienza en $0.002 por elemento y la opción del navegador usa la misma lógica pura. No presente el texto unido como cita: se han retirado deliberadamente la puntuación y los términos estructurales.

Preparar términos clave candidatos

Retire el relleno gramatical antes de revisar los términos que mejor describen un artículo, una nota o un producto.

Comparar vocabulario documental

Genere listas coherentes de palabras relevantes antes de contar vocabulario repetido en textos del mismo idioma.

Depurar respuestas de encuestas

Reduzca términos estructurales para que los temas recurrentes de las respuestas libres resulten más visibles.

¿Qué idiomas se admiten?

Inglés (en), español (es), francés (fr), alemán (de), italiano (it) y portugués (pt). Cualquier otro código genera un error de entrada.

¿La herramienta detecta automáticamente el idioma?

No. Usted indica el código de forma explícita para mantener un comportamiento predecible y evitar una lista incorrecta.

¿Se conservan las mayúsculas?

Sí. La comparación ignora las mayúsculas, pero cada término retenido mantiene la grafía y capitalización originales.

¿Qué ocurre con la puntuación?

Se excluye durante la tokenización. El resultado contiene una lista ordenada de términos relevantes y un texto unido por espacios.

¿La herramienta obtiene raíces o lemas?

No. Solo elimina las palabras vacías enumeradas; no combina variantes, infiere raíces ni analiza funciones gramaticales.

¿Cuánto cuesta el procesamiento por API?

El procesamiento por API comienza en $0.002 por elemento. También puede ejecutarse en el navegador con la misma lógica determinista.

Todo lo de esta página está disponible por programación. Esta sección es para equipos que quieren integrarlo en sus sistemas; el resto puede usar la herramienta de arriba sin más.

POSThttps://api.kit.forhosting.com/text/remove-stopwords

¿Prefiere automatizarlo? Un POST autenticado crea la tarea; el resultado llega por webhook o enlace firmado. La misma capacidad también se ejecuta aquí en la web, por email y desde Telegram — y pronto también desde nuestra app.

curl -X POST https://api.kit.forhosting.com/text/remove-stopwords \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"text":"The quick brown fox jumps over the lazy dog and runs into the forest.","language":"en"}'
{
  "text": "The quick brown fox jumps over the lazy dog and runs into the forest.",
  "language": "en"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "text.remove_stopwords",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

La API es asíncrona: la llamada devuelve un task_id al instante y el resultado llega por webhook. El polling está limitado a 1 req/s por tarea.

Por solicitud$0.002

Precio publicado — sin tokens ni créditos inventados. Una tarea fallida no se cobra.

max_tokens20000
HTTPCódigoSignificado
401unauthorizedAPI key ausente o inválida.
402insufficient_balanceEl saldo no cubre el precio de la tarea.
404unknown_typeEl tipo de tarea no existe.
429rate_limitedDemasiadas peticiones. Use el webhook en vez de sondear.

Ver la documentación completa del KIT →