ForHosting KIT · Utilidades de desarrollo

Eliminar marcas diacríticas Unicode de un texto

Esta herramienta elimina las marcas diacríticas combinadas de un texto Unicode después de aplicar la descomposición canónica.

● BetaGratis · en su navegador
Úselo desde WebAPIEmailTelegramApp pronto

Letras acentuadas como é, ñ y ü pasan a sus formas base, mientras se conservan la puntuación, los espacios, los símbolos, las mayúsculas y minúsculas y las escrituras no relacionadas. El resultado sirve cuando un índice de búsqueda, identificador, nombre de archivo o slug necesita una representación insensible a los acentos, sin transliteraciones generales ni reglas ortográficas propias de un idioma. El proceso es determinista, se limita a la solicitud y devuelve un texto sencillo que usted puede copiar o encadenar con otra fase de normalización.

Qué hace la transformación

Unicode puede representar muchas letras acentuadas de más de una manera. Un carácter como é puede almacenarse como un único punto de código precompuesto o como una letra base e seguida de un acento agudo combinado. La comparación visual no permite saber qué representación se ha usado. Esta capacidad aplica primero la descomposición canónica Unicode, conocida normalmente como NFD, para expresar los caracteres que admiten descomposición canónica como caracteres base seguidos de sus marcas. A continuación elimina los caracteres de todas las categorías de marcas Unicode. Así, ejemplos como café, piñata y Ångström se convierten en cafe, pinata y Angstrom. No cambia el texto a minúsculas, no reduce espacios, no elimina signos de puntuación ni sustituye símbolos. Tampoco garantiza una transliteración completa a ASCII: letras sin descomposición canónica, como ł, se conservan. Este alcance reducido es deliberado. Ofrece a usted una operación de normalización predecible que puede combinar con reglas independientes para minúsculas, puntuación o formato de slugs, sin esconder transformaciones adicionales dentro del proceso.

Cómo crear claves de búsqueda y slugs estables

Las búsquedas insensibles a los acentos suelen funcionar mejor cuando se guardan por separado el valor original y una clave normalizada. Conserve la grafía original para mostrarla y pase el texto por esta capacidad para obtener un campo de comparación. Puede aplicar el mismo tratamiento a una consulta antes de buscar, de modo que quien escriba cafe encuentre café sin perder la etiqueta correctamente acentuada en los resultados. En una cadena de generación de slugs, use la salida en una fase inicial: elimine primero las marcas y después aplique minúsculas, sustituya los espacios y ejecute la política de puntuación de su proyecto. El orden importa porque la descomposición deja expuestas marcas que, de otro modo, seguirían unidas a letras precompuestas. La operación es determinista: la misma entrada Unicode siempre genera la misma salida y puede utilizarse con seguridad en claves de caché o preparaciones de datos repetibles. Sin embargo, normalizar no sustituye una ordenación sensible al idioma. Cada lengua decide de manera distinta si una letra acentuada es una variante o una letra diferente; conserve el texto original y elija este tipo de comparación solo cuando sea adecuado para su producto y sus usuarios.

Límites, escrituras y comprobaciones

La regla de eliminación abarca las marcas combinadas de todo Unicode, no solo el intervalo de acentos habitual en las lenguas de Europa occidental. Esto aporta coherencia técnica, pero también puede producir cambios importantes en sistemas de escritura donde las marcas contienen información esencial. Pruebe contenido representativo de todos los idiomas aceptados por su aplicación antes de usar el resultado en búsquedas, rutas o campos de identidad. Los selectores de variación de emoji y otros caracteres clasificados como marcas también pueden desaparecer; por eso conviene considerar la salida como una clave normalizada, no como una copia perfecta para mostrar. La descomposición canónica difiere intencionadamente de la descomposición de compatibilidad: las formas decorativas o de compatibilidad no se simplifican de manera general, y la herramienta no pretende ser un transliterador universal. Para comprobar el resultado, compare versiones precompuestas y descompuestas de una misma muestra y confirme que coinciden. Incluya además puntuación, texto no latino, emoji y letras que carezcan de descomposición. Esos casos indican si esta operación específica basta o si su cadena necesita otras fases de normalización elegidas explícitamente.

Crear claves de búsqueda sin acentos

Guarde un valor normalizado adicional para que las consultas sin acentos encuentren nombres y términos escritos correctamente.

Preparar texto para slugs de URL

Simplifique las letras acentuadas descomponibles antes de aplicar reglas de minúsculas, separadores y puntuación.

Comparar representaciones Unicode alternativas

Convierta grafías precompuestas y formas con marcas combinadas en la misma representación de letras base para compararlas de modo determinista.

¿Qué elimina esta capacidad?

Aplica la descomposición canónica Unicode y elimina caracteres pertenecientes a las categorías de marcas Unicode, incluidas las marcas diacríticas combinadas.

¿Convierte todo el texto a ASCII?

No. Los caracteres que no tienen una descomposición canónica en letras base permanecen intactos, al igual que la puntuación, los símbolos y las letras de otras escrituras.

¿Transforma el texto a minúsculas o crea un slug completo?

No. Las minúsculas, la sustitución de espacios, el filtrado de puntuación y las reglas de separadores deben aplicarse después como pasos explícitos.

¿Los acentos precompuestos y descompuestos producen el mismo resultado?

Sí. La descomposición canónica ocurre antes de eliminar las marcas, por lo que una é precompuesta y una e seguida de un acento agudo se simplifican de forma coherente.

¿Cuánto cuesta una solicitud de API?

Cada solicitud de API cuesta $0.002. La transformación también funciona en el ejecutor generado para el navegador porque no necesita red ni estado del servidor.

Todo lo de esta página está disponible por programación. Esta sección es para equipos que quieren integrarlo en sus sistemas; el resto puede usar la herramienta de arriba sin más.

POSThttps://api.kit.forhosting.com/str/remove-diacritic-marks

¿Prefiere automatizarlo? Un POST autenticado crea la tarea; el resultado llega por webhook o enlace firmado. La misma capacidad también se ejecuta aquí en la web, por email y desde Telegram — y pronto también desde nuestra app.

curl -X POST https://api.kit.forhosting.com/str/remove-diacritic-marks \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"text":"Crème brûlée — déjà vu in São Paulo"}'
{
  "text": "Crème brûlée — déjà vu in São Paulo"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "str.remove_diacritic_marks",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

La API es asíncrona: la llamada devuelve un task_id al instante y el resultado llega por webhook. El polling está limitado a 1 req/s por tarea.

Por solicitud$0.002

Precio publicado — sin tokens ni créditos inventados. Una tarea fallida no se cobra.

HTTPCódigoSignificado
401unauthorizedAPI key ausente o inválida.
402insufficient_balanceEl saldo no cubre el precio de la tarea.
404unknown_typeEl tipo de tarea no existe.
429rate_limitedDemasiadas peticiones. Use el webhook en vez de sondear.

Ver la documentación completa del KIT →