🧰 UtlKit

Similitud de cadenas

Compara dos cadenas y calcula la distancia de Levenshtein.

Distancia
3
Similitud
57.1%
Operaciones
7
Similitud
Operaciones de edición (7)
1. Reemplazar 'k' → 's'
2. Coincidencia 'i'
3. Coincidencia 't'
4. Coincidencia 't'
5. Reemplazar 'e' → 'i'
6. Coincidencia 'n'
7. Insertar 'g'
🐛

Reportar un problema

¿Encontraste un error o tienes una sugerencia? Ayúdanos a mejorar esta herramienta.

📊 Resumen de datos (autocompletado)

Herramienta: string-similarity · /tools/string-similarity/

str1: kitten

str2: sitting

¿Qué es esta herramienta?

La Similitud de cadenas compara dos cadenas de texto y mide en qué medida se parecen mediante varios algoritmos. Admite distancia de Levenshtein (distancia de edición), similitud de Jaccard, similitud coseno y subsecuencia común más larga. Útil para coincidencias aproximadas, detección de plagio, corrección ortográfica y deduplicación de datos.

Cómo usar

  1. 1

    Introducir la primera cadena

    Introduce el primer texto a comparar.

  2. 2

    Introducir la segunda cadena

    Introduce el segundo texto a comparar.

  3. 3

    Ver resultados

    Ve las puntuaciones de similitud de varios algoritmos.

Preguntas frecuentes

¿Qué es la distancia de Levenshtein?

La distancia de Levenshtein cuenta el número mínimo de ediciones de un carácter (inserciones, eliminaciones, sustituciones) necesarias para transformar una cadena en otra. Una distancia de 0 significa cadenas idénticas. Menor distancia = más similares.

¿Qué algoritmo debo usar?

Levenshtein para errores tipográficos, Cosine para texto.

¿Puedo procesar textos muy grandes?

El navegador puede manejar texto de varios megabytes. Para archivos muy grandes, considera dividirlos primero.

¿Qué algoritmo de similitud de cadenas debo usar?

Para coincidencias tolerantes a errores de escritura en cadenas cortas, usa la distancia de Levenshtein (operaciones de edición). Para conjuntos o documentos más largos, usa Jaccard (solapamiento de conjuntos) o similitud de coseno sobre n-gramas de tokens/caracteres. Normaliza primero (minúsculas, recorte, normalización Unicode) antes de cualquier cálculo de distancia.