Pular para o conteúdo principal

Calculadora de Similaridade de Strings

Compare duas strings com métricas de similaridade numérica exatas: distância de edição Levenshtein (com detalhamento de operações de inserção/exclusão/substituição e matriz DP visual), similaridade Jaro e Jaro-Winkler, distância de Hamming e similaridade cosseno de bigramas.

Entrada

Tratar "Palavra" e "palavra" como iguais em cada métrica abaixo.

Saída

Métricas de Similaridade
MétricaValor
No data yet
Operações de Edição Levenshtein (A → B)
OperaçãoContagem
No data yet
Matriz de Distância Levenshtein
 
Isso foi útil?

Guias

Compare duas strings usando cinco algoritmos bem conhecidos de distância de string e similaridade de string ao mesmo tempo: distância de edição Levenshtein, similaridade Jaro e Jaro-Winkler, distância de Hamming e similaridade cosseno sobre bigramas de caracteres. Onde uma ferramenta de comparação de texto simples mostra o que mudou, esta ferramenta diz quanto — como números exatos e reproduzíveis.

Como usar

Digite ou cole String A e String B, e leia os resultados instantaneamente — a ferramenta recalcula a cada toque de tecla. Ative Ignorar maiúsculas/minúsculas para tratar "Palavra" e "palavra" como iguais em todos os métricas.

O que cada métrica significa

  • Distância Levenshtein — o número mínimo de inserções, exclusões e substituições de caracteres únicos necessários para transformar String A em String B. A linha Similaridade Levenshtein expressa a mesma distância como uma percentagem (1 − distância ÷ comprimento da string mais longa).
  • Operações de Edição Levenshtein — um detalhamento exato de quantas inserções, exclusões e substituições compõem esse script de edição mínimo, além de quantos caracteres correspondem sem alteração.
  • Matriz de Distância Levenshtein — a tabela completa de programação dinâmica que o algoritmo constrói internamente, rotulada com linhas e colunas com os caracteres reais comparados. Leia uma célula como "a distância de edição entre os prefixos que terminam nesta linha e coluna". Omitido para strings mais longas que 25 caracteres, onde a grade deixa de ser legível.
  • Similaridade Jaro — favorece strings que compartilham caracteres próximos em posição, tolerante a pequenas transposições (usado em sistemas de vinculação de registros e detecção de duplicatas).
  • Similaridade Jaro-Winkler — similaridade Jaro aumentada para strings que compartilham um prefixo comum (até 4 caracteres), o que a torna uma escolha comum para corresponder nomes e identificadores curtos onde o início da string tende a ser mais confiável.
  • Distância de Hamming — o número de caracteres diferentes na mesma posição, definido apenas quando ambas as strings têm o mesmo comprimento; mostrado como "N/A" caso contrário.
  • Similaridade de Cosseno (bigramas) — trata cada string como um vetor de sequências de 2 caracteres sobrepostas e mede o ângulo entre elas, uma métrica comum em correspondência de texto fuzzy e detecção de quase-duplicatas.

Por que os algoritmos discordam?

Eles foram construídos para trabalhos diferentes. Levenshtein e Hamming contam edições brutas no nível dos caracteres, portanto, uma letra única inserida perto do início de uma string longa pode parecer uma grande mudança. Similaridade cosseno Jaro-Winkler e bigram pesam estrutura compartilhada mais que posição, portanto são frequentemente mais tolerantes com erros de digitação, reordenação e diferenças de comprimento — é por isso que sistemas de correspondência fuzzy e verificadores de ortografia tendem a favorecer sobre distância de edição simples.

É o mesmo que um diff de texto?

Não exatamente. Use esta ferramenta quando você precisa de um número preciso — desduplicando registros, ajustando um limiar de correspondência fuzzy, graduando o quão próxima uma resposta digitada está da correta. Para uma visualização lado a lado de exatamente quais palavras ou linhas mudaram entre dois blocos de texto, use a ferramenta Comparador de Texto em vez disso, ou o Verificador de Similaridade de Texto para uma pontuação geral de sobreposição de caracteres/palavras em trechos mais longos.

Privacidade

Tudo funciona no seu navegador — as strings que você digita nunca são enviadas para um servidor.

levenshteinjaro-winklerhamming distancecosine similarityedit distancefuzzy matchingstring distancerecord linkagespell check

Mais formas de usar esta ferramenta

API REST

curl -X POST https://api.iotools.cloud/v1/tool/string-similarity-calculator \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "stringA": "kitten",
    "stringB": "sitting",
    "caseInsensitive": ""
  }'

Troque pela sua própria chave, da sua conta. Os campos da ferramenta viram o corpo da requisição — sem envelope.

Peça a um agente de IA

Use the IOTools `string-similarity-calculator` tool (String Similarity Calculator) on this input:

YOUR_INPUT_HERE

Cole isto em qualquer agente conectado ao servidor MCP do IOTools e depois adicione sua entrada.

Widget para incorporar

<iframe
  src="https://iotools.cloud/embed/string-similarity-calculator/"
  width="100%" height="520" frameborder="0" scrolling="no" loading="lazy"
  title="Calculadora de Similaridade de Strings — iotools.cloud"
  sandbox="allow-scripts allow-forms allow-same-origin allow-downloads allow-popups allow-popups-to-escape-sandbox"
  allow="clipboard-write"
  style="width:100%;border:1px solid #e5e7eb;border-radius:12px;overflow:hidden"></iframe>
<script src="https://iotools.cloud/embed.js" async></script>

Coloque isso na sua própria página — grátis, sem chave, só um link de volta.

Custo por chamadaA partir de 5 créditos

Também disponível via

Ama as ferramentas? Livre-se dos anúncios.

Um único pagamento remove todos os anúncios da sua conta, para sempre. Sem assinatura, sem rastreamento.