Calculadora de Similaridade de Strings
Compare duas strings com métricas de similaridade numérica exatas: distância de edição Levenshtein (com detalhamento de operações de inserção/exclusão/substituição e matriz DP visual), similaridade Jaro e Jaro-Winkler, distância de Hamming e similaridade cosseno de bigramas.
Entrada
Tratar "Palavra" e "palavra" como iguais em cada métrica abaixo.
Saída
| Métrica | Valor |
|---|---|
| No data yet | |
| Operação | Contagem |
|---|---|
| No data yet | |
Guias
Compare duas strings usando cinco algoritmos bem conhecidos de distância de string e similaridade de string ao mesmo tempo: distância de edição Levenshtein, similaridade Jaro e Jaro-Winkler, distância de Hamming e similaridade cosseno sobre bigramas de caracteres. Onde uma ferramenta de comparação de texto simples mostra o que mudou, esta ferramenta diz quanto — como números exatos e reproduzíveis.
Como usar
Digite ou cole String A e String B, e leia os resultados instantaneamente — a ferramenta recalcula a cada toque de tecla. Ative Ignorar maiúsculas/minúsculas para tratar "Palavra" e "palavra" como iguais em todos os métricas.
O que cada métrica significa
- Distância Levenshtein — o número mínimo de inserções, exclusões e substituições de caracteres únicos necessários para transformar String A em String B. A linha Similaridade Levenshtein expressa a mesma distância como uma percentagem (
1 − distância ÷ comprimento da string mais longa). - Operações de Edição Levenshtein — um detalhamento exato de quantas inserções, exclusões e substituições compõem esse script de edição mínimo, além de quantos caracteres correspondem sem alteração.
- Matriz de Distância Levenshtein — a tabela completa de programação dinâmica que o algoritmo constrói internamente, rotulada com linhas e colunas com os caracteres reais comparados. Leia uma célula como "a distância de edição entre os prefixos que terminam nesta linha e coluna". Omitido para strings mais longas que 25 caracteres, onde a grade deixa de ser legível.
- Similaridade Jaro — favorece strings que compartilham caracteres próximos em posição, tolerante a pequenas transposições (usado em sistemas de vinculação de registros e detecção de duplicatas).
- Similaridade Jaro-Winkler — similaridade Jaro aumentada para strings que compartilham um prefixo comum (até 4 caracteres), o que a torna uma escolha comum para corresponder nomes e identificadores curtos onde o início da string tende a ser mais confiável.
- Distância de Hamming — o número de caracteres diferentes na mesma posição, definido apenas quando ambas as strings têm o mesmo comprimento; mostrado como "N/A" caso contrário.
- Similaridade de Cosseno (bigramas) — trata cada string como um vetor de sequências de 2 caracteres sobrepostas e mede o ângulo entre elas, uma métrica comum em correspondência de texto fuzzy e detecção de quase-duplicatas.
Por que os algoritmos discordam?
Eles foram construídos para trabalhos diferentes. Levenshtein e Hamming contam edições brutas no nível dos caracteres, portanto, uma letra única inserida perto do início de uma string longa pode parecer uma grande mudança. Similaridade cosseno Jaro-Winkler e bigram pesam estrutura compartilhada mais que posição, portanto são frequentemente mais tolerantes com erros de digitação, reordenação e diferenças de comprimento — é por isso que sistemas de correspondência fuzzy e verificadores de ortografia tendem a favorecer sobre distância de edição simples.
É o mesmo que um diff de texto?
Não exatamente. Use esta ferramenta quando você precisa de um número preciso — desduplicando registros, ajustando um limiar de correspondência fuzzy, graduando o quão próxima uma resposta digitada está da correta. Para uma visualização lado a lado de exatamente quais palavras ou linhas mudaram entre dois blocos de texto, use a ferramenta Comparador de Texto em vez disso, ou o Verificador de Similaridade de Texto para uma pontuação geral de sobreposição de caracteres/palavras em trechos mais longos.
Privacidade
Tudo funciona no seu navegador — as strings que você digita nunca são enviadas para um servidor.
Mais formas de usar esta ferramenta
API REST
curl -X POST https://api.iotools.cloud/v1/tool/string-similarity-calculator \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"stringA": "kitten",
"stringB": "sitting",
"caseInsensitive": ""
}'Troque pela sua própria chave, da sua conta. Os campos da ferramenta viram o corpo da requisição — sem envelope.
Peça a um agente de IA
Use the IOTools `string-similarity-calculator` tool (String Similarity Calculator) on this input:
YOUR_INPUT_HERECole isto em qualquer agente conectado ao servidor MCP do IOTools e depois adicione sua entrada.
Widget para incorporar
<iframe
src="https://iotools.cloud/embed/string-similarity-calculator/"
width="100%" height="520" frameborder="0" scrolling="no" loading="lazy"
title="Calculadora de Similaridade de Strings — iotools.cloud"
sandbox="allow-scripts allow-forms allow-same-origin allow-downloads allow-popups allow-popups-to-escape-sandbox"
allow="clipboard-write"
style="width:100%;border:1px solid #e5e7eb;border-radius:12px;overflow:hidden"></iframe>
<script src="https://iotools.cloud/embed.js" async></script>Coloque isso na sua própria página — grátis, sem chave, só um link de volta.
| Custo por chamada | A partir de 5 créditos |
|---|