Перейти к основному содержанию

Калькулятор Сходства Строк

Сравнивайте две строки с использованием точных метрик числовой схожести: расстояние редактирования Levenshtein (с описанием операций вставки/удаления/замены и визуальной матрицей DP), сходство Jaro и Jaro-Winkler, расстояние Hamming и косинусное сходство биграмм.

Ввод

Рассматривать "Слово" и "слово" как равные во всех метриках ниже.

Вывод

Метрики Сходства
МетрикаЗначение
No data yet
Операции Редактирования Levenshtein (A → B)
ОперацияКоличество
No data yet
Матрица Расстояния Levenshtein
 
Это было полезно?

Руководства

Сравнивайте две строки, используя пять хорошо известных алгоритмов расстояния строк и сходства строк одновременно: расстояние редактирования Levenshtein, сходство Jaro и Jaro-Winkler, расстояние Hamming и косинусное сходство над биграммами символов. Если обычный инструмент diff показывает что изменилось, этот инструмент показывает насколько — как точные, воспроизводимые числа.

Как его использовать

Введите или вставьте Строка A и Строка B, затем прочитайте результаты мгновенно — инструмент пересчитывается при каждом нажатии клавиши. Включите Игнорировать регистр для рассмотрения "Слово" и "слово" как равные во всех метриках ниже.

Что означает каждая метрика

  • Расстояние Levenshtein — минимальное количество вставок, удалений и замен отдельных символов, необходимых для преобразования строки A в строку B. Строка Сходство Levenshtein выражает то же расстояние в виде процентного соотношения (1 − расстояние ÷ длина более длинной строки).
  • Операции редактирования Levenshtein — подробное описание количества вставок, удалений и замен, составляющих этот минимальный скрипт редактирования, плюс количество символов, совпадающих без изменений.
  • Матрица расстояния Levenshtein — полная таблица динамического программирования, которую алгоритм строит внутренне, с метками строк и столбцов содержащими сравниваемые символы. Прочитайте ячейку как "расстояние редактирования между префиксами, заканчивающимися в этой строке и столбце". Пропускается для строк длиннее 25 символов, где сетка становится нечитаемой.
  • Сходство Jaro — награждает строки, которые содержат символы, близко расположенные по позиции, терпимо к небольшим перестановкам (используется в системах связывания записей и обнаружения дубликатов).
  • Сходство Jaro-Winkler — сходство Jaro усилено для строк, имеющих общий префикс (до 4 символов), что делает его распространённым выбором для сопоставления имён и коротких идентификаторов, где начало строки имеет тенденцию быть более надёжным.
  • Расстояние Hamming — количество различающихся символов в одной и той же позиции, определено только для строк одинаковой длины; показывается как "N/A" в противном случае.
  • Косинусное сходство (биграммы) — рассматривает каждую строку как вектор перекрывающихся двухсимвольных последовательностей и измеряет угол между ними, метрика, часто используемая при нечётком сопоставлении текста и обнаружении близких дубликатов.

Почему алгоритмы не согласны?

Они созданы для разных задач. Levenshtein и Hamming считают сырые правки на уровне символов, поэтому один вставленный символ в начале длинной строки может выглядеть как большое изменение. Косинусное сходство Jaro-Winkler и биграммы взвешивают общую структуру больше, чем позицию, поэтому они часто более терпимы к опечаткам, переупорядочению и различиям длины — вот почему системы нечёткого сопоставления и проверки орфографии, как правило, предпочитают их простому расстоянию редактирования.

Это то же самое, что текстовый diff?

Не совсем. Используйте этот инструмент, когда вам нужно точное число — дедупликация записей, настройка порога нечёткого сопоставления, оценка того, насколько близко введённый ответ к правильному. Для представления рядом-рядом того, какие слова или строки изменились между двумя блоками текста, используйте вместо этого инструмент Сравнение текста, или Проверку сходства текста для общей оценки перекрытия символов/слов на более длинных фрагментах.

Конфиденциальность

Всё выполняется в вашем браузере — введённые вами строки никогда не отправляются на сервер.

levenshteinjaro-winklerhamming distancecosine similarityedit distancefuzzy matchingstring distancerecord linkagespell check

Другие способы использовать этот инструмент

REST API

curl -X POST https://api.iotools.cloud/v1/tool/string-similarity-calculator \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "stringA": "kitten",
    "stringB": "sitting",
    "caseInsensitive": ""
  }'

Подставьте свой собственный ключ из аккаунта. Поля инструмента — это тело запроса, без обёртки.

Спросите у ИИ-агента

Use the IOTools `string-similarity-calculator` tool (String Similarity Calculator) on this input:

YOUR_INPUT_HERE

Вставьте это любому агенту, подключённому к MCP-серверу IOTools, и добавьте свой ввод.

Виджет для встраивания

<iframe
  src="https://iotools.cloud/embed/string-similarity-calculator/"
  width="100%" height="520" frameborder="0" scrolling="no" loading="lazy"
  title="Калькулятор Сходства Строк — iotools.cloud"
  sandbox="allow-scripts allow-forms allow-same-origin allow-downloads allow-popups allow-popups-to-escape-sandbox"
  allow="clipboard-write"
  style="width:100%;border:1px solid #e5e7eb;border-radius:12px;overflow:hidden"></iframe>
<script src="https://iotools.cloud/embed.js" async></script>

Вставьте это на свою страницу — бесплатно, без ключа, нужна лишь обратная ссылка.

Стоимость вызоваОт 5 кредитов

Также доступно через

Нравятся инструменты? Уберите рекламу.

Один платёж навсегда убирает всю рекламу с вашего аккаунта. Без подписки, без слежки.