Поиск плагиата в текстовых файлах с помощью хеширования шинглов

Курсовая · 20–25 страниц · Информатика · студент

Реализация алгоритма, который разбивает текст на цепочки слов и находит совпадения в чужой работе с заданным порогом.

Метод обнаружения заимствований, основанный на разбиении текста на короткие цепочки слов. Работа объясняет, как шинглы и их хеши позволяют быстро сравнивать документы. Студент напишет программу, которая находит процент совпадений между файлами.

Работа по этой теме — за несколько минут. План и структура бесплатно и без регистрации, оплата — только за готовый документ с оформлением по ГОСТ.

Сгенерировать текст курсовой по этой теме

Оглавление курсовой

  1. Теория шинглов и хеширования
    • Определение шингла и выбор его длины
    • Использование MinHash для уменьшения размерности
  2. Реализация поиска совпадений
    • Разбиение текста на шинглы и вычисление хешей
    • Сравнение множеств шинглов через коэффициент Жаккара
  3. Тестирование на примерах
    • Проверка на парах оригинальных и изменённых текстов
    • Оценка ложных срабатываний при разных настройках

Оглавление можно менять: перед оплатой вы бесплатно правите главы и параграфы под требования преподавателя.

Текст работы

Полный текст появится после заказа. Закажите первым.

Курсовая пишется с нуля по этому оглавлению — с оформлением по ГОСТ.

Заказать работу по этой теме