Поиск плагиата в текстовых файлах с помощью хеширования шинглов
Курсовая · 20–25 страниц · Информатика · студент
Реализация алгоритма, который разбивает текст на цепочки слов и находит совпадения в чужой работе с заданным порогом.
Метод обнаружения заимствований, основанный на разбиении текста на короткие цепочки слов. Работа объясняет, как шинглы и их хеши позволяют быстро сравнивать документы. Студент напишет программу, которая находит процент совпадений между файлами.
Работа по этой теме — за несколько минут. План и структура бесплатно и без регистрации, оплата — только за готовый документ с оформлением по ГОСТ.
Сгенерировать текст курсовой по этой темеОглавление курсовой
-
Теория шинглов и хеширования
- Определение шингла и выбор его длины
- Использование MinHash для уменьшения размерности
-
Реализация поиска совпадений
- Разбиение текста на шинглы и вычисление хешей
- Сравнение множеств шинглов через коэффициент Жаккара
-
Тестирование на примерах
- Проверка на парах оригинальных и изменённых текстов
- Оценка ложных срабатываний при разных настройках
Оглавление можно менять: перед оплатой вы бесплатно правите главы и параграфы под требования преподавателя.
Текст работы
Полный текст появится после заказа. Закажите первым.
Курсовая пишется с нуля по этому оглавлению — с оформлением по ГОСТ.
Заказать работу по этой теме