<?xml version="1.0" encoding="UTF-8"?>
<!DOCTYPE article PUBLIC "-//NLM//DTD JATS (Z39.96) Journal Publishing DTD v1.3 20210610//EN" "JATS-journalpublishing1-3.dtd">
<article article-type="research-article" dtd-version="1.3" xmlns:mml="http://www.w3.org/1998/Math/MathML" xmlns:xlink="http://www.w3.org/1999/xlink" xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance" xml:lang="ru"><front><journal-meta><journal-id journal-id-type="publisher-id">sapi</journal-id><journal-title-group><journal-title xml:lang="ru">Системный анализ и прикладная информатика</journal-title><trans-title-group xml:lang="en"><trans-title>«System analysis and applied information science»</trans-title></trans-title-group></journal-title-group><issn pub-type="ppub">2309-4923</issn><issn pub-type="epub">2414-0481</issn><publisher><publisher-name>Belarusian National Technical University</publisher-name></publisher></journal-meta><article-meta><article-id pub-id-type="doi">10.21122/2309-4923-2018-1-71-78</article-id><article-id custom-type="elpub" pub-id-type="custom">sapi-206</article-id><article-categories><subj-group subj-group-type="heading"><subject>Research Article</subject></subj-group><subj-group subj-group-type="section-heading" xml:lang="ru"><subject>Информационные технологии в образовании</subject></subj-group><subj-group subj-group-type="section-heading" xml:lang="en"><subject>Information technologies in education</subject></subj-group></article-categories><title-group><article-title>АЛГОРИТМИЧЕСКАЯ И ПРОГРАММНАЯ РЕАЛИЗАЦИЯ ОПРЕДЕЛЕНИЯ ПЛАГИАТА В СИСТЕМАХ УПРАВЛЕНИЯ ОБУЧЕНИЕМ</article-title><trans-title-group xml:lang="en"><trans-title>ALGORITHMIC AND PROGRAM IMPLEMENTATION OF THE PLAGIARISM DEFINITION IN LEARNING MANAGEMENT SYSTEMS</trans-title></trans-title-group></title-group><contrib-group><contrib contrib-type="author" corresp="yes"><name-alternatives><name name-style="eastern" xml:lang="ru"><surname>Попова</surname><given-names>Ю. Б.</given-names></name><name name-style="western" xml:lang="en"><surname>Popova</surname><given-names>Y. B.</given-names></name></name-alternatives><bio xml:lang="ru"><p>Попова Юлия Борисовна - кандидат технических наук, доцент кафедры программного обеспечения вычислительной техники и автоматизированных систем БНТУ.</p></bio><bio xml:lang="en"/><xref ref-type="aff" rid="aff-1"/></contrib><contrib contrib-type="author" corresp="yes"><name-alternatives><name name-style="eastern" xml:lang="ru"><surname>Голобурда</surname><given-names>А. В.</given-names></name><name name-style="western" xml:lang="en"><surname>Goloburda</surname><given-names>A. V.</given-names></name></name-alternatives><bio xml:lang="ru"><p>Голобурда Александр Вячеславович –  магистрант кафедры программного обеспечения вычислительной техники и автоматизированных систем БНТУ.</p></bio><bio xml:lang="en"><p>Alexander Goloburda - Maste</p></bio><xref ref-type="aff" rid="aff-1"/></contrib></contrib-group><aff-alternatives id="aff-1"><aff xml:lang="ru"><institution>Белорусский национальный технический университет</institution><country>Беларусь</country></aff><aff xml:lang="en"><institution>Belarusian National Technical University</institution><country>Belarus</country></aff></aff-alternatives><pub-date pub-type="collection"><year>2018</year></pub-date><pub-date pub-type="epub"><day>12</day><month>06</month><year>2018</year></pub-date><volume>0</volume><issue>1</issue><fpage>71</fpage><lpage>78</lpage><permissions><copyright-statement>Copyright &amp;#x00A9; Попова Ю.Б., Голобурда А.В., 2018</copyright-statement><copyright-year>2018</copyright-year><copyright-holder xml:lang="ru">Попова Ю.Б., Голобурда А.В.</copyright-holder><copyright-holder xml:lang="en">Popova Y.B., Goloburda A.V.</copyright-holder><license xml:lang="ru" license-type="creative-commons-attribution" xlink:href="https://creativecommons.org/licenses/by/4.0/" xlink:type="simple"><license-p>Данная работа распространяется под лицензией Creative Commons Attribution 4.0.</license-p></license><license xml:lang="en" license-type="creative-commons-attribution" xlink:href="https://creativecommons.org/licenses/by/4.0/" xlink:type="simple"><license-p>This work is licensed under a Creative Commons Attribution 4.0 License.</license-p></license></permissions><self-uri xlink:href="https://sapi.bntu.by/jour/article/view/206">https://sapi.bntu.by/jour/article/view/206</self-uri><abstract><p>Основное преимущество применения информационных технологий в образовании, заключающееся в ускорении и упрощении обмена информацией, одновременно является его недостатком, поскольку порождает проблему плагиата. Целью данной работы является разработка программного обеспечения для проверки текста на уникальность в системах управления обучением. Для достижения указанной цели необходимо решить круг задач, связанных с выбором метода определения плагиата, его алгоритмизацией и программной реализацией. В работе рассматриваются методы шинглов, супершинглов, сигнатурные методы, векторные модели представления текста, а также кластерный анализ текстовой информации. Авторами предлагается модификация векторной модели для повышения точности определения схожих документов за счет формирования N-списка каждого документа отдельно. Вследствие этого будет происходить попарное сравнение документов и формирование образа одного документа относительно N-списка другого. Таким образом, в i-й строку матрицы схожести будут записываться коэффициенты схожести всех рассматриваемых документов относительно i-го документа. Предлагаемая модификация также позволит ускорить процесс вычислений, поскольку отсутствует необходимость искать общие термы для всех документов. Для анализа большого количества работ обучающихся с целью проверки их на плагиат авторы предлагают использовать кластерный подход. Его применение показало, что время определения дубликатов для одного документа и для всех документов, входящих в выборку, одинаковое. Т. е. за один и тот же промежуток времени можно получить все варианты одинаковых работ обучающихся. Таким образом, применение кластерного анализа текстовой информации при определении плагиата ощутимо экономит как время преподавателя, так и вычислительные ресурсы. Программная реализация предлагаемых алгоритмов выполнена в виде веб-сервиса на языке Java.</p></abstract><trans-abstract xml:lang="en"><p>The main advantage of using information technologies in education, which consists in speeding up and simplifying of information exchange, is also its drawback, because it raises the problem of plagiarism. The purpose of this paper is to develop testing text software for uniqueness in learning management systems. To achieve this goal, it is necessary to solve a range of problems related to the choice of a method for determining plagiarism, its algorithmization and software implementation. The work deals with the methods of shingles, super-shingles, signature methods, vector models of text representation, as well as cluster analysis of text information. The authors suggest a modification of the vector model to improve the accuracy of determining similar documents by creating an N-list of each document separately. As a result, a pairwise comparison of the documents and the formation of the image of one document relative to the N-list of the other will occur. Thus, in the i-th row of the similarity matrix, the coefficients of similarity of all the documents considered relative to the i-th document will be recorded. The proposed modification will also speed up the calculation process, since there is no need to search for common terms for all documents. To analyze a large number of student’s works in order to test them for plagiarism, the authors propose using a cluster approach. Its application showed that the time for determining duplicates for one document and for all documents included in the sample is the same. For the same time it is possible to get all the options for the same works of students. Thus, the use of cluster analysis of text information in determining plagiarism significantly saves both the teacher’s time and computing resources. The software implementation of the proposed algorithms is implemented as a web service in the Java language.</p></trans-abstract><kwd-group xml:lang="ru"><kwd>плагиат</kwd><kwd>векторная модель документа</kwd><kwd>термы</kwd><kwd>N-список</kwd><kwd>матрица схожести</kwd><kwd>кластер</kwd><kwd>кластерный анализ</kwd></kwd-group><kwd-group xml:lang="en"><kwd>plagiarism</kwd><kwd>vector document model</kwd><kwd>terms</kwd><kwd>N-list</kwd><kwd>similarity matrix</kwd><kwd>cluster</kwd><kwd>cluster analysis</kwd></kwd-group></article-meta></front><back><ref-list><title>References</title><ref id="cit1"><label>1</label><citation-alternatives><mixed-citation xml:lang="ru">Бобкова, О. В. Плагиат как гражданское правонарушение / Бобкова О. В., Давыдов С. А., Ковалева И. А. // Патенты и лицензии. – 2016. – № 7. – С. 31–41.</mixed-citation><mixed-citation xml:lang="en">Bobkova, O. V. Plagiat kak grazhdanskoe pravonarushenie / Bobkova O. V., Davydov S. A., Kovaleva I. A. // Patenty i licenzii. – 2016. – № 7. – S. 31–41.</mixed-citation></citation-alternatives></ref><ref id="cit2"><label>2</label><citation-alternatives><mixed-citation xml:lang="ru">Голобурда, А. В. Проверка плагиата в веб-приложениях / А. В. Голобурда, Ю. Б. Попова // Информационные технологии в образовании, науке и производстве: IV Международная научно-техническая интернет-конференция, 18–19 ноября 2016 г. Секция Информационные технологии в производстве и научных исследованиях [Электронный ресурс]. – Режим доступа: http://rep.bntu.by/handle/data/27126. – Дата доступа: 25.11.2017.</mixed-citation><mixed-citation xml:lang="en">Goloburda, A. V. Proverka plagiata v veb-prilozhenijah / A. V. Goloburda, Ju. B. Popova // Informacionnye tehnologii v obrazovanii, nauke i proizvodstve: IV Mezhdunarodnaja nauchno-tehnicheskaja internet-konferencija, 18–19 nojabrja 2016 g. Sekcija Informacionnye tehnologii v proizvodstve i nauchnyh issledovanijah [Jelektronnyj resurs]. – Rezhim dostupa: http://rep.bntu.by/handle/data/27126. – Data dostupa: 25.11.2017.</mixed-citation></citation-alternatives></ref><ref id="cit3"><label>3</label><citation-alternatives><mixed-citation xml:lang="ru">Попова, Ю. Б. Классификация автоматизированных систем управления обучением / Попова Ю. Б. // Системный анализ и прикладная информатика. – 2016. – № 2. – С. 51–58.</mixed-citation><mixed-citation xml:lang="en">Popova, Ju. B. Klassifikacija avtomatizirovannyh sistem upravlenija obucheniem / Popova Ju. B. // Sistemnyj analiz i prikladnaja informatika. – 2016. – № 2. – S. 51–58.</mixed-citation></citation-alternatives></ref><ref id="cit4"><label>4</label><citation-alternatives><mixed-citation xml:lang="ru">Broder, A. On the resemblance and containment of documents / Broder A. // Compression and Complexity of Sequences (SEQUENCES’97). – IEEE Computer Society, 1998. – P. 21–29.</mixed-citation><mixed-citation xml:lang="en">Broder, A. On the resemblance and containment of documents / Broder A. // Compression and Complexity of Sequences (SEQUENCES’97). – IEEE Computer Society, 1998. – P. 21–29.</mixed-citation></citation-alternatives></ref><ref id="cit5"><label>5</label><citation-alternatives><mixed-citation xml:lang="ru">Зеленкова, Ю. Г. Сравнительный анализ методов определения нечетких дубликатов для Web-документов / Зеленкова Ю. Г., Сегалович И. В. // Труды 9-ой Всероссийской научной конференции «Электронные библиотеки: перспективные методы и технологии, электронные коллекции»: сб. работ участников конкурса. – Переславль-Залесский, 2007. – Т. 1. – С. 169–172.</mixed-citation><mixed-citation xml:lang="en">Zelenkova, Ju. G. Sravnitel’nyj analiz metodov opredelenija nechetkih dublikatov dlja Web-dokumentov / Zelenkova Ju. G., Segalovich I. V. // Trudy 9-oj Vserossijskoj nauchnoj konferencii «Jelektronnye biblioteki: perspektivnye metody i tehnologii, jelektronnye kollekcii»: sb. rabot uchastnikov konkursa. – Pereslavl’-Zalesskij, 2007. – T. 1. – S. 169–172.</mixed-citation></citation-alternatives></ref><ref id="cit6"><label>6</label><citation-alternatives><mixed-citation xml:lang="ru">Моченов, С. В. Векторная модель представления текстовой информации / С. В. Моченов, А. М. Бледнов, Ю. А. Луговских // Материалы международной научной конференции. – Ижевск, 2006. – С. 133–139.</mixed-citation><mixed-citation xml:lang="en">Mochenov, S. V. Vektornaja model’ predstavlenija tekstovoj informacii / S. V. Mochenov, A. M. Blednov, Ju. A. Lugovskih // Materialy mezhdunarodnoj nauchnoj konferencii. – Izhevsk, 2006. – S. 133–139.</mixed-citation></citation-alternatives></ref><ref id="cit7"><label>7</label><citation-alternatives><mixed-citation xml:lang="ru">Андреев, А. М. Метод обнаружения дубликатов в потоке текстовых документов / Андреев А. М., Березкин Д. В., Козлов И. А., Симаков К. В. // Труды 16-й Всероссийской научной конференции «Электронные библиотеки: перспективные методы и технологии, электронные коллекции». – Дубна, 2014. – С. 310–321.</mixed-citation><mixed-citation xml:lang="en">Andreev, A. M. Metod obnaruzhenija dublikatov v potoke tekstovyh dokumentov / Andreev A. M., Berezkin D. V., Kozlov I. A., Simakov K. V. // Trudy 16-j Vserossijskoj nauchnoj konferencii «Jelektronnye biblioteki: perspektivnye metody i tehnologii, jelektronnye kollekcii». – Dubna, 2014. – S. 310–321.</mixed-citation></citation-alternatives></ref><ref id="cit8"><label>8</label><citation-alternatives><mixed-citation xml:lang="ru">Антонова, А. Ю. Об использовании мер сходства при анализе документации / Антонова А. Ю., Клышинский Э. С. // Труды 13-й Всероссийской научной конференции «Электронные библиотеки: перспективные методы и технологии, электронные коллекции». – Воронеж, 2011. – С. 134–138.</mixed-citation><mixed-citation xml:lang="en">Antonova, A. Ju. Ob ispol’zovanii mer shodstva pri analize dokumentacii / Antonova A. Ju., Klyshinskij Je. S. // Trudy 13-j Vserossijskoj nauchnoj konferencii «Jelektronnye biblioteki: perspektivnye metody i tehnologii, jelektronnye kollekcii». – Voronezh, 2011. – S. 134–138.</mixed-citation></citation-alternatives></ref><ref id="cit9"><label>9</label><citation-alternatives><mixed-citation xml:lang="ru">Баранов, М. А. Модификация жадного алгоритма кластеризации / Баранов М. А. // Прикладная информатика. – 2013. – № 2. – С. 78–88.</mixed-citation><mixed-citation xml:lang="en">Baranov, M. A. Modifikacija zhadnogo algoritma klasterizacii / Baranov M. A. // Prikladnaja informatika. – 2013. – № 2. – S. 78–88.</mixed-citation></citation-alternatives></ref><ref id="cit10"><label>10</label><citation-alternatives><mixed-citation xml:lang="ru">Барахнин, В. Б. Кластеризация текстовых документов на основе составных ключевых термов / Барахнин В. Б., Ткачев Д. А. // Вестник Новосибирского государственного университета. Серия: Информационные технологии. – 2010. – № 2. – С. 5–14.</mixed-citation><mixed-citation xml:lang="en">Barahnin, V. B. Klasterizacija tekstovyh dokumentov na osnove sostavnyh kljuchevyh termov / Barahnin V. B., Tkachev D. A. // Vestnik Novosibirskogo gosudarstvennogo universiteta. Serija: Informacionnye tehnologii. – 2010. – № 2. – S. 5–14.</mixed-citation></citation-alternatives></ref></ref-list><fn-group><fn fn-type="conflict"><p>The authors declare that there are no conflicts of interest present.</p></fn></fn-group></back></article>
