Короткий фрагмент даёт мало данных
Детектор оценивает сочетания слов, структуру предложений и другие признаки готового текста. На фрагменте из нескольких абзацев каждый повтор или шаблонная конструкция сильнее влияет на общий результат.
Компания «Антиплагиат» указывает, что распознавание искусственного текста доступно для документов объёмом от двух листов. Авторы исследования русскоязычных текстов RuATD учитывали различия по предметным областям и длине материала. В обзоре они отмечают, что короткие публикации в социальных сетях сложнее классифицировать.
Процент по одному абзацу нельзя переносить на весь документ. Сначала верните фрагмент в работу и проверьте файл целиком.
Что показывают российские системы
В «Антиплагиате» показатель «ИИ-контент» отражает предполагаемую долю сгенерированного текста. В подробном отчёте указаны страницы, которые система предлагает изучить.
«Руконтекст» показывает результат по всему документу и отдельным страницам. Подозрительные фрагменты выделяются синим цветом. Пользователь с ролью эксперта может исключить ошибочно отмеченный участок.
В отчёте «Думейт» применяется тепловая карта. По данным рекомендаций МПГУ, красный, оранжевый и жёлтый цвета соответствуют разным уровням редкости признаков среди текстов, написанных людьми. В итоговый процент включаются красные фрагменты.
У систем различаются модели, шкалы и правила выделения текста. Показатели 20% в двух сервисах могут описывать разные результаты.