Латинская буква внутри русского слова не прячет текст, а выдает его.
Речь про один прием: подмену знаков в файле. Обзор всех способов обхода лежит в статье «Почему не работает технический обход», разбор самой отметки в отчете в статье «Подозрительный документ в отчете». Здесь про механику и про самопроверку файла.
Порядок проверки и меры за нарушение каждый вуз устанавливает сам, поэтому сверяйтесь с положением своей кафедры: формулировки там могут быть другие.
В двух словах
Коротко для тех, кто прочитал где-то про замену букв и хочет понять, видно ли это и нет ли такого в его собственном файле.
- Подмену ловят не смыслом, а арифметикой. Русская «о» и латинская «o» нарисованы одинаково, но это разные знаки, и в русском слове второго быть не должно.
- Невидимых знаков несколько. Мягкие переносы, лишние пробелы, скрытый текст и текст нулевого размера на печати не видны, а в файле лежат.
- Чаще всего их никто не вставлял. Копирование из браузера, вставка из PDF, формулы и чужой шаблон титульного листа приносят их сами.
- Свой файл проверяется за минуту. Кнопка со знаком абзаца показывает служебные знаки, а поиск с заменой их убирает.
- Найденный обход отменяет процент. По типовому положению о проверке работ проверка считается пройденной с отрицательным результатом, и оригинальность дальше не смотрят.
Почему подмена букв заметна
Студент читает на сайте: поменяйте в тексте несколько букв, и проверка его не узнает. На экране после такой правки действительно не меняется ничего.
Расчет строится на простой вещи. Русская буква «о» и латинская «o» нарисованы одинаково, но для программы это два разных знака. Слово «работа» с латинской буквой внутри перестает совпадать со словом «работа» из базы, и кусок текста уходит из подсветки.
Дальше начинается то, о чем на таких сайтах не пишут. Подмена оставляет след, которого в обычном тексте не бывает: внутри одного слова оказываются буквы двух алфавитов сразу. Пары таких букв-двойников давно собраны в отдельный список международного стандарта символов, и кириллица с латиницей дают там самый длинный набор совпадений.
Тот же стандарт называет смешение алфавитов внутри слова прямым признаком подделки: так подделывают адреса сайтов, и защищаются от этого поиском по знакам. Никакого понимания текста тут не нужно, нужен перебор букв.
Отсюда результат, обратный обещанному. Совпадение с базой действительно рвется, доля заимствований действительно падает. Но работа уходит из одной проверки и попадает под другую, где ищут уже не чужой текст, а следы правки файла.
Что именно прячется в файле
Подмена букв прием самый известный, но не единственный. Остальные знаки не видно вообще: ни на экране, ни на распечатке.
В студенческой работе встречаются пять видов посторонних знаков:
- латинские буквы-двойники внутри русских слов;
- мягкие переносы, то есть пометки, где слово разрешено разорвать;
- лишние пробелы между буквами внутри слова;
- текст белого цвета или нулевого размера;
- куски, помеченные как скрытый текст.
Мягкий перенос ведет себя хитрее прочих. Word показывает его отдельной настройкой, а без нее знак виден только тогда, когда слово реально переносится, и выглядит при этом обычным дефисом. На бумаге он неотличим от нормального переноса, а в файле стоит внутри слова.
Скрытый текст устроен похоже. У него свой флажок в настройках, и по этому флажку Word рисует под таким куском пунктирную линию. Без флажка куска на экране просто нет.
Общее у всех пяти одно. Печать их не показывает, автор их не видит, а программа читает файл целиком, вместе с ними. Поэтому разговор про такие знаки почти всегда начинается со стороны кафедры, а не со стороны студента.
Откуда эти знаки берутся сами
Обиднее всего то, что чаще всего их никто не вставлял. Работу собирали честно, из нормальных источников, а знаки в файле есть.
Каждый способ переноса текста в документ приносит свой мусор:
Копирование из браузера. Вместе с текстом переезжают неразрывные пробелы, а с англоязычных страниц и латинские буквы внутри слов.
Вставка из PDF. Текст там разбит по строкам верстки, и в документ он приходит с переносами и разрывами посреди слов.
Формулы из редактора. Переменные в них набраны латиницей по правилам записи, и в соседнем русском слове такая буква выглядит подменой.
Чужой шаблон титульного листа. В скачанном образце остается разметка прежнего автора: служебные знаки, скрытые блоки, поля его оформления.
Автоматическая расстановка переносов. Она ставит мягкие переносы внутрь слов, и после правки текста они остаются там, где перенос уже не нужен.
Ни один из этих пяти путей к обходу отношения не имеет. Но знак в файле получается тот же самый, а алгоритм смотрит именно на знак.
Случайный знак и намеренная подмена выглядят в отчете одинаково: намерения алгоритм не различает, он видит только след. Поэтому файл стоит просмотреть даже тогда, когда вы точно ничего не подменяли.
Как посмотреть свой файл
Проверить документ можно самому, за минуту, и ставить для этого ничего не нужно: хватает того же Word, в котором работа и написана.
Кнопка со знаком абзаца. Она стоит на вкладке «Главная», в группе «Абзац». После нажатия пробелы становятся точками, табуляция стрелками, конец абзаца получает знак ¶. Вы увидите свой текст примерно таким, каким его читает программа.
Настройки экрана. Файл, Параметры, Экран, раздел «Всегда показывать эти знаки форматирования на экране». Там отдельные флажки на мягкие переносы и на скрытый текст. Поставленный флажок держит знак на виду постоянно, даже когда кнопка с абзацем выключена.
Куда смотреть. На середину слов. Лишняя точка между буквами, черточка внутри слова, пунктирная линия под куском текста выпадают из ровной страницы сразу.
Одного просмотра мало, и честнее сказать об этом сразу. Подмененную букву знаки форматирования не покажут: она обычная буква, просто из другого алфавита. Так находятся четыре вида из пяти, а на пятый нужен поиск.
Начинайте с титульного листа и содержания. Скачанный образец оформления несет больше всего служебной разметки, а просматривают эти страницы в последнюю очередь.
Как найти и убрать посторонние знаки
Глазами находится крупное. Одну подмененную букву в середине третьей главы так не выловить, и дальше работает поиск с заменой.
Окно поиска и замены открывается сочетанием Ctrl+H. В нем есть кнопка «Специальный», а под ней список служебных знаков документа. Знак выбирается из списка, поле замены остается пустым, и весь документ чистится за один заход.
Латинские двойники. Их ищут по одной букве. В поле поиска ставится латинская «o», и Word покажет вам все места, где она стоит. В русском тексте находки будут двух видов: английские слова в списке литературы и подмена.
Шрифт как подсказка. Поставьте курсор внутрь подозрительного слова и посмотрите на имя шрифта вверху. Кусок из чужого файла обычно набран другой гарнитурой, и название меняется прямо посреди слова.
Белый и нулевой текст. Выделите документ целиком и задайте основному тексту один цвет и один размер. Спрятанное всплывет и станет обычным абзацем, который дальше видно глазами.
Чем находится каждый вид посторонних знаков
| Что ищем | Чем находится | Что делать |
|---|---|---|
| латинские буквы в русских словах | поиск по одной букве | править вручную, глядя на слово |
| мягкие переносы | замена через кнопку «Специальный» | заменить на пустое поле |
| лишние пробелы внутри слов | кнопка со знаком абзаца | убрать по одному |
| белый и нулевой текст | единый цвет и размер для всего текста | удалить лишнее |
| скрытый текст | флажок в параметрах экрана | удалить лишнее |
Замена всей латиницы на кириллицу одним нажатием ломает работу. Под нее попадают английские названия в списке литературы, переменные в формулах и адреса ссылок. Поэтому по одной букве и с просмотром каждой находки.
Чем это кончается для работы
Допустим, знаки в файле остались. Дальше все решает не процент, а то, как их прочитают на кафедре.
Система помечает такой документ отдельно: в руководстве пользователя это названо признаками технических способов изменения текста. Отдельный поиск таких следов работает не первый год: по официальной истории обновлений алгоритм появился 29 сентября 2018 года и сразу выдавал проверяющему группу обхода с номерами страниц, а с 30 января 2019 года ему показывают и сам найденный текст.
Дальше в дело идет положение вуза. В типовом шаблоне такого положения пункт 5.2 называет замену букв кириллицы буквами других алфавитов и невидимые символы прямо, причем список там открытый. В приложении со шкалой оригинальности верхняя строка отведена найденным попыткам обхода: проверка считается пройденной с отрицательным результатом, а доля заимствований дальше не рассматривается.
Обратная сторона так же важна. Чистый файл не поднимает процент ни на пункт. Если не проходит оригинальность, лечится она текстом, и честные способы собраны в статье «Как честно повысить оригинальность». Если не проходит вторая строка отчета, это отдельный разговор про нейросеть.
Посторонние знаки стоят не между работой и нужным числом, а между студентом и разговором про обход.
Если в отчете уже стоит отметка и непонятно, что именно нашли, пришлите его на бесплатный разбор: скажу, откуда взялись знаки и сколько работы впереди, до всякой оплаты.
Частые ошибки
Считать подмену букв безобидной хитростью
В типовом положении о проверке это отдельный пункт с отдельными последствиями. Низкий процент означает доработку текста, найденная подмена означает отрицательный результат проверки независимо от процента.
Не проверять файл, потому что ничего не подменяли
Отметку ставит алгоритм по следу в документе, а не по намерению. Конвертация из PDF и скачанный образец оформления дают тот же след. Откройте файл с включенными знаками форматирования и просмотрите его сами.
Заменить всю латиницу на кириллицу одной командой
Под замену попадут английские источники в списке литературы, переменные в формулах и адреса ссылок. Работа после этого станет хуже, чем была. Ищите по одной букве и смотрите каждую находку.
Чистить файл вместо того, чтобы править текст
Посторонние знаки к проценту отношения не имеют: убрали их, и число в отчете осталось прежним. Это две разные задачи, и делать надо обе, начиная с текста.
Частые вопросы
Видно ли подмену букв на распечатке
Нет. В этом и смысл приема: на бумаге текст выглядит обычным. Видно ее в файле, и только через служебные знаки или поиск по буквам.
Считается ли латиница в списке литературы нарушением
Нет. Английские названия, фамилии авторов и адреса источников набраны латиницей по делу, и алгоритм смотрит на смешение алфавитов внутри одного слова.
Сохранение в PDF убирает такие знаки
Нет. Знаки переезжают в PDF вместе с текстом, а вуз обычно просит исходный файл. К тому же документ из картинок распознают и проверяют наравне с остальными.
Может ли отметка появиться из-за формул
Да, если формулы вставлены картинками или набраны вперемешку с русским текстом. Набирайте их встроенным редактором формул и не растягивайте латинские переменные на соседние слова.
Короткий алгоритм
- Откройте готовый файл и нажмите кнопку со знаком абзаца: пока служебные знаки выключены, вы не знаете, что в документе лежит.
- Поставьте в параметрах экрана флажки на мягкие переносы и скрытый текст, иначе эти два вида останутся невидимыми.
- Пройдите титульный лист и содержание первыми: именно туда чаще всего переезжает разметка прежнего автора.
- Уберите мягкие переносы через поиск и замену, выбрав знак кнопкой «Специальный» и оставив поле замены пустым.
- Найдите латинские буквы поиском по одной букве и правьте только те, что стоят внутри русских слов.
- Не путайте чистый файл с высоким процентом: знаки убраны, а оригинальность и доля ИИ остались прежними, и с ними работают отдельно.
- Если в отчете уже стоит отметка, пришлите его на разбор и получите объяснение бесплатно.