Пользовались этим инструментом? Оцените его
Пользовались этим инструментом? Оцените его
Copyleaks — платформа для проверки целостности контента, отвечающая на два связанных вопроса о тексте: есть ли в нём фрагменты, созданные генеративной моделью, и есть ли фрагменты, которые уже существуют где-то ещё. Продукт построен на убеждении, что эти два вопроса относятся к одному рабочему процессу, а не к двум разным инструментам. Компания основана в 2015 году, начинала как сервис проверки на плагиат и расширилась до распознавания ИИ и инструментов соответствия требованиям по мере того, как большие языковые модели входили в повседневное письмо. Эта история важна при оценке: сторона плагиата опирается на базу сравнения и алгоритмы сопоставления, оттачивавшиеся около десяти лет, тогда как сторона распознавания ИИ опирается на статистические классификаторы, появившиеся гораздо позже и, как подробно разбирается ниже, куда более спорные.
На практике продукт сводится к одной проверке и одному отчёту. Вы отправляете текст через веб-приложение, расширение браузера, дополнение для Google Docs, вызов API или систему управления обучением и получаете вид документа с подсвеченными фрагментами и процентным показателем. Целостность контента здесь проверяется с двух сторон: проверка плагиата показывает в отчёте найденные источники. Со стороны ИИ — какие фрагменты несут статистическую подпись машинной генерации. Проверка текста возвращает анализ ИИ и сопоставление на плагиат в едином отчёте, но распознавание изображений оценивает только присутствие ИИ и не проверяет изображения на плагиат, поэтому объединённый отчёт — свойство именно текстовой проверки.
Кому это подходит, зависит от того, какая половина вам важнее. Университеты и школы используют платформу как слой академической честности, подключённый к их LMS. Издатели и редакции проверяют, оригинален ли присланный текст и не читается ли он как машинный. Компании применяют её для соблюдения прав на интеллектуальную собственность, управления использованием генеративного ИИ и проверки того, что обучающие данные написаны людьми. Частные пользователи проверяют собственные работы перед сдачей. Компания сообщает о присутствии более чем в 100 странах, более 500 предприятиях и учебных заведениях и более 30 миллионах проверок ежемесячно — это самостоятельно заявленные, а не проверенные аудитом цифры.
Новые аккаунты включают ограниченное число бесплатных кредитов, которых достаточно, чтобы прогнать настоящие документы и оценить отчёты до оплаты. Постоянного бесплатного тарифа со значимым объёмом нет, поэтому бесплатный лимит стоит понимать как механизм ознакомления.
Платные индивидуальные тарифы — подписки с кредитным расчётом. Personal стоит 16,99 $ в месяц или 13,99 $ в месяц при годовой оплате, Pro — 99,99 $ в месяц или 74,99 $ в месяц при годовой оплате; в Pro добавляются 25 пользовательских мест, расширенные фильтры распознавания, проверка сайта целиком по карте сайта, межъязыковое распознавание плагиата и панель аналитики. Расчёт ведётся в единых кредитах: один кредит покрывает до 250 слов или одно изображение, поэтому статья на 5 000 слов расходует 20 кредитов, а заявленное в тарифе число кредитов соответствует примерно 250-кратному числу слов. Тарифы Enterprise и Education рассчитываются индивидуально; образовательная цена зависит от числа студентов очной формы, а доступ к API и интеграция с LMS доступны только на этих уровнях.
Три коммерческих условия заслуживают внимания до оформления подписки: их легко пропустить, а обнаруживать поздно — дорого. Тарифы не суммируются: переход перезаписывает текущий тариф, и остаток кредитов сгорает. Возврат средств рассматривается только при обращении в первые 10 дней расчётного периода и только если кредиты не расходовались. Все тарифы продлеваются автоматически до отмены. Если использование сезонное — семестр, а не год, — до годового обязательства проверьте на странице оплаты, действительно ли вам доступен помесячный вариант.
Этот раздел заслуживает большего веса, чем аналогичный у большинства инструментов, потому что точность распознавания ИИ — вопрос, где маркетинговые утверждения и независимые свидетельства резко расходятся, а последствия ошибки ложатся на конкретных людей.
Цифра точности — заявление самого поставщика. Copyleaks рекламирует точность выше 99 %, но эта цифра сопровождается сноской о том, что оценка основана на внутреннем тестировании на англоязычных наборах данных, а значит представляет собой самоотчёт, а не независимо проверенный результат. Это не обвинение в недобросовестности — сноска размещена на самой странице. Но 99 %, полученные компанией на собственном английском тестовом наборе, не следует читать как гарантию для вашего документа на вашем языке.
По собственным данным поставщика показатели вне английского заметно слабее. Официальная таблица по языкам показывает явный градиент: значение со стороны ИИ падает с 99,20 % для английского до 95,63 % для немецкого и 93,08 % для португальского. Разрыв примерно в 7 пунктов для португальского означает существенно больше пропусков, чем предполагает основная цифра. Учтите также, что распознавание ИИ охватывает более 30 языков, а распознавание плагиата — более 100; эти числа не взаимозаменяемы.
Независимые академические исследования противоречат маркетингу отрасли. Рецензируемое исследование Вебер-Вульфф и коллег, опубликованное в International Journal for Educational Integrity, протестировало 14 инструментов распознавания и заключило, что доступные инструменты не являются ни точными, ни надёжными и склонны относить материал к написанному человеком. Та же работа показала, что приёмы запутывания содержания значительно ухудшают их показатели. Необходимо уточнение: Copyleaks появляется в этой статье только в обзоре предшествующих работ, а не среди 14 инструментов, протестированных самими авторами, поэтому это свидетельство о категории, а не прямое измерение данного продукта.
Осторожнее с формулировкой «исследование Корнелла». Утверждение, что исследование Корнеллского университета признало Copyleaks самым точным детектором, широко распространено, однако arXiv — площадка препринтов, которой управляет Cornell Tech, и публикация там не является ни результатом, ни одобрением Корнеллского университета. Препринты к тому же не обязательно проходили рецензирование. По любому детектору проверяйте, кто проводил цитируемое исследование, на каком тестовом наборе и было ли оно отрецензировано.
Ложные срабатывания сильнее всего бьют по авторам, для которых английский неродной. По материалам The Markup, семь детекторов отмечали тексты неносителей английского как созданные ИИ в 61 % случаев, а примерно в 20 % работ такая ошибка была единогласной, тогда как у носителей языка подобная ошибка почти не встречалась. Механизм прост: детекторы поощряют языковую непредсказуемость, а пишущие на втором языке часто выдают формальную, малоизменчивую прозу, которую поощряло их образование. Учреждение, внедряющее распознавание без учёта этого, выстраивает дискриминационную процедуру независимо от выбранного поставщика.
Пользовательские оценки низкие, и претензии концентрируются именно на этом. Trustpilot показывает 2,6 балла из 5 при 344 отзывах, из которых 49 % — на одну звезду, а компания занимает 80-е место из 85 в категории Software Vendor. Преобладающая жалоба — работы, написанные людьми, оцениваются как созданные ИИ; её высказывают в том числе рецензенты, называющие себя отставным военным и аспирантами. Нужна оговорка при чтении: площадки отзывов отбирают пострадавшую сторону, и у человека, отмеченного ошибочно, куда больше поводов написать, чем у того, чья проверка подтвердила ожидания. Эту оценку следует читать как свидетельство о характере сбоев, а не как измерение общей точности.
Позиция самого поставщика сдержаннее его рекламы. В публичных ответах компания признаёт, что крайне шаблонное человеческое письмо иногда способно имитировать паттерны ИИ, и советует считать показатель ИИ сильным индикатором, оставляя окончательное решение за человеком. Совет разумный, и им стоит поверять рекламные заявления.
Известные помехи и рабочие ограничения. Распространённые помощники по письму могут вызывать отметки, требования к минимальной длине делают короткие фрагменты нестабильными, а различия в конфигурации дают расходящиеся показатели для одного документа: пользователи неоднократно описывают разные результаты у студента и у преподавателя, что компания объясняет различием настроек проверки.
Компания заявляет точность выше 99 % и долю ложных срабатываний 0,03 %, но эта цифра получена во внутреннем тестировании на английских данных, о чём говорит сноска на её собственном сайте. Независимое рецензируемое исследование категории заключает, что инструменты распознавания в целом не являются ни точными, ни надёжными. Честный ответ: он выглядит сравнительно хорошо внутри класса инструментов, фундаментальная надёжность которого оспаривается, и ни один нынешний детектор не даёт оснований считать свой вывод доказательством.
Новым аккаунтам выдаётся ограниченный запас бесплатных кредитов, достаточный для оценки продукта на реальных документах. Постоянное использование требует платного тарифа: Personal за 16,99 $ в месяц или 13,99 $ при годовой оплате, Pro за 99,99 $ или 74,99 $ соответственно.
Для текста — да, оба результата попадают в один отчёт. Для изображений — нет: проверка изображений выявляет только присутствие ИИ и не выполняет сопоставления на плагиат.
Распознавание ИИ охватывает более 30 языков, распознавание плагиата — более 100. Опубликованная точность по языкам наиболее высока для английского и измеримо снижается для остальных, поэтому к неанглоязычным результатам стоит относиться с повышенной осторожностью.
Возможно. Copyleaks прямо указывает, что платформы вроде Grammarly применяют ChatGPT и другие генеративные модели для части функций и такой вывод может быть отмечен как потенциально созданный ИИ. Базовая проверка орфографии и грамматики отметок вызывать не должна, а генеративное переписывание — может.
Да, через нативные коннекторы для Canvas, Moodle, D2L Brightspace, Blackboard, Schoology, Edsby и Sakai. Интеграция с LMS доступна только в тарифах Education и Enterprise, но не в индивидуальных подписках.
Можно повысить тариф или докупить разовые кредиты. Учтите, что тарифы не суммируются: переход перезаписывает текущий тариф и обнуляет остаток кредитов, поэтому повышение в середине периода может стоить вам неизрасходованного лимита.
Откройте отчёт, а не смотрите на показатель, и разберите, какие фрагменты отмечены и куда указывает AI Source Match. Соберите свидетельства процесса работы: историю черновиков, версии, заметки. Если по этому результату вас оценивают, спросите, какая конфигурация проверки использовалась, — при разных настройках один документ может получить разные показатели. Авторам, для которых английский неродной, стоит знать, что исследования зафиксировали существенное смещение против этой группы у детекторов в целом; на это можно правомерно ссылаться.
Компания заявляет о наличии PCI DSS, SOC 2, SOC 3 и соответствия GDPR. Корпоративные и образовательные заказчики могут выбрать размещение на собственных серверах или в частном облаке с региональным хранением — это путь при требованиях к местонахождению данных. Индивидуальные тарифы работают на стандартном облачном сервисе.
Возврат не гарантирован. Опубликованные правила допускают его только при обращении в первые 10 дней расчётного периода и только если кредиты не расходовались, поэтому оценивайте продукт бесплатными кредитами до оформления подписки, а не после.