Вопросы и ответы

Как устроена проверка, что сервис видит на сайте и чего не видит, какой у отчёта статус и что делать владельцу сайта, который нашёл наш краулер в логах.

Как это работает

Что именно делает сервис?

Мы открываем общедоступные страницы сайта и собираем то, что видно любому посетителю: опубликованные документы, формы и отметки согласия, cookie и подключённые скрипты, настройки соединения, сведения о владельце. Дальше правила из курируемой базы сопоставляют собранные факты с требованиями и показывают признаки возможных нарушений — с указанием, на чём именно основан каждый пункт.

Это проверка того, что наблюдается снаружи, и её границы описаны в самом отчёте, а не мелким шрифтом под ним.

Нужна ли регистрация и сколько идёт проверка?

Экспресс-анализ запускается без регистрации: результат открывается сразу и сохраняется по ссылке в вашем браузере. Обычно проверка занимает несколько минут — на сбор данных заложен ограниченный бюджет времени, и если сайт отвечает медленно, часть страниц может не попасть в выборку. Это будет видно в блоке о качестве данных.

Повторный запрос по тому же домену в течение суток обычно возвращает уже собранный результат мгновенно, а не запускает новый обход. Если предыдущая проверка домена не дошла до результата или принадлежит другому аккаунту, сервис честно скажет, что домен проверяли недавно, и назовёт время, когда обход можно повторить.

Признаки находит нейросеть?

Нет, список признаков собирает код. Каждый признак — это правило с идентификатором из базы плюс доказательство: фрагмент разметки, запись сетевого обмена, снимок экрана или адрес страницы. Нет доказательства — нет пункта в отчёте.

Модель участвует только в узких местах разбора — например, отличает текст согласия на обработку данных от подписки на рассылку, — и её ответ возвращается в общий контур как обычный факт. Правило, в цепочке которого она участвовала, не поднимается в отчёте выше уровня «признаки возможного нарушения».

Нормы, редакции и суммы — данные базы правил, а не вывод модели: упоминание нормы в тексте сверяется со списком норм по найденным признакам, и текст со ссылкой вне этого списка отбрасывается целиком. Связный разбор модель пишет поверх готового списка находок — добавить в него новый пункт она структурно не может.

Что мы проверяем и чего не проверяем

Что именно вы проверяете?

База правил разбита на шесть категорий — теми же названиями, что и в отчёте: «Персональные данные», «Cookie и трекеры», «Торговля и оферта», «Техническая безопасность», «Реклама» и «Информационные замечания». Больше всего правил о персональных данных.

Практически это наличие политики и её связь с формами, отметки согласия и заранее проставленные галочки, отправка форм с персональными данными на зарубежные сервисы, счётчики и скрипты, которые срабатывают ещё до взаимодействия с cookie-баннером, обязательные сведения о продавце, защищённость соединения.

Состав базы меняется без обновления сайта, поэтому точный список правил мы здесь не фиксируем: версия базы, по которой сделана проверка, печатается в каждом отчёте.

Чего вы не проверяете?

Снаружи не видно того, что происходит на стороне владельца: уведомление оператора в Роскомнадзор, размещение баз данных, обработка данных на сервере, договоры с подрядчиками и внутренние документы. Это проверяется документарно — самостоятельно или с юристом.

Из опубликованных документов правила используют наличие по ссылке и структурные признаки: юридическое качество текста в список находок не попадает и на балл не влияет. В полном отчёте есть отдельный блок «Зона внимания: документы» — автоматический разбор текста политики и согласий оставляет там наблюдения по чек-листу, именно как наблюдения: вне списка признаков и вне оценки риска.

Перечень непроверенного и карта того, что проверка охватила, печатаются в каждом отчёте, включая бесплатный: граница платного и бесплатного на эти блоки не распространяется.

Вы находите все cookie и трекеры?

Нет, и такого обещания мы не даём: обход ограничен по числу страниц и по времени, а список сторонних скриптов в интернете больше любого краулерского бюджета. Что мы делаем надёжно — фиксируем состояние до какого-либо взаимодействия с баннером: какие cookie и запросы появляются ещё до того, как посетитель что-нибудь нажал.

Скрипт, которого нет в нашем справочнике сервисов, мы не объявляем получателем данных: угадывать принадлежность и юрисдикцию по одному домену — прямой путь к ложному обвинению, поэтому такие места остаются вне списка признаков.

Проверяете ли вы рекламные материалы и маркировку?

Почти нет: отдельная проверка рекламных материалов зарезервирована под следующий этап, в активной базе из этой категории пока одна запись. Причина не только в сроках — граница между рекламой и информированием о собственных товарах остаётся предметом разъяснений и споров практиков, и автоматически объявлять блок на сайте рекламой мы не станем.

Максимум, что здесь уместно, — обратить внимание на спорное место и предложить показать его специалисту.

Результат и его статус

Что такое Risk Score и как он считается?

Это числовая сводка по найденным признакам: каждый даёт вклад, зависящий от уровня критичности и от уверенности детекта, а сумма нормируется в шкалу с четырьмя зонами. Параметры формулы — часть версии базы правил, а не константы в коде, поэтому при тех же фактах и той же версии базы балл воспроизводится в точности и не меняется после оплаты.

Балл — ориентир и способ увидеть изменения после исправлений, а не отметка о пройденной проверке, которую можно кому-то предъявить.

Может ли сервис ошибиться?

Может, и продукт построен исходя из этого. В одну сторону мы строги: каждый пункт отчёта опирается на доказательство, которое можно посмотреть глазами, — нет доказательства, нет пункта. Пункты, в цепочке детекта которых участвовала модель-классификатор, не поднимаются выше уровня «признаки возможного нарушения» — так подписан в отчёте каждый такой пункт, в отличие от «подтверждено наблюдением».

В обратную сторону строгости меньше: снаружи видна лишь часть картины, поэтому отсутствие признака в отчёте не означает, что проблемы нет. Ровно поэтому мы отдельно перечисляем зоны, которые не проверяли.

Юрист после этого всё равно нужен?

Для части находок — да, и отчёт прямо их разделяет: одно закрывается своими силами (баннер, отметка согласия, ссылка на документ, защищённое соединение), другое требует человека с квалификацией — содержание документов, уведомление оператора, договоры с подрядчиками.

Мы делаем первый и самый дешёвый шаг: собираем факты, показываем доказательства и говорим, что из этого стоит показать юристу. Тексты политик, согласий и оферт сервис не составляет.

Кто видит мой отчёт?

Полный отчёт виден только вам. У бесплатного экспресса есть особенность, о которой честнее сказать сразу: результат по домену общий — если тот же адрес в течение суток проверит кто-то ещё, сервис отдаст ему уже собранный отчёт вместо нового обхода. Пока проверка не привязана к аккаунту, её видит каждый, кто запросил тот же домен; после входа она становится вашей и посторонним больше не отдаётся.

Публичной ссылки на результат у сервиса нет и не планируется: страницы проверок закрыты от индексации, рейтингов и витрин проверенных сайтов мы не ведём.

Деньги и аккаунт

Сколько это стоит?

Экспресс-анализ бесплатный. Платные тарифы, цены и срок жизни кредитов собраны на странице тарифов, там же объяснено, чем кредит отличается от подписки.

Здесь стоит добавить одно: кредит списывается не в момент оплаты, а в момент запуска проверки, и автоматических повторных списаний сервис не делает.

Чем полный отчёт отличается от бесплатного?

Факты собираются одни и те же — отличается то, что с ними делают дальше. В экспрессе физически нет рекомендаций и плана исправления, оценки вероятных финансовых последствий, подробного разбора каждого признака, зоны внимания по документам и PDF: это не спрятано в интерфейсе, этих данных до покупки просто не существует.

Экспресс показывает Risk Score, количество находок по уровням критичности, их список по названиям и подробный разбор двух-трёх самых критичных. Блоки честности («Как читать этот отчёт», перечень непроверенного, дата проверки и версия базы) одинаковы в обоих ярусах.

Можно ли докупить полный отчёт по уже сделанной бесплатной проверке?

Да, это основной путь. Для покупки нужно войти через Яндекс ID: анонимная проверка сначала привязывается к аккаунту, и только после этого её можно расширить до полного отчёта. Сам экспресс по-прежнему доступен без регистрации.

Если факты свежие, моложе недели, сайт заново не обходится: версия базы правил наследуется от экспресса, поэтому список признаков и Risk Score после оплаты остаются теми же. Если факты успели устареть, сбор идёт заново и результат может отличаться от бесплатного — об этом мы предупреждаем до оплаты.

Что будет, если проверку не удалось выполнить?

Если robots.txt сайта запрещает обход стартового адреса или сайт отвечает защитной заглушкой, мы честно останавливаемся, ничего не обходя, а списанный отчёт возвращается на баланс автоматически — заявления это не требует.

Если собралось не всё, но ядро отчёта есть, проверка помечается частичной, а пробелы перечисляются в блоке о качестве данных. Отдельный случай — когда не собрался пояснительный текст: находки, балл, оценка последствий и план посчитаны кодом и уже доставлены, поэтому кредит не возвращается, а повторное формирование текста выполняется без доплаты.

Что происходит с данными при удалении аккаунта?

Профиль обезличивается сразу: имя, почта и связь с Яндекс ID стираются, все сессии закрываются, повторный вход создаст уже нового пользователя. Проверки, находки и файлы, включая готовые PDF, удаляются отложенно, в течение суток.

Сохраняются платёжные записи — этого требуют правила о кассовых чеках и налоговый учёт, уже без связи с личностью, — журнал согласий и отметки об использовании бесплатных проверок по доменам. Неизрасходованные кредиты сгорают; предупреждение об этом показывается до подтверждения удаления.

Владельцам проверяемых сайтов

Можно ли проверить чужой сайт?

Проверяется общедоступная поверхность любого адреса — ровно то, что видит обычный посетитель. Но перед запуском нужно подтвердить правомерный интерес: вы владелец сайта, уполномоченное лицо или изучаете сайт на законном основании, например как клиент подрядчика. Без такого подтверждения форма проверку не запускает.

Отчёт остаётся приватным, формулировки в нём — про признаки и риски, а не про установленные факты. Предъявлять его как вывод о чужом сайте нельзя.

Как узнать ваш краулер и запретить ему обход?

Бот представляется в логах честным User-Agent со ссылкой на страницу о нём, и подменить это имя заказчик проверки не может. Работает он строго пассивно: не отправляет формы, не кликает по баннерам и кнопкам, не проходит авторизацию и не обходит капчи.

robots.txt соблюдается безусловно, включая Crawl-delay: запрета в нём достаточно, чтобы проверка вашего сайта стала невозможной. Закрытые страницы не анализируются, и сам по себе запрет ни во что не трактуется — страница попадает в блок о качестве данных как недоступная по решению владельца и на Risk Score не влияет.

Как запретить проверки нашего домена совсем и что вы храните?

Напишите нам — мы внесём домен в список исключений, и новые проверки по нему создаваться не будут; достаточно указать сам домен. Дальше мы подтверждаем, что домен ваш, и перестаём показывать результаты прошлых проверок по нему. Собранные данные по такому обращению удаляются — отдельным решением с нашей стороны, потому что удаление необратимо.

Собранное сырьё нужно нам только как доказательная база уже выданного отчёта, и по сроку оно удаляется автоматически: сохранённые копии страниц, файлы собранных фактов, сетевые и cookie-логи проверки — через 90 дней; снимки экрана и копии опубликованных на сайте документов — через 12 месяцев. Публиковать собранное или передавать его третьим лицам мы не будем: данные используются только для отчёта конкретному заказчику.

Остались вопросы?

Напишите нам — на странице контактов собрано, какое обращение куда идёт. Или запустите бесплатный экспресс-анализ и посмотрите на результат своими глазами.