Законность парсинга в России: 152-ФЗ, публичные данные, риски

Разбираем правовые аспекты парсинга в России: персональные данные, публичная информация, авторское право на базы данных. Не юридическая консультация.

Законность парсинга в России: 152-ФЗ, публичные данные, риски

Вопрос «законен ли парсинг» звучит в каждом втором брифе на автоматизированный сбор данных. Ответ разочарует тех, кто ищет простое «да» или «нет»: законность парсинга зависит от того, что именно собирается, откуда, каким способом и как используется дальше. Отдельного закона «о парсинге» в России нет — оценка строится на нормах о персональных данных, гражданском праве и условиях площадок.

Важная оговорка про 152-ФЗ и право в целом. Эта статья не является юридической консультацией и не заменяет оценку юриста применительно к конкретной задаче, источникам и объёму данных. Ниже — общий разбор факторов, которые обычно учитывают при принятии решения о сборе данных, и практика, которой придерживается Rinolens при выполнении промышленного парсинга под заказ. Перед стартом проекта, где есть риск столкнуться с персональными данными физлиц, рекомендуем обратиться к юристу, специализирующемуся на защите персональных данных.

Почему вопрос законности парсинга не имеет универсального ответа

Парсинг — это способ получения данных, а не отдельный вид деятельности с фиксированным правовым статусом. Сама технология автоматического обращения к странице и извлечения данных нейтральна. Правовая оценка возникает на уровне того, что именно извлекается и как это используется:

Серьёзные подрядчики не дают гарантий «всё легально» без анализа источников и целей сбора.

152-ФЗ и персональные данные при сборе информации

Ключевой блок риска в России — законодательство о персональных данных (152-ФЗ). Повторим оговорку: то, что написано ниже, — общая ориентировка, а не юридическое заключение. Для проекта, где в данных может присутствовать информация о физических лицах, нужна консультация профильного юриста.

Что считается персональными данными

К персональным данным обычно относят любую информацию, которая прямо или косвенно относится к определённому или определяемому физическому лицу: ФИО, телефон, email, адрес, иногда — фотографии или профильные идентификаторы. Важно понимать: то, что данные размещены в открытом доступе (например, в объявлении или профиле соцсети), само по себе не снимает их с категории персональных данных и не отменяет требований 152-ФЗ к их обработке.

Это принципиальный момент, который часто упускают при постановке задачи на парсинг: «данные лежат в открытом доступе» и «данные можно свободно собирать и обрабатывать в коммерческих целях» — не одно и то же с точки зрения закона.

Обезличивание и фильтрация ПДн на практике

На практике для B2B-задач часто есть возможность выстроить сбор так, чтобы персональные данные физических лиц вообще не попадали в итоговый массив, если они не нужны для бизнес-цели. Например, при сборе объявлений о продаже товаров ценность представляют характеристики товара, цена, категория, наличие — а не имя и телефон частного продавца. Разумная практика — исключать поля с ПДн ещё на этапе парсинга или сразу после него, до сохранения в базу.

Публичные данные vs закрытые разделы сайта

Разграничение между публичными и закрытыми данными — фактор, который стоит анализировать до начала сбора, а не после.

Что обычно относят к публичным данным

К информации, доступной без авторизации и специальных прав, обычно относят:

Что считается закрытым или ограниченным доступом

Другая категория — данные за авторизацией, в личных кабинетах, за платным доступом, а также информация, которую владелец сайта прямо обозначил как закрытую техническими средствами (капчи, ограничение доступа по IP, авторизация). Обход таких технических ограничений — самостоятельный фактор риска, который стоит оценивать отдельно от вопроса о характере самих данных. Ответственный подрядчик заранее обсуждает с заказчиком, какие источники доступны для сбора, а какие требуют отдельного согласования или вовсе исключаются из скоупа.

Пользовательские соглашения и robots.txt

Отдельный слой регулирования — не законы, а договорные документы конкретных площадок: пользовательские соглашения, условия использования сайта, файл robots.txt. Формально robots.txt — техническая рекомендация для поисковых роботов, а не юридически обязывающий документ сам по себе. Но пользовательское соглашение сайта может содержать прямой запрет на автоматизированный сбор данных — и это уже договорное условие, которое стоит принимать во внимание при планировании проекта.

Авторское право на структуру баз данных

В российском гражданском праве есть отдельная категория охраняемых объектов — базы данных, если их составление потребовало существенных затрат (подбора, расположения материалов). Вопрос авторского права может возникать не в отношении отдельных фактов (цена товара — не объект авторского права), а в отношении структуры и организации именно чужой базы данных как целого произведения.

На практике это означает: копирование отдельных публичных фактов (цена, характеристика, наличие) — один сценарий; массовое воспроизведение целиком чужой структурированной базы с последующей перепродажей как «своей» — принципиально другой, требующий отдельной юридической оценки. Мы намеренно не приводим здесь номера конкретных судебных дел — такие прецеденты нужно проверять и обсуждать с юристом применительно к задаче, а не опираться на обобщённые ссылки из статей в интернете.

Типовые B2B-сценарии сбора данных

В повседневной практике промышленного парсинга большинство задач заказчиков укладываются в несколько типовых сценариев, где вопрос персональных данных физлиц вообще не встаёт остро:

Подробнее о том, какие типы задач мы решаем и как выстраиваем такие проекты, — на странице сценариев использования парсинга. Примеры того, как это выглядело для разных отраслей, собраны в разделе кейсов.

Риски для бизнеса при непродуманном парсинге

Даже если технически парсинг реализуем, у заказчика могут возникнуть репутационные и операционные риски, если сбор данных спланирован без предварительного анализа:

Как Rinolens подходит к вопросу законности

Мы не даём заказчикам юридических заключений и не обещаем «стопроцентную законность» — это прерогатива юриста, который оценивает конкретный проект, источники и цели использования данных. Что мы делаем на своей стороне — это аудит источников перед стартом работ: разбираем, какие данные на сайте являются публичными и не требуют авторизации, какие поля потенциально содержат персональные данные и должны быть исключены из сбора, какие разделы источника мы не трогаем в принципе.

Такой аудит снижает риски для заказчика ещё до того, как запущен первый парсер, и формирует прозрачное техническое задание, где явно зафиксировано, что собирается, а что — нет. Ознакомиться с форматами работы и стоимостью можно на странице тарифов.

Заключение

Парсинг в России не запрещён как метод получения данных, но и не является автоматически безопасным действием — законность конкретного проекта определяется совокупностью факторов: характером данных, их публичностью, условиями конкретного источника и целью использования. Персональные данные физических лиц требуют повышенного внимания даже тогда, когда они формально находятся в открытом доступе. Структурированные базы данных могут быть отдельным объектом правовой охраны.


Заказать аудит источников

Планируете сбор данных и хотите заранее понять, какие источники безопасны для парсинга, а какие требуют осторожности или юридической консультации? Разберём вашу задачу и предложим план сбора, который решает бизнес-цель без лишних рисков.

Заказать аудит источников →

Обсудить задачу

Расскажите о категориях, источниках и желаемой частоте обновления — подготовим оценку пилота и структуру данных.

Перейти к форме