Перейти к содержанию

Легален ли парсинг: что говорят правила площадок

Одного слова в ответе здесь не будет. «Да» и «нет» на вопрос о легальности парсинга одинаково бессмысленны. Практическая граница проходит по трём проверкам: данные публичные или лежат за логином, что говорит пользовательское соглашение площадки, есть ли в выгрузке персональные данные. Публичные данные, собранные в рамках правил площадки и без персональных, это обычная рабочая зона, в которой я и беру заказы. Всё, что за её чертой, требует правовой оценки под конкретный случай. Юридических вердиктов в этом посте не будет, только сами первоисточники и то, как это выглядит на практике.

Что считается публичными данными

Публичными я называю то, что источник показывает любому посетителю без входа в аккаунт: посты открытого Telegram-канала со счётчиками просмотров, карточки товаров в каталоге Wildberries, объявления на Авито, открытые сообщества ВКонтакте. Страницу видит каждый, значит данные на ней тоже видны каждому.

За этой чертой начинается всё остальное: переписки, закрытые каналы и группы, статистика личных кабинетов, содержимое, которое открывается после авторизации. Отдельная категория это персональные данные: имена, телефоны, почты, привязанные к конкретному человеку. В России их оборот регулирует 152-ФЗ: для работы с ними нужно законное основание, одной технической возможности парсера мало.

Какие ограничения пишут сами площадки

Закон и правила площадки это разные документы. Закон пишет государство, правила пользования пишет сама площадка, и вы принимаете их, заходя на сайт. На нарушение своих правил площадка отвечает блокировкой: доступ закрывают аккаунту, IP-адресу, целым диапазонам. Правовую оценку конкретного сбора даёт юрист, а требования самих площадок видны из их документов.

Telegram формулирует жёстче остальных. Основные условия использования ссылаются на отдельный документ о лицензировании контента, и в нём прямым текстом запрещён доступ к пользовательскому контенту в целях, отличных от обычного использования платформы. Узкое исключение сделано для легальных клиентов, ботов и мини-приложений. Сбор данных для обучения нейросетей запрещён отдельно. Документ действует с 2026 года, в веб-архиве он виден с июля. Что эти правила значат для сбора по открытым каналам, я разбираю в посте про парсер Telegram-каналов.

У Авито, Wildberries и ВКонтакте подход общий: в пользовательских соглашениях автоматизированный сбор данных ограничен, сервисами предполагается пользоваться как обычный посетитель. Формулировки у площадок разные, редакции обновляются, поэтому перед работой я открываю актуальную версию соглашения на самом сайте, а не пересказы из чужих статей.

Что в парсинг точно нельзя

Красные линии, за которые я не выхожу с заказами.

  • Обходить авторизацию, капчу и технические защиты. Данные за входом не публичные, каким бы лёгким ни казался обход.
  • Собирать персональные данные людей без законного основания: телефоны из объявлений, связки имени и почты, всё, что сводится к конкретному человеку.
  • Лезть в приватные переписки и закрытые каналы. Это чужие данные, недоступные обычному читателю.
  • Вести массовый сбор против явного запрета площадки. Для Telegram такой запрет описан выше.
  • Отдавать выгрузки на обучение нейросетей, если источник это запрещает.

Риски для бизнеса при заказе парсинга

Заказчик думает о результате, а риски прячутся в деталях. Вот четыре зоны, которые стоит проговорить до старта.

Блокировка доступа

Площадка может закрыть аккаунт и IP, с которых шёл сбор. Если парсер привязан к вашему рабочему аккаунту, пострадает ваш аккаунт, со всей историей и клиентами в нём.

Персональные данные в выгрузке

Если в таблицу попали телефоны или почты людей, компания обязана эти данные защищать и вовремя удалять. Состав выгрузки проверяют до того, как она уехала в работу.

Испорченные данные

Сбор в обход ограничений часто отдаёт мусор: дубли, обрезанные поля, устаревшие цены. Дешёвый обход правил потом обходится дороже чистой работы.

Граница без фиксации в договоре

Что собираем, откуда, где храним и когда удаляем, прописывают в договоре до подписания. Если исполнитель не спросил про источник и назначение данных, это повод насторожиться.

Что уточнить перед заказом парсинга

Список, который я прогоняю с заказчиком в брифе.

  1. Какие данные нужны и зачем: поля, период, объём, частота обновления.
  2. Источник публичный или за логином. Второй вариант в работу не берётся без отдельной правовой оценки.
  3. Что разрешает и запрещает актуальное пользовательское соглашение площадки.
  4. Есть ли в данных персональные и что с ними делать при хранении и удалении.
  5. Где живёт результат и у кого к нему доступ.

Ответы на эти вопросы занимают минуты, а снимают главные разногласия заранее.

Коротко

Вопрос «легален ли парсинг» закрывается проверками до старта: публичность, правила площадки, персональные данные. Все три закрыты, и сбор превращается в обычную инженерную задачу; открыта хотя бы одна, и задачу сначала разбирают с юристом. По Telegram я собираю публичные данные и фиксирую границу в брифе, как это устроено в услуге парсинга Telegram. Более широкий срез задач по сбору данных лежит в категории «Парсинг данных».

Частые вопросы

Законно ли парсить публичные данные?
«Публичные» означает видимые без входа: посты открытых каналов, каталоги магазинов, объявления. Такой сбор обычная аналитическая практика. Тонкости в двух местах: правила площадки, на которой собираете, и персональные данные, если они попали в выгрузку. Оценку под конкретный случай даёт юрист, границу по задаче я фиксирую в брифе.
Можно ли парсить Telegram-каналы?
Открытые каналы собирают для аналитики: охваты, реакции, динамику подписчиков, сообщения открытых обсуждений. Ограничения задаёт сам Telegram в условиях использования: массовый сбор запрещён, исключение узкое, для легальных клиентов, ботов и мини-приложений, а данные для обучения нейросетей не трогают вовсе. Механику и границы этой работы я разбираю в отдельном посте про парсер Telegram-каналов.
Что говорят правила Wildberries и Avito о парсинге?
Обе площадки ограничивают автоматизированный сбор в пользовательских соглашениях. Для заказчика из этого следуют две вещи: сбор идёт по открытым страницам, а перед работой исполнитель сверяется с текущей редакцией соглашения на сайте самой площадки, потому что формулировки там обновляются.
Что делать, если нужные данные за логином?
Считать их непубличными и не лезть в эту зону вслепую. Обход авторизации и технических защит это отдельная категория риска, в которую я с заказами не хожу. Если данные доступны вам легально, через API или ваш кабинет, задача решается официальным доступом, а не парсером.
Чем парсер отличается от бота?
Парсер читает публичные данные как обычный посетитель и складывает их в таблицу, от вашего имени он ничего не отправляет. Бот работает от вашего аккаунта через официальный API: отвечает на сообщения, шлёт уведомления, принимает платежи. У бота есть владелец и правила API, у парсера источник и правила площадки.

Читайте также