Легален ли парсинг: что говорят правила площадок
Одного слова в ответе здесь не будет. «Да» и «нет» на вопрос о легальности парсинга одинаково бессмысленны. Практическая граница проходит по трём проверкам: данные публичные или лежат за логином, что говорит пользовательское соглашение площадки, есть ли в выгрузке персональные данные. Публичные данные, собранные в рамках правил площадки и без персональных, это обычная рабочая зона, в которой я и беру заказы. Всё, что за её чертой, требует правовой оценки под конкретный случай. Юридических вердиктов в этом посте не будет, только сами первоисточники и то, как это выглядит на практике.
Что считается публичными данными
Публичными я называю то, что источник показывает любому посетителю без входа в аккаунт: посты открытого Telegram-канала со счётчиками просмотров, карточки товаров в каталоге Wildberries, объявления на Авито, открытые сообщества ВКонтакте. Страницу видит каждый, значит данные на ней тоже видны каждому.
За этой чертой начинается всё остальное: переписки, закрытые каналы и группы, статистика личных кабинетов, содержимое, которое открывается после авторизации. Отдельная категория это персональные данные: имена, телефоны, почты, привязанные к конкретному человеку. В России их оборот регулирует 152-ФЗ: для работы с ними нужно законное основание, одной технической возможности парсера мало.
Какие ограничения пишут сами площадки
Закон и правила площадки это разные документы. Закон пишет государство, правила пользования пишет сама площадка, и вы принимаете их, заходя на сайт. На нарушение своих правил площадка отвечает блокировкой: доступ закрывают аккаунту, IP-адресу, целым диапазонам. Правовую оценку конкретного сбора даёт юрист, а требования самих площадок видны из их документов.
Telegram формулирует жёстче остальных. Основные условия использования ссылаются на отдельный документ о лицензировании контента, и в нём прямым текстом запрещён доступ к пользовательскому контенту в целях, отличных от обычного использования платформы. Узкое исключение сделано для легальных клиентов, ботов и мини-приложений. Сбор данных для обучения нейросетей запрещён отдельно. Документ действует с 2026 года, в веб-архиве он виден с июля. Что эти правила значат для сбора по открытым каналам, я разбираю в посте про парсер Telegram-каналов.
У Авито, Wildberries и ВКонтакте подход общий: в пользовательских соглашениях автоматизированный сбор данных ограничен, сервисами предполагается пользоваться как обычный посетитель. Формулировки у площадок разные, редакции обновляются, поэтому перед работой я открываю актуальную версию соглашения на самом сайте, а не пересказы из чужих статей.
Что в парсинг точно нельзя
Красные линии, за которые я не выхожу с заказами.
- Обходить авторизацию, капчу и технические защиты. Данные за входом не публичные, каким бы лёгким ни казался обход.
- Собирать персональные данные людей без законного основания: телефоны из объявлений, связки имени и почты, всё, что сводится к конкретному человеку.
- Лезть в приватные переписки и закрытые каналы. Это чужие данные, недоступные обычному читателю.
- Вести массовый сбор против явного запрета площадки. Для Telegram такой запрет описан выше.
- Отдавать выгрузки на обучение нейросетей, если источник это запрещает.
Риски для бизнеса при заказе парсинга
Заказчик думает о результате, а риски прячутся в деталях. Вот четыре зоны, которые стоит проговорить до старта.
Блокировка доступа
Площадка может закрыть аккаунт и IP, с которых шёл сбор. Если парсер привязан к вашему рабочему аккаунту, пострадает ваш аккаунт, со всей историей и клиентами в нём.
Персональные данные в выгрузке
Если в таблицу попали телефоны или почты людей, компания обязана эти данные защищать и вовремя удалять. Состав выгрузки проверяют до того, как она уехала в работу.
Испорченные данные
Сбор в обход ограничений часто отдаёт мусор: дубли, обрезанные поля, устаревшие цены. Дешёвый обход правил потом обходится дороже чистой работы.
Граница без фиксации в договоре
Что собираем, откуда, где храним и когда удаляем, прописывают в договоре до подписания. Если исполнитель не спросил про источник и назначение данных, это повод насторожиться.
Что уточнить перед заказом парсинга
Список, который я прогоняю с заказчиком в брифе.
- Какие данные нужны и зачем: поля, период, объём, частота обновления.
- Источник публичный или за логином. Второй вариант в работу не берётся без отдельной правовой оценки.
- Что разрешает и запрещает актуальное пользовательское соглашение площадки.
- Есть ли в данных персональные и что с ними делать при хранении и удалении.
- Где живёт результат и у кого к нему доступ.
Ответы на эти вопросы занимают минуты, а снимают главные разногласия заранее.
Коротко
Вопрос «легален ли парсинг» закрывается проверками до старта: публичность, правила площадки, персональные данные. Все три закрыты, и сбор превращается в обычную инженерную задачу; открыта хотя бы одна, и задачу сначала разбирают с юристом. По Telegram я собираю публичные данные и фиксирую границу в брифе, как это устроено в услуге парсинга Telegram. Более широкий срез задач по сбору данных лежит в категории «Парсинг данных».
Частые вопросы
- Законно ли парсить публичные данные?
- «Публичные» означает видимые без входа: посты открытых каналов, каталоги магазинов, объявления. Такой сбор обычная аналитическая практика. Тонкости в двух местах: правила площадки, на которой собираете, и персональные данные, если они попали в выгрузку. Оценку под конкретный случай даёт юрист, границу по задаче я фиксирую в брифе.
- Можно ли парсить Telegram-каналы?
- Открытые каналы собирают для аналитики: охваты, реакции, динамику подписчиков, сообщения открытых обсуждений. Ограничения задаёт сам Telegram в условиях использования: массовый сбор запрещён, исключение узкое, для легальных клиентов, ботов и мини-приложений, а данные для обучения нейросетей не трогают вовсе. Механику и границы этой работы я разбираю в отдельном посте про парсер Telegram-каналов.
- Что говорят правила Wildberries и Avito о парсинге?
- Обе площадки ограничивают автоматизированный сбор в пользовательских соглашениях. Для заказчика из этого следуют две вещи: сбор идёт по открытым страницам, а перед работой исполнитель сверяется с текущей редакцией соглашения на сайте самой площадки, потому что формулировки там обновляются.
- Что делать, если нужные данные за логином?
- Считать их непубличными и не лезть в эту зону вслепую. Обход авторизации и технических защит это отдельная категория риска, в которую я с заказами не хожу. Если данные доступны вам легально, через API или ваш кабинет, задача решается официальным доступом, а не парсером.
- Чем парсер отличается от бота?
- Парсер читает публичные данные как обычный посетитель и складывает их в таблицу, от вашего имени он ничего не отправляет. Бот работает от вашего аккаунта через официальный API: отвечает на сообщения, шлёт уведомления, принимает платежи. У бота есть владелец и правила API, у парсера источник и правила площадки.
Читайте также
- Парсер Telegram-каналов: как работает и что можноПарсер Telegram-каналов собирает публичные данные: посты, реакции, просмотры, сообщения открытых чатов. Как работает, что можно собрать и что нельзя.
- Как перенести Telegram-бота в MAXПеренос Telegram-бота в MAX: что переезжает без изменений, что меняется в Bot API и оплате, зачем верифицированное юрлицо и сколько занимает перенос.