ГлавнаяБлогПравила сбора данных
📜 Правила платформы · по первоисточникам

Сбор данных в Telegram: что запрещено правилами

Один запрет Telegram написал без единой оговорки: собирать данные с платформы ради обучения нейросетей нельзя. Ни скрейпить, ни индексировать, ни агрегировать — формулировка перечисляет глаголы подряд. Остальное сложнее: правил три штуки, лежат они в трёх разных документах, и отдельного пункта «нельзя собирать участников чата» нет ни в одном. Зато есть широкая рамка про «обычное использование платформы как её пользователем» и обещание вечного бана за флуд, спам и накрутку счётчиков. Разбираю дословно, потому что пересказы этих документов в рунете расходятся с оригиналом.

Что изменилось на этой неделе

Мы держим страницы документации Telegram под ежедневным диффом. Между 31 августа и 3 сентября изменилась ровно одна страница из двадцати одной — /bots/features, и ровно на два абзаца во вступлении.

Было: ИИ-боты могут нативно встречаться, общаться и соревноваться друг с другом. Стало: сторонние ИИ-боты приветствуются в общении с пользователями и друг с другом — «при условии, что они придерживаются правил». И слово «правил» стоит ссылкой, которая ведёт не в общий документ, а точно в раздел 4.3 Data Scraping условий для разработчиков ботов.

Правку такого рода легко пропустить: ни в блоге, ни в списке изменений Bot API её нет. Но Telegram редко переписывает вступление ради красоты. Раздел, на который он теперь показывает пальцем, стоит прочитать целиком — что я и сделал, вместе с двумя соседними документами, о существовании которых половина разработчиков не знает.

Три документа, а не один

Сбор данных в Telegram описан не в одном месте, и это главная причина путаницы. У каждого документа своя аудитория, и требования не совпадают.

ДокументКого касаетсяКлючевой пункт
Content Licensing and AI Scrapingвсех, кто получает данные с платформызапрет на сбор ради ИИ, отзывная лицензия на остальное
API Terms of Serviceсторонних клиентов на MTProtoнельзя действовать за пользователя без его ведома
Terms of Service for Bot Developersботов и мини-аппов на Bot APIраздел 4.3: не собирать больше необходимого

Плюс отдельная страница про получение api_id, где лежит самая известная фраза во всей этой истории — про бан навсегда. Её мы разбирали в материале за что Telegram банит аккаунты.

Что запрещено прямым текстом: обучение ИИ

Самый жёсткий документ — короткий, на полторы страницы, и называется «Условия лицензирования контента и ИИ-скрейпинга». Раздел про большие языковые модели написан так, что толковать его двояко не выйдет.

Дословно: Telegram решительно запрещает скрейпинг, индексирование, сбор, агрегацию или использование данных, полученных с платформы, для обучения, дообучения, валидации или иного участия в разработке, улучшении, бенчмаркинге либо развёртывании искусственного интеллекта, моделей машинного обучения и подобных технологий.

Обрати внимание на список глаголов. Там не только «обучать» — там ещё валидация и бенчмаркинг. То есть прогнать выгрузку из чата через чужую модель, чтобы сравнить её с другой моделью, формально тоже нельзя. И «индексирование» стоит в одном ряду со скрейпингом, что бьёт по поисковикам по Telegram куда сильнее, чем по маркетологам.

Исключение прописано, но пользоваться им почти невозможно. Нужно индивидуальное, явное, информированное, утвердительное и продолжающееся согласие каждого затронутого пользователя, строго ограниченное конкретным контентом и конкретным чатом. И отдельно оговорено: согласие, полученное в одном контексте, не переносится на другой и не даёт лицензии на данные из остальных чатов. Собрать такое с чата на десять тысяч человек — задача не про технологии.

Это тот случай, когда правило написано под конкретную волну. Telegram с мая 2026 года сам строит экосистему ИИ-ботов — гостевые ассистенты, боты, которые общаются с ботами, автоматизация переписки. Пускать в неё разработчиков и одновременно позволять им уносить содержимое чатов в свои датасеты платформа не собирается. Про то, как выглядит обратная сторона этой волны, у нас есть разбор нейрокомментинга.

Что запрещено ботам: раздел 4.3 целиком

Условия для разработчиков ботов — документ куда длиннее, и раздел про скрейпинг в нём занимает три предложения. Первое задаёт принцип: не собирать, не хранить, не агрегировать и не обрабатывать данные сверх того, что необходимо для работы твоего сервиса.

Второе перечисляет, что запрещено всегда: любой сбор данных, нацеленный на создание больших датасетов, моделей машинного обучения и ИИ-продуктов, — и приводит пример «скрейпинг содержимого публичных групп и каналов». Третье разрешает то, что пользователь передал боту сам и добровольно, при условии явного, индивидуального, активного и отзываемого согласия.

Рядом лежит раздел 4.2 — про хранение, и он конкретнее многих российских регламентов. Удалять данные требуется без неоправданной задержки в четырёх случаях.

  1. По требованию пользователя — или самого Telegram.
  2. Когда хранение перестало быть необходимым для работы сервиса.
  3. При прекращении работы бота на платформе — всё, кроме того, на что есть явное согласие пользователя, и только пока это согласие действует.
  4. По законному запросу уполномоченного органа.

Ещё два пункта оттуда же, которые касаются каждого, кто пишет автоматизацию. Раздел 4.5: выданные тебе api_id, хеш и токены публиковать запрещено, и любые действия тех, кто авторизовался под твоими креденшелами, считаются твоими — независимо от того, как они их получили. Раздел 5.2 пункт «f»: бот не должен обходить рейт-лимиты и модерацию, в том числе работая «по доверенности» на чужих ключах Bot API.

И там же, в списке запрещённых сценариев, отдельной строкой стоит social growth manipulation — накрутка социальных сигналов. Соседствует она с финансовыми пирамидами и фишингом, что неплохо показывает, как платформа её оценивает. Что из методов продвижения переживает такую рамку, а что нет, разобрано в материале про раскрутку канала.

Может ли бот собрать список участников чата

Нет, и правила тут ни при чём. В Bot API вообще нет метода, который отдаёт список участников. Я проверил свежий снимок страницы: есть getChatMember — узнать статус по конкретному идентификатору, есть getChatMemberCount — получить число участников, есть getChatAdministrators — список админов. Всё.

Поэтому запрет из раздела 4.3 бьёт не по спискам участников, а по содержимому: бот, добавленный в публичную группу, видит поток сообщений и мог бы складывать его в датасет. Ровно это Telegram и назвал примером всегда запрещённого использования. Разницу между тем, что видит бот и что видит обычный клиент, мы разбирали в статье про ботов в чате, а что нового приехало в последнем обновлении платформы — в разборе Bot API 10.3.

Что запрещено сторонним клиентам

Третий документ — условия использования API, они же правила для тех, кто пишет свой клиент поверх MTProto. Тут интереснее всего пункт 1.4, потому что именно он задаёт рамку для всей автоматизации: запрещено вмешиваться в базовую функциональность, и первым в списке примеров стоит «действия от имени пользователя без его ведома и согласия».

Дальше по списку — не мешать самоуничтожению сообщений, не прятать статусы «в сети» и «был недавно», не подделывать отметки о прочтении. Последнее сформулировано с прямым указанием на популярный трюк: «например, реализация режима невидимки». Кто ставил модифицированный клиент ради того, чтобы читать чужие сообщения без отметки, теперь знает, каким пунктом это описано.

Пункт 1.5 добавили под ту же волну ИИ: использование API дополнительно подчинено условиям про лицензирование контента, а значит агрегировать данные с платформы для обучения моделей запрещено и здесь. Один и тот же запрет продублирован в двух документах из трёх — это редкость и обычно означает, что тему считают важной.

Наказание для клиента прописано мягче, чем для аккаунта. Telegram уведомляет аккаунт, ответственный за приложение, даёт 10 дней на исправление, и только потом отключает доступ к API и пишет в магазины приложений о снятии программы. Для живого аккаунта таких десяти дней нет — на странице получения api_id сказано коротко: за флуд, спам и подделку счётчиков подписчиков и просмотров бан навсегда.

Где на самом деле проходит граница для парсинга

Здесь придётся уточнить то, что мы сами писали раньше. В материале законно ли парсить Telegram мы опирались на список из правил получения api_id и обращали внимание, что сбора данных в этом списке нет. Это по-прежнему верно. Но есть документ, который мы тогда не разбирали, и формулировка в нём шире.

Дословно: доступ к пользовательскому контенту для любых целей, кроме обычного, законного и предусмотренного использования платформы Telegram как её пользователем, запрещён. Как ограниченное исключение Telegram разрешает доступ к данным, необходимым для запуска и работы легитимного стороннего клиента, бота или мини-аппа — на отзывной, ограниченной, неисключительной, непередаваемой основе и строго в объёме, необходимом для работы сервиса.

Прочитай ещё раз слово «отзывной». Это не разрешение, это лицензия, которую забирают в одностороннем порядке. Отдельного пункта «нельзя выгружать участников» в документах нет — но и разрешения на массовую выгрузку тоже нет, а трактует широкую формулировку та же сторона, которая её написала.

Мой вывод после чтения всех трёх документов такой. Явно и поимённо запрещены четыре вещи: обучение ИИ на данных платформы, спам, накрутка счётчиков и хранение данных дольше необходимого. Всё остальное живёт в серой зоне, где решает не текст правил, а поведение — и, честно говоря, меня это устраивает больше, чем притворяться, будто у нас есть письменное разрешение. Его нет ни у кого.

Практическое следствие для тех, кто собирает аудиторию: риск создаёт не сбор, а то, что ты делаешь дальше. Одна и та же выгрузка из активных писавших может пролежать без единой жалобы или превратиться в тысячу репортов — разница только в том, что ты отправишь и кому. А вот идея «соберу побольше и скормлю модели» из серой зоны выпала окончательно: теперь это написано в двух документах из трёх.

Что делать прямо сейчас

  1. Если у тебя ИИ-бот в телеграмм — заведи политику приватности. Через BotFather. По умолчанию к боту применяется стандартная политика Telegram, и отвечать за несоответствие ей практике будешь ты.
  2. Не складывай переписку в датасет. Даже «для внутренних тестов» и «просто померить качество» — валидация и бенчмаркинг названы отдельными глаголами.
  3. Настрой удаление данных. Четыре случая из раздела 4.2 стоит реализовать до того, как придёт первый запрос, а не после.
  4. Не давай никому свои ключи. Действия под твоими креденшелами — твои действия, это написано буквально.
  5. Собираешь аудиторию — сегментируй. Точное попадание снижает не только стоимость лида, но и число жалоб, а жалобы и есть настоящий механизм наказания.

Наш парсер аудитории работает от лица обычного пользователя, вступившего в чат: собирает участников, писавших и комментаторов, то есть то, что люди опубликовали сами. Скрытое мы не вскрываем и подписчиков каналов не обещаем — Telegram их не отдаёт. Аккаунты под сбор лежат в каталоге и проверяются в момент выдачи, разводить их по адресам — резидентными прокси.

Частые вопросы

Запрещает ли Telegram парсить открытые чаты?

Отдельного пункта «нельзя собирать участников» ни в одном из документов нет. Но есть формулировка пошире: доступ к пользовательскому контенту для любых целей, кроме обычного, законного и предусмотренного использования платформы как её пользователем, запрещён. Это из документа Terms of Service for Content Licensing and AI Scraping. Разрешение там даётся как ограниченное исключение и только на данные, которые нужны для работы легитимного клиента, бота или мини-аппа, причём лицензия названа отзывной. Прямого запрета на чтение открытого чата нет, прямого разрешения на массовую выгрузку тоже.

Можно ли обучать нейросеть на сообщениях из Telegram?

Нет, и это единственный запрет, написанный без обиняков. Telegram запрещает scraping, indexing, harvesting, aggregation и любое использование данных с платформы для обучения, дообучения, валидации, разработки, улучшения, бенчмаркинга или развёртывания моделей машинного обучения. Исключение возможно, если каждый затронутый пользователь дал явное, информированное, утвердительное и продолжающееся согласие, ограниченное конкретным чатом или каналом. Согласие из одного чата на другой не переносится.

Может ли бот выгрузить список участников чата?

Нет, и дело даже не в правилах. В Bot API просто нет метода, который отдаёт список участников. Есть getChatMember по конкретному идентификатору, getChatMemberCount для числа участников и getChatAdministrators для админов. Списка нет ни в каком виде. Проверено по странице core.telegram.org/bots/api 3 сентября 2026 года.

Что грозит за нарушение правил API?

На странице получения api_id написано прямо: за использование Telegram API для флуда, спама и подделки счётчиков подписчиков и просмотров каналов аккаунт банится навсегда. Отдельно оговорено, что все аккаунты, входящие через неофициальные клиенты, автоматически ставятся под наблюдение. Для приложений-клиентов процедура мягче: Telegram уведомляет ответственный аккаунт и даёт 10 дней на исправление, после чего отключает доступ к API и обращается в магазины приложений.

Сколько данных пользователей можно хранить боту?

Ровно столько, сколько нужно для работы сервиса, и не дольше, чем нужно. Условия для разработчиков перечисляют четыре случая, когда данные надо удалять без неоправданной задержки: по требованию пользователя или самого Telegram, когда хранение перестало быть необходимым, при прекращении работы бота и по законному запросу уполномоченного органа. Отдельно требуется политика приватности: своя через BotFather или стандартная, которая применяется по умолчанию.

Что нового появилось в правилах в сентябре 2026?

Сами правила не менялись. Изменилось вступление страницы core.telegram.org/bots/features: между 31 августа и 3 сентября 2026 года Telegram переписал абзац про ИИ-ботов. Раньше там говорилось, что ИИ-боты могут встречаться, общаться и соревноваться, теперь — что сторонние ИИ-боты приветствуются, пока соблюдают правила, и слово «правила» ведёт ссылкой ровно в раздел 4.3 Data Scraping условий для разработчиков.

Запрет на использование данных для обучения ИИ, формулировка про «обычное, законное и предусмотренное использование» и условия исключения по согласию — из документа Terms of Service for Content Licensing and AI Scraping. Раздел 4.3 Data Scraping, обязанности по удалению данных из 4.2, правило о креденшелах из 4.5 и список запрещённых сценариев из 5.2 — из условий для разработчиков ботов. Пункты 1.4, 1.5 и порядок с десятью днями на исправление — из API Terms of Service. Фраза про вечный бан за флуд, спам и подделку счётчиков и про наблюдение за неофициальными клиентами — со страницы получения api_id. Состав методов Bot API по участникам и переписанный абзац про ИИ-ботов — со страниц bots/api и bots/features. Всё снято и сверено 3 сентября 2026 года; изменение во вступлении /bots/features зафиксировано диффом против нашего снимка от 31 августа.

Собрать аудиторию по правилам

Парсер TrueStore читает то, что люди опубликовали сами: участников, писавших и комментаторов. Разовый сбор от 50 ₽, экспорт в XLSX и TXT.