Что изменилось на этой неделе
Мы держим страницы документации Telegram под ежедневным диффом. Между 31 августа и 3 сентября изменилась ровно одна страница из двадцати одной — /bots/features, и ровно на два абзаца во вступлении.
Было: ИИ-боты могут нативно встречаться, общаться и соревноваться друг с другом. Стало: сторонние ИИ-боты приветствуются в общении с пользователями и друг с другом — «при условии, что они придерживаются правил». И слово «правил» стоит ссылкой, которая ведёт не в общий документ, а точно в раздел 4.3 Data Scraping условий для разработчиков ботов.
Правку такого рода легко пропустить: ни в блоге, ни в списке изменений Bot API её нет. Но Telegram редко переписывает вступление ради красоты. Раздел, на который он теперь показывает пальцем, стоит прочитать целиком — что я и сделал, вместе с двумя соседними документами, о существовании которых половина разработчиков не знает.
Три документа, а не один
Сбор данных в Telegram описан не в одном месте, и это главная причина путаницы. У каждого документа своя аудитория, и требования не совпадают.
| Документ | Кого касается | Ключевой пункт |
|---|---|---|
| Content Licensing and AI Scraping | всех, кто получает данные с платформы | запрет на сбор ради ИИ, отзывная лицензия на остальное |
| API Terms of Service | сторонних клиентов на MTProto | нельзя действовать за пользователя без его ведома |
| Terms of Service for Bot Developers | ботов и мини-аппов на Bot API | раздел 4.3: не собирать больше необходимого |
Плюс отдельная страница про получение api_id, где лежит самая известная фраза во всей этой истории — про бан навсегда. Её мы разбирали в материале за что Telegram банит аккаунты.
Что запрещено прямым текстом: обучение ИИ
Самый жёсткий документ — короткий, на полторы страницы, и называется «Условия лицензирования контента и ИИ-скрейпинга». Раздел про большие языковые модели написан так, что толковать его двояко не выйдет.
Обрати внимание на список глаголов. Там не только «обучать» — там ещё валидация и бенчмаркинг. То есть прогнать выгрузку из чата через чужую модель, чтобы сравнить её с другой моделью, формально тоже нельзя. И «индексирование» стоит в одном ряду со скрейпингом, что бьёт по поисковикам по Telegram куда сильнее, чем по маркетологам.
Исключение прописано, но пользоваться им почти невозможно. Нужно индивидуальное, явное, информированное, утвердительное и продолжающееся согласие каждого затронутого пользователя, строго ограниченное конкретным контентом и конкретным чатом. И отдельно оговорено: согласие, полученное в одном контексте, не переносится на другой и не даёт лицензии на данные из остальных чатов. Собрать такое с чата на десять тысяч человек — задача не про технологии.
Это тот случай, когда правило написано под конкретную волну. Telegram с мая 2026 года сам строит экосистему ИИ-ботов — гостевые ассистенты, боты, которые общаются с ботами, автоматизация переписки. Пускать в неё разработчиков и одновременно позволять им уносить содержимое чатов в свои датасеты платформа не собирается. Про то, как выглядит обратная сторона этой волны, у нас есть разбор нейрокомментинга.
Что запрещено ботам: раздел 4.3 целиком
Условия для разработчиков ботов — документ куда длиннее, и раздел про скрейпинг в нём занимает три предложения. Первое задаёт принцип: не собирать, не хранить, не агрегировать и не обрабатывать данные сверх того, что необходимо для работы твоего сервиса.
Второе перечисляет, что запрещено всегда: любой сбор данных, нацеленный на создание больших датасетов, моделей машинного обучения и ИИ-продуктов, — и приводит пример «скрейпинг содержимого публичных групп и каналов». Третье разрешает то, что пользователь передал боту сам и добровольно, при условии явного, индивидуального, активного и отзываемого согласия.
Рядом лежит раздел 4.2 — про хранение, и он конкретнее многих российских регламентов. Удалять данные требуется без неоправданной задержки в четырёх случаях.
- По требованию пользователя — или самого Telegram.
- Когда хранение перестало быть необходимым для работы сервиса.
- При прекращении работы бота на платформе — всё, кроме того, на что есть явное согласие пользователя, и только пока это согласие действует.
- По законному запросу уполномоченного органа.
Ещё два пункта оттуда же, которые касаются каждого, кто пишет автоматизацию. Раздел 4.5: выданные тебе api_id, хеш и токены публиковать запрещено, и любые действия тех, кто авторизовался под твоими креденшелами, считаются твоими — независимо от того, как они их получили. Раздел 5.2 пункт «f»: бот не должен обходить рейт-лимиты и модерацию, в том числе работая «по доверенности» на чужих ключах Bot API.
И там же, в списке запрещённых сценариев, отдельной строкой стоит social growth manipulation — накрутка социальных сигналов. Соседствует она с финансовыми пирамидами и фишингом, что неплохо показывает, как платформа её оценивает. Что из методов продвижения переживает такую рамку, а что нет, разобрано в материале про раскрутку канала.
Может ли бот собрать список участников чата
Нет, и правила тут ни при чём. В Bot API вообще нет метода, который отдаёт список участников. Я проверил свежий снимок страницы: есть getChatMember — узнать статус по конкретному идентификатору, есть getChatMemberCount — получить число участников, есть getChatAdministrators — список админов. Всё.
Поэтому запрет из раздела 4.3 бьёт не по спискам участников, а по содержимому: бот, добавленный в публичную группу, видит поток сообщений и мог бы складывать его в датасет. Ровно это Telegram и назвал примером всегда запрещённого использования. Разницу между тем, что видит бот и что видит обычный клиент, мы разбирали в статье про ботов в чате, а что нового приехало в последнем обновлении платформы — в разборе Bot API 10.3.
Что запрещено сторонним клиентам
Третий документ — условия использования API, они же правила для тех, кто пишет свой клиент поверх MTProto. Тут интереснее всего пункт 1.4, потому что именно он задаёт рамку для всей автоматизации: запрещено вмешиваться в базовую функциональность, и первым в списке примеров стоит «действия от имени пользователя без его ведома и согласия».
Дальше по списку — не мешать самоуничтожению сообщений, не прятать статусы «в сети» и «был недавно», не подделывать отметки о прочтении. Последнее сформулировано с прямым указанием на популярный трюк: «например, реализация режима невидимки». Кто ставил модифицированный клиент ради того, чтобы читать чужие сообщения без отметки, теперь знает, каким пунктом это описано.
Пункт 1.5 добавили под ту же волну ИИ: использование API дополнительно подчинено условиям про лицензирование контента, а значит агрегировать данные с платформы для обучения моделей запрещено и здесь. Один и тот же запрет продублирован в двух документах из трёх — это редкость и обычно означает, что тему считают важной.
Наказание для клиента прописано мягче, чем для аккаунта. Telegram уведомляет аккаунт, ответственный за приложение, даёт 10 дней на исправление, и только потом отключает доступ к API и пишет в магазины приложений о снятии программы. Для живого аккаунта таких десяти дней нет — на странице получения api_id сказано коротко: за флуд, спам и подделку счётчиков подписчиков и просмотров бан навсегда.
Где на самом деле проходит граница для парсинга
Здесь придётся уточнить то, что мы сами писали раньше. В материале законно ли парсить Telegram мы опирались на список из правил получения api_id и обращали внимание, что сбора данных в этом списке нет. Это по-прежнему верно. Но есть документ, который мы тогда не разбирали, и формулировка в нём шире.
Прочитай ещё раз слово «отзывной». Это не разрешение, это лицензия, которую забирают в одностороннем порядке. Отдельного пункта «нельзя выгружать участников» в документах нет — но и разрешения на массовую выгрузку тоже нет, а трактует широкую формулировку та же сторона, которая её написала.
Мой вывод после чтения всех трёх документов такой. Явно и поимённо запрещены четыре вещи: обучение ИИ на данных платформы, спам, накрутка счётчиков и хранение данных дольше необходимого. Всё остальное живёт в серой зоне, где решает не текст правил, а поведение — и, честно говоря, меня это устраивает больше, чем притворяться, будто у нас есть письменное разрешение. Его нет ни у кого.
Практическое следствие для тех, кто собирает аудиторию: риск создаёт не сбор, а то, что ты делаешь дальше. Одна и та же выгрузка из активных писавших может пролежать без единой жалобы или превратиться в тысячу репортов — разница только в том, что ты отправишь и кому. А вот идея «соберу побольше и скормлю модели» из серой зоны выпала окончательно: теперь это написано в двух документах из трёх.
Что делать прямо сейчас
- Если у тебя ИИ-бот в телеграмм — заведи политику приватности. Через BotFather. По умолчанию к боту применяется стандартная политика Telegram, и отвечать за несоответствие ей практике будешь ты.
- Не складывай переписку в датасет. Даже «для внутренних тестов» и «просто померить качество» — валидация и бенчмаркинг названы отдельными глаголами.
- Настрой удаление данных. Четыре случая из раздела 4.2 стоит реализовать до того, как придёт первый запрос, а не после.
- Не давай никому свои ключи. Действия под твоими креденшелами — твои действия, это написано буквально.
- Собираешь аудиторию — сегментируй. Точное попадание снижает не только стоимость лида, но и число жалоб, а жалобы и есть настоящий механизм наказания.
Наш парсер аудитории работает от лица обычного пользователя, вступившего в чат: собирает участников, писавших и комментаторов, то есть то, что люди опубликовали сами. Скрытое мы не вскрываем и подписчиков каналов не обещаем — Telegram их не отдаёт. Аккаунты под сбор лежат в каталоге и проверяются в момент выдачи, разводить их по адресам — резидентными прокси.
Частые вопросы
Запрещает ли Telegram парсить открытые чаты?
Отдельного пункта «нельзя собирать участников» ни в одном из документов нет. Но есть формулировка пошире: доступ к пользовательскому контенту для любых целей, кроме обычного, законного и предусмотренного использования платформы как её пользователем, запрещён. Это из документа Terms of Service for Content Licensing and AI Scraping. Разрешение там даётся как ограниченное исключение и только на данные, которые нужны для работы легитимного клиента, бота или мини-аппа, причём лицензия названа отзывной. Прямого запрета на чтение открытого чата нет, прямого разрешения на массовую выгрузку тоже.
Можно ли обучать нейросеть на сообщениях из Telegram?
Нет, и это единственный запрет, написанный без обиняков. Telegram запрещает scraping, indexing, harvesting, aggregation и любое использование данных с платформы для обучения, дообучения, валидации, разработки, улучшения, бенчмаркинга или развёртывания моделей машинного обучения. Исключение возможно, если каждый затронутый пользователь дал явное, информированное, утвердительное и продолжающееся согласие, ограниченное конкретным чатом или каналом. Согласие из одного чата на другой не переносится.
Может ли бот выгрузить список участников чата?
Нет, и дело даже не в правилах. В Bot API просто нет метода, который отдаёт список участников. Есть getChatMember по конкретному идентификатору, getChatMemberCount для числа участников и getChatAdministrators для админов. Списка нет ни в каком виде. Проверено по странице core.telegram.org/bots/api 3 сентября 2026 года.
Что грозит за нарушение правил API?
На странице получения api_id написано прямо: за использование Telegram API для флуда, спама и подделки счётчиков подписчиков и просмотров каналов аккаунт банится навсегда. Отдельно оговорено, что все аккаунты, входящие через неофициальные клиенты, автоматически ставятся под наблюдение. Для приложений-клиентов процедура мягче: Telegram уведомляет ответственный аккаунт и даёт 10 дней на исправление, после чего отключает доступ к API и обращается в магазины приложений.
Сколько данных пользователей можно хранить боту?
Ровно столько, сколько нужно для работы сервиса, и не дольше, чем нужно. Условия для разработчиков перечисляют четыре случая, когда данные надо удалять без неоправданной задержки: по требованию пользователя или самого Telegram, когда хранение перестало быть необходимым, при прекращении работы бота и по законному запросу уполномоченного органа. Отдельно требуется политика приватности: своя через BotFather или стандартная, которая применяется по умолчанию.
Что нового появилось в правилах в сентябре 2026?
Сами правила не менялись. Изменилось вступление страницы core.telegram.org/bots/features: между 31 августа и 3 сентября 2026 года Telegram переписал абзац про ИИ-ботов. Раньше там говорилось, что ИИ-боты могут встречаться, общаться и соревноваться, теперь — что сторонние ИИ-боты приветствуются, пока соблюдают правила, и слово «правила» ведёт ссылкой ровно в раздел 4.3 Data Scraping условий для разработчиков.
Запрет на использование данных для обучения ИИ, формулировка про «обычное, законное и предусмотренное использование» и условия исключения по согласию — из документа Terms of Service for Content Licensing and AI Scraping. Раздел 4.3 Data Scraping, обязанности по удалению данных из 4.2, правило о креденшелах из 4.5 и список запрещённых сценариев из 5.2 — из условий для разработчиков ботов. Пункты 1.4, 1.5 и порядок с десятью днями на исправление — из API Terms of Service. Фраза про вечный бан за флуд, спам и подделку счётчиков и про наблюдение за неофициальными клиентами — со страницы получения api_id. Состав методов Bot API по участникам и переписанный абзац про ИИ-ботов — со страниц bots/api и bots/features. Всё снято и сверено 3 сентября 2026 года; изменение во вступлении /bots/features зафиксировано диффом против нашего снимка от 31 августа.