Пт. Сен 4th, 2026

Эксперт объяснил, почему ИИ не может обучаться на закрытом контенте

Эксперт объяснил, почему ИИ не может обучаться на закрытом контенте

Работа за компьютером. Архивное фотоКраткий пересказ от РИА ИИ

  • Искусственный интеллект не может обучаться на данных, которые доступны только по платной подписке или закрыты от пользователей.
  • Поисковый робот или чат-бот собирают информацию в интернете одинаково: они отправляют запрос серверу и получают только те данные, которые сервер решил им вернуть.
  • Корректно настроенную серверную защиту нейросеть обойти не сможет в рамках обычного сбора данных для обучения.

Искусственный интеллект (ИИ) не может обучаться на данных, которые доступны только по платной подписке или закрыты от пользователей, рассказал РИА Новости амбассадор интернет-площадок в «Поиске Яндекса» Михаил Сливинский.

«У ИИ-систем нет особого доступа к сайтам. Поисковый робот или чат-бот собирают информацию в интернете одинаково: они отправляют запрос серверу и получают только те данные, которые сервер решил ему вернуть», — сказал он.

Эксперт объяснил, что если полный текст статьи, книги или другой материал доступен только авторизованным подписчикам, то робот увидит ровно столько же, сколько и неавторизованный пользователь.

Также он добавил, что не всякое ограничение доступа устроено одинаково. «Принципиально важно различать настоящий технический пейволл (в котором видна только часть открытого текста) и визуальную заглушку, которая не является защитным механизмом», — прокомментировал эксперт.

Так, по его мнению, в первом случае сервер сначала проверяет подписку и только после этого решает, отправлять ли пользователю полный текст. Если подписки нет, сам материал не покидает сервер.

Во втором случае, сайт сначала дает доступ к тексту целиком, а уже в браузере перекрывает его, например, окном входа в личный кабинет, которое можно закрыть. «Тогда данные технически уже были переданы пользователю — независимо от того, человек это или автоматизированная система», — уточнил эксперт.

Сливинский подытожил, что корректно настроенную серверную защиту нейросеть обойти не сможет в рамках обычного сбора данных для обучения.