Искусственный интеллект создал 35% нового контента в интернете

ChatGPT и другие крупные языковые модели преобразуют не только веб, но и сам язык

22 августа 2026, 14:01Искусственный интеллектDexter0

Более трети англоязычных веб-страниц, выпущенных после запуска ChatGPT, могут содержать тексты, созданные или значительно отредактированные искусственным интеллектом. Эту информацию представил Pew Research Center, проанализировав около 490 тысяч англоязычных страниц из веб-архива Common Crawl за последние пять лет. Для проверки текстов использовался детектор OpenPangram, который с помощью машинного обучения выявляет статистические характеристики, присущие ИИ-контенту.

В случайной выборке из 10 тысяч страниц, доступных в Common Crawl в июле 2026 года, примерно 10% показали значительные признаки ИИ-авторства или редактирования. Однако в эту статистику попали и многие устаревшие материалы, созданные ещё до появления современных генеративных чат-ботов.

Если рассматривать только страницы, выпущенные после запуска ChatGPT, доля резко увеличивается. В июле 2026 года признаки применения ИИ наблюдались примерно в 35% таких материалов. Причём чем новее страницы, тем выше этот показатель.

Распространение ИИ-контента в интернете оказалось также неравномерным. На коммерческих доменах .com в 2026 году признаки генерации или редактирования ИИ встречались примерно на каждой десятой странице. Для .org этот показатель составлял около 4,6%, а для .edu и .gov — примерно 1%. Иными словами, коммерческий сектор интернета быстрее других заполняется материалами с признаками машинного происхождения.

Генеративный ИИ влияет уже не только на количество текстов в интернете, но и на сам язык. Сравнив современные материалы с текстами 2023 года, исследователи отметили увеличение ряда конструкций и знаков препинания, которые особенно часто используют чат-боты. Например, длинное тире стало встречаться примерно вдвое чаще, а использование оксфордской запятой увеличилось на 63%.

Исследователи подчеркивают, что отдельное слово, длинное тире или оксфордская запятая не могут служить доказательством того, что конкретный текст написан ИИ. Все эти особенности существовали в человеческой речи задолго до появления ChatGPT. Они становятся показательными только при статистическом анализе обширных массивов текстов.

Кроме того, у исследования есть ограничения: детекторы ИИ могут ошибаться, принимая текст, написанный человеком, за машинный или наоборот, не распознавая сгенерированный материал. Поэтому показатели в 10% и 35% следует воспринимать как оценки, а не как точный подсчет страниц, созданных нейросетями.

Тем не менее, тенденция выглядит показательной. Менее чем за четыре года после появления ChatGPT генеративный ИИ стал не просто инструментом для создания веб-контента — его следы уже заметны в статистике языка, которым пишется значительная часть нового англоязычного интернета.

Источники:Pew Research CenterИскусственный интеллект01 минуту назад

Источник
Елизавета Воронцова

Журналист информационного портала vtambove.ru. Освещает городские события, общественную повестку, социальные инициативы и актуальные новости региона. В работе придерживается принципов точности, оперативности и понятной подачи информации. Особое внимание уделяет темам, которые напрямую влияют на жизнь жителей Тамбова и области.

Оцените автора
Тамбов