Оглавление

С момента выхода ChatGPT в конце 2022 года облик интернета начал меняться, и теперь это подтверждено цифрами. Согласно новому исследованию, о котором пишет The Decoder, доля текстов, созданных искусственным интеллектом, демонстрирует устойчивый и стремительный рост.

Аналитики Pew Research Center изучили массив из почти 500 тысяч англоязычных веб-страниц, используя архив Common Crawl и инструменты детекции Open Pangram. Результаты показывают, что более трети страниц, созданных после запуска известных языковых моделей, несут на себе явные следы машинного авторства.

Любопытно, что коммерческие домены .com внедряют технологии генерации текста в десять раз активнее, чем образовательные (.edu) или государственные (.gov) ресурсы. В то время как на официальных сайтах доля ИИ-контента составляет около 1%, в коммерческом сегменте она достигла 10% от общего объема страниц.

Лингвистические маркеры и «цифровой диалект»

Исследователи заметили, что алгоритмы привнесли в сеть специфическую манеру письма. Например, использование оксфордской запятой выросло на 63%, а частота появления длинных тире увеличилась вдвое. Похоже, у нейросетей есть свои стилистические фавориты, которые они навязывают цифровому пространству.

Слова вроде delve, pivotal и tapestry стали встречаться в два раза чаще, превращаясь в своего рода «цифровые отпечатки пальцев». Также наблюдается почти трехкратный рост конструкций отрицательного параллелизма, строящихся по принципу «это не просто X, это Y», что делает тексты более пафосными, но предсказуемыми.

Рост частотности специфических слов-маркеров и пунктуационных паттернов свидетельствует о формировании «усредненного» стиля интернета. Это ведет к семантической энтропии, где уникальность авторского слога приносится в жертву алгоритмической гладкости. Рынок рискует захлебнуться в однотипном контенте, который формально безупречен, но содержательно стерилен.

Проблема детекции и размытые границы авторства

Несмотря на пугающую статистику, остается открытым вопрос методологии. Текущие детекторы ИИ, включая Open Pangram, часто пасуют перед гибридными текстами, где человек лишь редактирует сгенерированный черновик или использует нейросеть для полировки собственных мыслей.

Грань между «полностью машинным» и «частично автоматизированным» письмом становится все более прозрачной. Эксперты отмечают, что общественная дискуссия часто поляризована: использование ИИ либо клеймится как «шлак», либо превозносится как абсолютная эффективность, при этом игнорируется реальная практика совместной работы человека и алгоритма.

В конечном итоге, данные Pew Research лишь фиксируют фазу активного накопления критической массы ИИ-текстов. Поскольку темпы внедрения технологий не снижаются, вопрос не в том, как отличить человека от машины, а в том, как мы адаптируем свои стандарты качества к этой новой, гибридной реальности.