ШІ захоплює веб: понад третина нових сторінок створена нейромережами

Масштабне дослідження, що охопило вибірку з 10 000 випадкових англомовних веб-сторінок, зібраних у липні 2026 року, проливає світло на стрімку експансію генеративних моделей. Аналіз, проведений за допомогою спеціалізованої моделі машинного навчання, виявив, що приблизно 10% усіх проіндексованих сторінок несуть явні сліди синтетичного авторства.
Однак цей середній показник оманливий. Ключовий інсайт криється в динаміці: якщо розглядати лише контент, опублікований після дебюту ChatGPT у листопаді 2022 року, картина радикально змінюється. Серед «свіжих» матеріалів частка сторінок, створених або суттєво відредагованих ШІ, перевищує одну третину. Це прямий доказ того, що генеративні моделі стали не просто інструментом, а основним «автором» значної частини нового веб-контенту.
Комерційний сектор — головний драйвер синтетики
Розподіл ШІ-генерації за доменними зонами вкрай нерівномірний і відображає економічні стимули. Лідирує зона .com, де ознаки ШІ виявляються приблизно в кожної десятої сторінки — це вдвічі більше, ніж у .org (4,6%). Найбільш «чистими» залишаються освітні (.edu) та урядові (.gov) ресурси з показником близько 1%.
Така поляризація пояснюється: комерційні майданчики активно автоматизують виробництво SEO-текстів, описів товарів і новинних стрічок, де швидкість та обсяг критично важливі. На початку ери ChatGPT розрив між зонами був менш помітним, але зараз тренд очевидний.
Методологія та застереження
Важливо підкреслити: дослідження не є точним підрахунком, а радше оцінкою ймовірного авторства. Методологія базується на аналізі лінгвістичних маркерів, що статистично корелюють із генеративними моделями, а не на перевірці історії створення кожної сторінки. Крім того, до категорії «ШІ-контенту» потрапляють лише тексти, написані або суттєво перероблені нейромережею; дрібні правки не враховуються.
Це дослідження — ще один дзвіночок для ринку. Ми спостерігаємо не просто зростання, а структурну трансформацію вебу, де синтетичний контент стає «новою нормою» в комерційному сегменті. Це ставить нові виклики перед пошуковими алгоритмами та маркетологами: довіра до інформації та боротьба за органічний трафік дедалі більше залежатимуть від здатності відрізняти людський текст від машинного. Ініціативи з маркування, подібні до тієї, що впровадила Anthropic для Claude, — лише перший крок у цій гонці озброєнь.