Teach Me AI Academy

AI Insider #10: Мъртвият интернет вече не е теория

Публикувано на 31.08.2026

Все повече от това, което AI ти показва, е писано от друг AI.

Питаш AI. Той ти дава отговор с три източника. Отваряш ги, звучат супер. Само че и трите са писани от друг AI, който е учил от трети AI. Никъде в тази верига не присъства човек. И това вече не е параноя, а просто факт.

Теорията, която стана факт

От години кръжи една идея, наречена „теория за мъртвия интернет“: че по-голямата част от мрежата вече не са хора, а машини, които говорят с машини. Дълго беше конспирация по форумите като BG Mama. През 2026 г. стана статистика.

Ботовете вече надминаха хората. Cloudflare отчита, че 57,5% от заявките към уеб идват от автоматизирани системи, не от хора. Половината новопубликувани статии на английски са предимно AI-генерирани и този дял се задържа там вече над година. А според друго изследване 74% от новите уеб страници съдържат някакво AI съдържание.

Тук е важна една честна уговорка, за да не лъжа с числата. Пълно AI съдържание е малка част, около 3%. Огромната част са хибриди, човек плюс машина. Мрежата не става изведнъж изцяло фалшива. Тя първо минава през един размит, труден за разчитане етап.

Истинският проблем не е количеството

Механизмът е опасното: AI вече цитира AI.

Преди около месец излезе изследване с показателното име „AI Search Collapse“. То проверява какво реално цитират AI търсачките и открива, че значителен дял от източниците им са AI-генерирани статии и страници. Достатъчен е един самоцитиран текст, за да се завърти колелото и този дял расте ден след ден.

Ето какво се случва на всяко завъртане. Ти питаш. AI отговаря. Отговорът се публикува някъде в мрежата. Следващият AI го намира, цитира го и учи от него. Кръгът се затваря, а с всяко завъртане оригиналният човешки глас, ако въобще е присъствал, се разрежда още и още, и още.

Защо това е опасно

Отговорите се стесняват. Когато AI разчита все повече на AI съдържание, резултатите му стават постепенно по-еднакви, по-блудкави и, най-лошото, по-лесни за манипулиране. По-малко източници значи по-малко гледни точки, по-малко критика – повече съгласие.

Това ражда една огромна нова ниша за манипулация и контрол, която все по-силно ще влияе не само на бизнесите, а на човешките съдби.

Появи се цяла индустрия за подлъгване. Нарича се GEO, оптимизация за генеративни търсачки. Фирми пълнят мрежата с хвалебствени класации за себе си и плащат на хора да пишат за продуктите им в Reddit, само за да ги захапе AI и да те насочи натам. Абсурдни цитирания на списъци, създадени от самата компания, която се е титулувала на първо място.

И почти нищо не е обозначено. Одит на новинарски сайтове открива, че рубриките „мнения“ в престижни издания са замърсени с AI над шест пъти повече от новините, а около 95% от тях не са отбелязани. Ти не можеш да различиш и точно това е целта.

Когато ъпдейтът смени магазина

Има и трета, по-търговска страна на същия проблем: какво ти препоръчва AI, когато го питаш „кои маратонки да купя“ или „кой лаптоп е най-добър“. Отговорът е шокиращо нестабилен.

Един и същ въпрос, зададен два пъти, може да върне напълно различен списък марки. Отговорите са вероятностни и се менят дори според това от коя точка на света питаш. Едно проучване установява, че простичкото „какъв сапун за лице да ползвам“ дава 35 различни варианта на отговор в петте водещи модела. Смениш ли модела с нова версия, с друга дата на знание и друго обучение, целият списък се пренарежда. Марка, която вчера е била в топ 3, днес може да изчезне напълно.

И тук е жестокото. В AI отговора няма „втора страница“. Или си сред препоръчаните, или те няма. Затова спадът не е плавен, а тотален срив: от често препоръчван до нула.

Това не е хипотеза. Одит на Search Atlas описва марка за бебешки продукти със силно присъствие: 60млн. посещения месечно, позитивна оценка от AI и въпреки това нулева видимост в препоръките на петте водещи модела. AI харесва марката, но просто не я предлага. Дори Oreo, най-продаваната бисквитка в света, не излиза първа, когато питаш LLM да препоръча бисквити. (тествах с OpenAI /на 5-то място сложи Oreo/ и Claude /за шоколадова бисквита сложи Milka Choco Grains, Oreo не съществува/, пробвайте да ви препоръча сирене, ще паднете какви неща ще прочетете... )

Защо се случва. Препоръката не идва от качеството на продукта, а от следите, които марката е оставила в данните: потвърждение от трети страни и обсъждане в общности като Reddit. Новият модел е учил от малко по-различен свят и претегля тези следи различно, плюс вградената случайност в отговора. Затова препоръките се местят със самия ъпдейт. И понеже вече почти половината хора се допитват до AI преди покупка, това не е академичен въпрос, а говорим просто за пари.

Правилото за теб е същото като през цялата статия: третирай AI препоръката като едно мнение в даден момент, не като истина и факт. Питай „защо точно тези“ и „кое е на второ място“. Ако моделът не може да обоснове избора, значи ти пробутва следа, не преценка.

Сайтовете затварят вратата

Докато AI яде мрежата, мрежата започна да се съпротивлява. Все повече сайтове просто забраняват на AI ботовете да четат съдържанието им.

Правят го през един стар файл, наречен robots.txt. Той е текстов файл отпреди трийсет години, който казва на автоматичните обхождащи програми кои части от сайта могат да четат. Днес се превърна в предната линия на войната за данни. Един ред в него, „Disallow“, и казваш на GPTBot (на OpenAI), ClaudeBot (на Anthropic), CCBot (на Common Crawl) или Google-Extended да стоят навън.

И това вече не е рядкост. Одит от юни 2026 г. на 122 водещи сайта открива, че почти половината, 45%, блокират поне един голям AI бот. Най-често баннват Common Crawl (37%), ClaudeBot (36%) и Bytespider на ByteDance (35%). Само за половин година броят на сайтовете, добавили GPTBot в списъка със забранените, е скочил от 3,3 на 5,6 милиона.

Кои са те? Едни от най-големите имена в интернет. Когато OpenAI обяви своя обхождащ бот, Reddit, Wikipedia и New York Times почти веднага му затвориха вратата. Stack Overflow, Getty, големите новинарски издания. Списъкът расте всеки месец.

Защо го правят

Причината се крие в един простичък механизъм на AI инструментите: AI отговорите не пращат хора обратно към сайта източник. Google ти вземаше съдържанието, но ти пращаше читатели. AI взема съдържанието, смила го в отговор и не праща никого обратно. Ти плащаш за сървъра и труда, а стойността прибира някой друг. Затова издателите блокират: за да защитят приходите, авторското право и възможността да договарят платени абонаменти.

Но ето мръсната част. robots.txt не е катинар. Той е учтива (не толкова учтива де) молба и разчита на добрата воля на този, когото моли. Големите AI компании публично се кълнат, че спазват robots.txt. Разследване на TollBit обаче твърди, че OpenAI и Anthropic заобикалят тези забрани и обхождат съдържание въпреки забраната. Делът на AI ботовете, които игнорират robots.txt, е скочил от 3,3% до над 13% за няколко тримесечия.

Затова битката ескалира от учтива молба към съд. The New York Times съди OpenAI, че е пренебрегнал robots.txt. Reddit съди Anthropic за нарушаване на условията за ползване. Вратата вече не се залоства с файл, а явно с крупна бройка адвокати.

Post-hoc цитиране

И накрая, най-долната част от кръговрата на AI съдържанието. Дори когато AI ти показва източници, редът, в който се случват нещата, много често е обърнат.

Ти мислиш, че става така: AI чете източниците, после формулира отговор от тях. Всъщност често е обратното. Моделът първо ражда отговора от паметта си, смачква знанята си и ги изплюва в семантично правилна теза. А после търси източници, които да го подпрат. Нарича се post-hoc цитиране, цитиране след факта.

Изследванията са недвусмислени. Модел може да реши отговора чрез вътрешните си знания, после да съчини обосновка, която крие тази пътека. Цитираните източници могат да се появят в отговора, без изобщо да са повлияли на самия отговор. Един одит го формулира брутално откровено: моделът използва разсъжденията и цитатите като слой за оправдание, а не като двигател на решението.

Защо това е важно за теб. Когато видиш три спретнати източника под AI отговор, инстинктът ти казва „проверено е“. Но цитатът там може да е декорация, залепена след като отговорът вече е бил решен. Не доказателство, а гримче.

Как да не потънеш

Тревожно е, но не безнадеждно. Ето какво работи.

Искай първоизточника, не резюмето. Питай AI „кой е първичният източник и от коя година“, после отвори самия него. Ако не може да посочи, третирай отговора като слух. Годината е ключова, но внимавайте с датите, в блог, който аз съм създал, мога да напиша каквато дата си пожелая. Това е тъй нареченото „манипулиране чрез пътуване във времето“. Публикуваме нова статия, която слагаме дата преди 2020г. Ботът обхожда и прочита старата дата. Другият гнусен похват е, влизате в много стара статия, която е силно четена и редактирате като добавяте новите абзаци, с които подвеждате AI, че текстът си е оттогава.

Пази човекът резерват. Хора с име, лице и репутация, които губят нещо, ако сгрешат. Оригинални изследвания, а не статии за изследвания. Експерти, а не агрегатори. Хора, които пишат ръчно, със своите специфични изказ и фактология, накратко пази човешкия стил. Аз ги наричам хора резервати, защото са като малък остров сред морето от AI slop.

Съмнявай се в шаблонния консенсус. Ако пет източника казват едно и също с еднакви думи, това не е потвърждение. Може да е един и същи AI текст, преписан пет пъти.

Използвай AI за въпроси, не за истини. Той е блестящ да ти покаже какво да питаш и къде да копаеш. Опасен е, когато го приемеш като краен арбитър на факта. Това вече съм го дъвкал 40 пъти, така че няма да се разстилам този път.

Финална мисъл

Интернет не е мъртъв. Но е закачен на изкуствено дишане, което сами си сложихме. Машините пишат, машините четат, машините се цитират взаимно, а човекът все по-често е само зрител на разговор между копия.

В този свят най-ценното нещо, което имаш, е това, което не е копие: собствената ти преценка, житейския ти куриран мироглед. Пази го, той остава последният източник, който още не е генериран.

💬 Проверяваш ли вече първоизточника, или спираш до резюмето? А хващал ли си някоя тежка манипулация вече?

ПП. За следващия път, ще се връщаме на тема образование след скорошните още по-подробни изследвания, както и разбира се в духа на наближаващия първи учебен ден!

Източници