Към съдържанието
seooptimizacia.bgby Webso Digital

Може ли ChatGPT да прочете сайта ви? Кои роботи изпълняват JavaScript, кои не, и тестът с единадесетте думи

Повечето AI роботи четат HTML кода и не изпълняват JavaScript. Тестът за една минута, сайтът от Стара Загора с единадесет думи, и как се поправя.

От Даниел Стойчев, Webso Digital · · 7 мин четене

Редове HTML код на тъмен екран

ChatGPT, Claude и Perplexity четат HTML кода, който техните роботи изтеглят, и не изпълняват JavaScript. Google го изпълнява, така че AI Overviews на Google виждат това, което вижда Google, а роботът на Bing също рендира, което е и което чете Copilot. Ако думите на страницата ви се появяват едва след като се изпълни скрипт, асистентите, които не рендират, виждат заглавие и почти нищо друго. Тестът отнема минута: отворете кода на страницата и пребройте думите. Направихме го през септември на сайта на транспортна фирма от Стара Загора и преброихме единадесет.

Кой рендира и кой не

РоботЗахранваИзпълнява JavaScriptИзточник
GooglebotGoogle Търсене, AI Overviews, AI Mode, GeminiДа, със закъснениеДокументацията на Google за JavaScript SEO
BingbotBing, CopilotДаДокументацията на Microsoft
ApplebotSiri, Spotlight, Apple IntelligenceДаДокументацията на Apple
GPTBot, OAI-SearchBotОбучение на ChatGPT и ChatGPT searchНеИзмерването на Vercel и MERJ, декември 2024
ClaudeBotClaudeНе: изтегля скриптовете при 23,84% от заявките и никога не ги изпълняваСъщото измерване
PerplexityBotPerplexityНеСъщото измерване

Измерването, което си струва да знаете, е публикувано от Vercel и MERJ, след като инструментираха собствената си мрежа: 569 милиона заявки от GPTBot и 370 милиона от ClaudeBot, и нито една изпълнена команда JavaScript. Роботите изтеглят файловете със скриптове, което в лога на сървъра изглежда като рендиране и не е. Документацията на Google казва обратното за Googlebot, и на същата страница казва, че рендирането на сървъра или предварителното рендиране все още е добра идея. И двете са верни едновременно: сайтът ви може да се класира отлично в Google и да е празен за всички останали.

Тестът с единадесетте думи

  1. Отворете страницата в браузър и натиснете Ctrl+U, или добавете view-source: пред адреса. Това е HTML кодът, както е изтеглен, преди да се изпълни какъвто и да е скрипт.
  2. Потърсете в кода изречение, което виждате на страницата. Ако го има, думите са в HTML. Ако го няма, те идват от скрипт.
  3. Пребройте думите в тялото на страницата. Страница за услуга трябва да носи стотици. Страница със заглавие, няколко етикета от менюто и празен основен елемент е дефектът.
  4. Повторете за началната страница, една страница за услуга и една статия, защото сайтовете на фреймуърк често рендират началната страница на сървъра, а останалите в браузъра.

Фирма за хамалски и транспортни услуги от Стара Загора имаше React сайт, построен другаде. На 2 септември 2026 г. началната ѝ страница носеше единадесет думи HTML: заглавието, менюто и един ред в подножието. Google я класираше на позиция 6,8 за основното ѝ търсене, защото Googlebot рендира страницата и прочете осемстотинте думи, които следват. ChatGPT, попитан за фирмата, имаше единадесетте. Съдържанието влезе в HTML на 3 септември; на 19 септември преброихме 1 123 думи в кода. Кликовете се раздвижиха през следващия месец, и казваме честно, че две промени влязоха в един и същ прозорец, така че не приписваме ръста само на тази.

Дефектите, които скриват думите дори на рендиран сайт

  • Коренен файл за зареждане. При един фреймуърк компонент за зареждане в корена изпраща всяка страница вътре в скрит контейнер, докато се изпълни скриптът. HTML кодът носи думите, но в елемент, маркиран като скрит, и робот, който не рендира, ги чете като скрити. Открихме това на сайта на клиент за чип тунинг на 2 октомври 2026 г., и то беше на живо пет седмици.
  • Табове и акордеони, които се монтират при клик. Първият таб е в HTML; другите не са, докато някой не натисне.
  • Съдържание, изтеглено след зареждане. Страница, която иска собствения си текст от API, няма нищо в кода освен заявката.
  • Банер за бисквитки, рендиран пред съдържанието. Роботът вижда думите на банера, а не вашите, ако банерът замества страницата, вместо да я покрива.

Поправката, според това как е построен сайтът

Статичен сайт или фреймуърк с рендиране на сървъра вече слага думите в HTML и няма нужда от нищо. Приложение на една страница има нужда от предварително рендиране при билд или от рендиране на сървъра, така че първият отговор да носи страницата. Конструктор на сайтове, който рендира в браузъра, няма поправка освен преместване. Поправката на транспортната фирма беше стъпка за предварително рендиране в билда, затова промяната отне един ден и сайтът остана където беше.

Google казва ясно за какво да не харчите пари: специален файл llms.txt, нарязване на съдържанието на парчета, пренаписване за AI и прекомерен фокус върху структурираните данни. Тестът с единадесетте думи е това, което да направите вместо това, защото е дефектът, който повечето сайтове имат.

Какво да има в HTML, щом вече е там

Думите в кода са портата; какво казват думите решава дали асистентът ще ги цитира. Три неща вършат повечето работа. Първи абзац, който отговаря на въпроса на страницата сам по себе си, с факта вътре, защото асистентът взима абзац, а не страница, и страница с цени, чийто първи абзац няма цена, не му дава какво да вземе. Блок с въпроси и отговори с реалните въпроси на клиентите, с техните думи. И по една страница на тема, защото страница, която покрива четири услуги в един скрол, не се цитира за нито една. Нищо от това не е пренаписване за AI; това е същото писане, което печели откроен отговор в Google, и Google казва ясно, че уникалното и полезно съдържание движи AI присъствието повече от всичко друго в списъка му.

Тестът за това, след теста с единадесетте думи, е да прочетете първия абзац сам, извън контекст, и да попитате дали отговаря на въпроса, който непознат е написал. Ако има нужда от заглавието над себе си, за да има смисъл, не е абзац, който асистент може да използва.

robots.txt, и роботите, които не го четат

Щом думите са в HTML, решете кой може да ги чете. GPTBot, OAI-SearchBot, ClaudeBot, PerplexityBot и Google-Extended имат по един потребителски агент, който можете да разрешите или забраните в robots.txt. Три робота го пренебрегват, защото човек ги е задействал: ChatGPT-User, агентът на Google и NotebookLM изтеглят страница, когато потребител постави адреса, и никой файл не спира това. На собствените си сайтове разрешаваме всички, включително обучаващите роботи, и файлът казва защо: сайт, който иска да бъде цитиран, няма причина да се крие от робота, който отговаря на въпроса.

Проверката за AI готовност на страницата ни за оптимизация за ChatGPT пуска този тест първи, защото всяко друго перо в списъка е шум, ако думите не са в HTML. Безплатният одит също го чете. Ако кодът на вашата страница показва заглавие и празен корен, това е находката, и тя е промяна в билда, а не в текста.

Въпроси по темата

Чете ли ChatGPT сайтове на JavaScript?

Не. GPTBot и OAI-SearchBot изтеглят HTML и не изпълняват скриптове. Думи, които идват от скрипт, не се четат.

Виждат ли AI Overviews на Google съдържание на JavaScript?

Да. Googlebot рендира страниците, а AI Overviews и AI Mode използват индекса на Google.

Как да проверя какво вижда AI робот?

Отворете кода на страницата и пребройте думите в тялото. Ако изречение, което виждате на екрана, го няма в кода, роботът не го получава.

Помага ли файл llms.txt?

Google казва, че Търсенето го пренебрегва. Не сме видели да променя нищо, и не прави нищо за страница, чиито думи не са в HTML.

Ще навреди ли на класирането в Google, ако блокирам GPTBot?

Не. GPTBot е роботът на OpenAI и Google не го използва. Блокирането му засяга само какво може да чете ChatGPT.

Разберете какво прави сайтът ви за вас, казано на разбираем език

Изпратете адреса, или кажете, че нямате сайт, и къде в България продавате. Даниел Стойчев го чете и отговаря до един работен ден: какво вижда клиентът, какво вижда Google, какво казват AI асистентите, и цена.