Дигитален маркетингРеклама и кампании с резултат
wp-site.bg
Ще се радваме да обсъдим Вашия проект.
Search Console показва какво Google е решил да покаже. Сървърните логове показват какво Google реално е направил — кога е дошъл, какво е поискал и какво е получил в отговор. Разликата между двете е мястото, където се крият най-скъпите проблеми.
Тази статия е за краул бюджета: колко внимание отделя Google на сайта ви, къде то изтича и как да го насочите. С реални числа от логовете на един български WordPress сайт, а не с теория.
Краул бюджетът е грубо казано колко страници Google е готов да изтегли от сайта ви за даден период. Определя се от две неща: колко натоварване издържа сървърът ви и колко интересен смята съдържанието ви търсачката.
Второто е по-важното. Google не обхожда по-рядко, защото се притеснява за сървъра ви — обхожда по-рядко, защото при последните посещения не е намерил достатъчно, което да си струва.
Ако имате сайт с 30–100 страници, вероятно нямате проблем с размера на бюджета. Имате проблем с това какво прави ботът с посещенията, които вече отделя — и точно там се печели.
Има два източника и те казват различни неща. Нужни са и двата.
| Източник | Какво показва | Ограничение |
|---|---|---|
| Search Console → Настройки → Статистика за обхождането | Обобщено: заявки на ден, типове файлове, отговори, цел на обхождането | Обобщено е — не виждате конкретни адреси и не можете да филтрирате свободно |
| Сървърни access логове | Всяка заявка: точен час, адрес, статус код, кой бот | Трябва достъп до хостинга и малко работа с командния ред |
При споделен хостинг обикновено ги има в cPanel („Raw Access Logs“) или директно по SSH — при нас пътят е ~/access-logs/ за текущия ден и ~/logs/ за архивите по месеци. Файловете са текстови: един ред на заявка.
Важно: проверявайте автентичността. Всеки може да се представи за Googlebot. Истинският идва от диапазона 66.249.* и се потвърждава с обратна DNS справка. В нашите логове открихме 135 фалшиви заявки с Googlebot етикет от български доставчици — най-вероятно инструменти за проследяване на позиции.
Практичен подход: филтрирайте по 66.249. вместо по текста „Googlebot“. Така отчитате само реалния бот и числата ви стават достоверни.
Ето какво намерихме в логовете на сайт, чиито позиции падаха от месеци, без видима причина.
Sitemap файловете връщаха 404 — не един ден, а през целия период от началото на юли до края на месеца. Googlebot ги беше поискал на 13 отделни дати и всеки път беше получил „няма такова нещо“. Bing беше опитал 74 пъти.
Sitemap-ът беше вписан в robots.txt, водеше се „изпратен“ в Search Console и изглеждаше наред от всяка административна гледна точка. Само че адресът връщаше 404, а никъде нямаше индикация за това.
Причината се оказа банална: загубени правила за пренаписване на адресите след промяна по сайта. Поправката отне една команда. Но три седмици Google не беше получавал списъка със страниците — точно докато сайтът се нуждаеше от преоценка.
Иронията: в същия период sitemap файловете на една забравена тестова папка в същия сървър работеха и връщаха 200.
| Наблюдение | Число | Значение |
|---|---|---|
| Заявки на Googlebot дневно | ≈32 | Малко — но нормално за сайт с намаляло търсене |
| Дял CSS, JS и изображения | 51% | Половината бюджет не отива за страници |
| Реални HTML страници на ден | ≈10 | При 60 страници: пълен обход веднъж на 6 дни |
| Заявки към изтрита тестова папка | 9,2% | Чист загубен ресурс |
| Дял 404 отговори (последна седмица) | 22,7% | Всяка пета заявка удря в стена |
| Обхождания на ключова страница за 5 седмици | 3–9 | Поправките по нея се преизчисляват бавно |
Проверете дела на 404 отговорите към Googlebot. Ако е над 10%, ботът си губи времето. При нас беше 22,7% — почти изцяло от папка, която отдавна не съществуваше.
Изтритите раздели връщат 410. Старите адреси с трафик — 301 към най-близкия жив еквивалент. Никакви пренасочвания „на сляпо“ към началната: това се разпознава като мек 404.
Отворете адреса му в браузър в анонимен режим. Ако не се зареди за вас, не се зарежда и за Google. Проверявайте го периодично, не еднократно.
Пагинация без край, филтри с параметри, архиви без стойност — с noindex или блокиране, според случая. Внимавайте: блокираното в robots.txt не се обхожда, но може да остане в индекса.
Страница, до която води една връзка, се обхожда рядко. Тежестта тече по връзките — това е и най-прекият начин да ускорите преоценката ѝ.
Бавните отговори намаляват темпото на обхождане. Кеширането не е само за посетители.
След съществена промяна: Search Console → проверка на адрес → заявка за индексиране. Работи за единични страници, не за целия сайт.
Не блокирайте CSS и JavaScript, за да „спестите“ бюджет. Google трябва да рендерира страницата, за да я разбере. Блокирането им е класическа грешка с тежки последствия.
Влязохме в логовете, за да преценим краул бюджета, и излязохме с два поправени дефекта, за които нищо друго не подсказваше. Това е и практическият извод: анализът на логовете е диагностика, не любопитство.
За повечето малки сайтове размерът на бюджета няма да е проблемът. Проблемът ще е, че Google идва рядко и когато дойде, попада на 404, на пренасочване или на файл, който не съществува. Тези три неща се оправят за един следобед.
Ако искате да проверим какво реално получава Googlebot на вашия сайт — логове, sitemap, отговори по адрес и дял успешни заявки — това е част от техническия одит. Как изглежда картината за AI ботовете сме описали в анализа на 39 654 записа от логовете.
Проверяваме логовете, sitemap-а, отговорите по адрес и дела успешни обхождания — и оправяме дефектите, които не се виждат в Search Console.
Заявете технически одит