Дигитален маркетингРеклама и кампании с резултат
wp-site.bg
Ще се радваме да обсъдим Вашия проект.
Няма наказание за дублирано съдържание. Това е първото, което трябва да се каже, защото около темата се е натрупала митология. Google не изтрива сайтове заради повтарящ се текст.
Има обаче нещо по-тихо и по-скъпо: когато един и същи текст е достъпен на няколко адреса, търсачката избира един от тях — и невинаги този, който вие искате. Сигналите се разпределят, обхожданията се харчат за копия, а вие се чудите защо страницата стои по-ниско, отколкото заслужава.
Дублирано съдържание е налице, когато съществено едно и също съдържание е достъпно на повече от един адрес. Ключовата дума е „адрес“ — проблемът е технически, не литературен.
Това не е дублирано съдържание: сходни по тема статии, повтарящи се елементи като футър и меню, цитати с посочен източник, продуктови описания от производителя (те са слаб сигнал, но друга тема).
| Ситуация | Дубликат? | Какво прави Google |
|---|---|---|
| Един текст на два ваши адреса | Да | Избира един, другият остава невидим |
| http и https версии | Да | Обикновено се справя, но не разчитайте |
| с www и без www | Да | Същото — трябва да е решено с пренасочване |
| Адрес със и без наклонена черта | Да | Изисква последователност |
| Две статии по сходна тема | Не | Но може да имате друг проблем — канибализация |
| Едно и също меню на всяка страница | Не | Шаблонните елементи се отчитат като такива |
Ако две ваши страници са различни, но се конкурират за една и съща заявка, това не е дублирано съдържание, а канибализация — различен проблем с различно лечение. Разгледали сме го подробно в отделна статия.
WordPress по подразбиране публикува едно и също съдържание на няколко места. Повечето инсталации имат поне три от изброените по-долу.
Реален случай от наш одит: страница „начало-2″ беше останала след редизайн и Googlebot я чукаше редовно, докато не беше премахната. Такива остатъци се намират за минути, ако човек се сети да ги потърси.
Етикетът rel="canonical" казва на търсачката: „това съдържание е достъпно и другаде, но ето кой е официалният адрес“. Всяка WordPress страница обикновено сочи сама към себе си — това е нормално и правилно.
Най-честата грешка, която виждаме, е каноничен адрес, сочещ към несъществуваща или сгрешена страница. В един одит открихме пет публикации с canonical към адреси, които връщаха 404 — тоест сайтът сам казваше на Google „официалната версия е ето тази“, а тя не съществуваше.
Canonical е указателна табела. Ако табелата сочи към празно поле, минувачът ще си избере посока сам.
При съдържателен сайт дублирането е дребен разход. При WooCommerce магазин може да е основната причина новите продукти да влизат бавно в индекса.
Причината е комбинаториката. Филтър по цвят, по размер, по цена и подредба по популярност дават стотици комбинации от една категория — и всяка е отделен адрес с почти същото съдържание.
| Източник | Мащаб | Решение |
|---|---|---|
| Филтри по атрибути | Стотици до хиляди адреса | noindex на филтрираните изгледи; canonical към чистата категория |
| Подредба (цена, популярност) | Умножава всяка категория | Canonical към категорията без параметри |
| Вариации на продукт | Отделен адрес на вариация | Canonical към основния продукт |
| Пагинация на категории | Десетки адреса | Оставете ги индексируеми със самосочещ canonical — това е правилният подход |
| Кошница и плащане | Няколко | noindex — тези страници нямат работа в търсенето |
Не блокирайте филтрите в robots.txt с идеята да ги скриете. Блокираният адрес не се обхожда, но може да остане в индекса без описание — по-лошо от контролирано noindex.
Вземете изречение от важна ваша страница и потърсете site:vashiat-sait.bg "точното изречение". Ако излязат няколко адреса, вече знаете къде е дубликатът.
Отворете сайта с http, с www, без www и с наклонена черта накрая. Всички трябва да водят с едно пренасочване към един и същи вид адрес.
Search Console → Страници. Раздели като „Дубликат без избран каноничен адрес“ и „Google избра различен каноничен адрес“ ви казват точно къде не сте се разбрали с търсачката.
Отворете /page/99/. Ако връща 200 със съдържание, имате безкрайно пространство за обхождане.
Отворете архив по етикет с една публикация. Ако показва целия текст, това е копие на статията.
В изходния код потърсете rel=“canonical“ на десетина страници. Всеки трябва да сочи към жив, правилен адрес.
Двайсет минути с този списък дават по-точна картина от повечето автоматични отчети, защото гледате същото, което гледа и ботът.
| Ситуация | Правилно действие |
|---|---|
| Стара страница, заменена от нова | 301 към новата — запазва натрупаното |
| Копие след редизайн (начало-2) | Изтриване; 410, ако е било индексирано |
| Архив по етикет с една публикация | noindex на архивите по етикет |
| Страници на прикачени файлове | Пренасочване към самия файл или към публикацията |
| Филтри и подредба в магазин | noindex + canonical към чистата категория |
| Пагинация на блога | Оставете я — самосочещ canonical, без noindex |
| Резултати от търсене | noindex |
| Две различни статии по близка тема | Не е дубликат — сливане или ясно разграничаване |
Не изключвайте всичко „за всеки случай“. Категориите често са полезни входни точки и носят трафик. Целта е да няма адреси без стойност, не да няма архиви.
Дублираното съдържание рядко е причина за срив. По-често е фонов шум, който прави всичко останало малко по-трудно: обхожданията се разпиляват, сигналите се разделят, а Google взима решения вместо вас.
Добрата новина е, че почти всичко се решава с настройки, а не с пренаписване. Половин ден работа върху архивите, каноничните адреси и остатъците от стари редизайни оставя сайта в състояние, в което всяка следваща оптимизация работи по-чисто.
Ако искате да проверим кои адреси на вашия сайт се дублират и какво Google е избрал за официална версия, това е част от техническия одит. За случаите, в които две различни страници се борят за една заявка, вижте статията за SEO канибализацията.
Намираме дублиращите се адреси, каноничните грешки и остатъците от стари редизайни — и ви даваме конкретен план какво да се изчисти.
Заявете SEO одит