Изпратете запитване

Ще се радваме да обсъдим Вашия проект.

SEO · WordPress

Дублирано съдържание в WordPress: откъде идва и как се маха

от Владислав Влаев ≈ 11 мин четене

Няма наказание за дублирано съдържание. Това е първото, което трябва да се каже, защото около темата се е натрупала митология. Google не изтрива сайтове заради повтарящ се текст.

Има обаче нещо по-тихо и по-скъпо: когато един и същи текст е достъпен на няколко адреса, търсачката избира един от тях — и невинаги този, който вие искате. Сигналите се разпределят, обхожданията се харчат за копия, а вие се чудите защо страницата стои по-ниско, отколкото заслужава.

дублирано съдържание в wordpress - един и същи текст на няколко адреса

Накратко

  • Наказание няма. Има разделени сигнали, объркан избор и пропилени обхождания.
  • WordPress генерира дубликати сам по себе си — архиви, етикети, пагинация, прикачени файлове, фийдове.
  • Каноничният адрес е препоръка, не команда. Google може да я подмине, ако другите сигнали ѝ противоречат.
  • Магазините са най-уязвими: филтри, сортиране и вариации умножават адресите с хиляди.
  • Проверката отнема двайсет минути и не изисква платени инструменти.

01Какво Google смята за дублирано — и какво не

Дублирано съдържание е налице, когато съществено едно и също съдържание е достъпно на повече от един адрес. Ключовата дума е „адрес“ — проблемът е технически, не литературен.

Това не е дублирано съдържание: сходни по тема статии, повтарящи се елементи като футър и меню, цитати с посочен източник, продуктови описания от производителя (те са слаб сигнал, но друга тема).

СитуацияДубликат?Какво прави Google
Един текст на два ваши адресаДаИзбира един, другият остава невидим
http и https версииДаОбикновено се справя, но не разчитайте
с www и без wwwДаСъщото — трябва да е решено с пренасочване
Адрес със и без наклонена чертаДаИзисква последователност
Две статии по сходна темаНеНо може да имате друг проблем — канибализация
Едно и също меню на всяка страницаНеШаблонните елементи се отчитат като такива

Ако две ваши страници са различни, но се конкурират за една и съща заявка, това не е дублирано съдържание, а канибализация — различен проблем с различно лечение. Разгледали сме го подробно в отделна статия.

02Откъде идва в WordPress

WordPress по подразбиране публикува едно и също съдържание на няколко места. Повечето инсталации имат поне три от изброените по-долу.

  • Архиви по етикет и категорияАко извеждат пълния текст на публикациите вместо откъс, всяка статия съществува и в архива. При етикет с една публикация архивът е практически копие на статията.
  • Архиви по дата и по авторПри сайт с един автор архивът по автор е дубликат на блог страницата. Архивите по година и месец добавят още слоеве.
  • ПагинацияАдреси като /page/2/ понякога връщат същото съдържание. Проверете какво връща произволно голямо число — ако е 200 със същия текст, имате безкрайно пространство.
  • Страници на прикачени файловеWordPress прави отделна страница за всяко изображение. Съдържание — почти нула, адреси — колкото са снимките.
  • ФийдоветеВсяка категория и публикация има RSS вариант с пълния текст.
  • Резултати от търсенеАдресите с /?s= генерират безброй страници с преподредено съдържание.
  • Параметри в адресаUTM етикети от кампании, идентификатори на сесии, филтри — всеки прави нов адрес за същата страница.
  • Черновите и копията на странициКласика при редизайн: „начало-2″, „услуги-копие“. Понякога остават публикувани.

Реален случай от наш одит: страница „начало-2″ беше останала след редизайн и Googlebot я чукаше редовно, докато не беше премахната. Такива остатъци се намират за минути, ако човек се сети да ги потърси.

03Каноничният адрес: какво прави и какво не

Етикетът rel="canonical" казва на търсачката: „това съдържание е достъпно и другаде, но ето кой е официалният адрес“. Всяка WordPress страница обикновено сочи сама към себе си — това е нормално и правилно.

Какво canonical НЕ прави

  • Не е командаGoogle го третира като силна препоръка. Ако другите сигнали противоречат — вътрешните връзки сочат другаде, sitemap-ът съдържа „копието“ — може да избере друг адрес.
  • Не пести обхожданеБотът трябва да изтегли страницата, за да види етикета. Ако целта е да спестите бюджет, canonical не е инструментът.
  • Не замества пренасочванеПри окончателно преместено съдържание правилното е 301, не canonical.
  • Не решава канибализацияАко две страници са различни, но се борят за една заявка, canonical към едната просто ще скрие другата — а тя може да ви трябва.

Най-честата грешка, която виждаме, е каноничен адрес, сочещ към несъществуваща или сгрешена страница. В един одит открихме пет публикации с canonical към адреси, които връщаха 404 — тоест сайтът сам казваше на Google „официалната версия е ето тази“, а тя не съществуваше.

Canonical е указателна табела. Ако табелата сочи към празно поле, минувачът ще си избере посока сам.

04Магазините: където проблемът става сериозен

При съдържателен сайт дублирането е дребен разход. При WooCommerce магазин може да е основната причина новите продукти да влизат бавно в индекса.

Причината е комбинаториката. Филтър по цвят, по размер, по цена и подредба по популярност дават стотици комбинации от една категория — и всяка е отделен адрес с почти същото съдържание.

ИзточникМащабРешение
Филтри по атрибутиСтотици до хиляди адресаnoindex на филтрираните изгледи; canonical към чистата категория
Подредба (цена, популярност)Умножава всяка категорияCanonical към категорията без параметри
Вариации на продуктОтделен адрес на вариацияCanonical към основния продукт
Пагинация на категорииДесетки адресаОставете ги индексируеми със самосочещ canonical — това е правилният подход
Кошница и плащанеНяколкоnoindex — тези страници нямат работа в търсенето

Не блокирайте филтрите в robots.txt с идеята да ги скриете. Блокираният адрес не се обхожда, но може да остане в индекса без описание — по-лошо от контролирано noindex.

05Как да го откриете за двайсет минути

  1. Търсене с site: и откъс от текста

    Вземете изречение от важна ваша страница и потърсете site:vashiat-sait.bg "точното изречение". Ако излязат няколко адреса, вече знаете къде е дубликатът.

  2. Проверете вариантите на домейна

    Отворете сайта с http, с www, без www и с наклонена черта накрая. Всички трябва да водят с едно пренасочване към един и същи вид адрес.

  3. Вижте отчета за индексиране

    Search Console → Страници. Раздели като „Дубликат без избран каноничен адрес“ и „Google избра различен каноничен адрес“ ви казват точно къде не сте се разбрали с търсачката.

  4. Проверете какво връща голямо число в пагинацията

    Отворете /page/99/. Ако връща 200 със съдържание, имате безкрайно пространство за обхождане.

  5. Прегледайте архивите

    Отворете архив по етикет с една публикация. Ако показва целия текст, това е копие на статията.

  6. Проверете каноничните адреси

    В изходния код потърсете rel=“canonical“ на десетина страници. Всеки трябва да сочи към жив, правилен адрес.

Двайсет минути с този списък дават по-точна картина от повечето автоматични отчети, защото гледате същото, което гледа и ботът.

06Кога да триете, кога да пренасочвате, кога да оставите

СитуацияПравилно действие
Стара страница, заменена от нова301 към новата — запазва натрупаното
Копие след редизайн (начало-2)Изтриване; 410, ако е било индексирано
Архив по етикет с една публикацияnoindex на архивите по етикет
Страници на прикачени файловеПренасочване към самия файл или към публикацията
Филтри и подредба в магазинnoindex + canonical към чистата категория
Пагинация на блогаОставете я — самосочещ canonical, без noindex
Резултати от търсенеnoindex
Две различни статии по близка темаНе е дубликат — сливане или ясно разграничаване

Какво да настроите в Rank Math или Yoast

  • Архиви по автор при един авторИзключете ги или сложете noindex — нямат самостоятелна стойност.
  • Архиви по датаnoindex при повечето сайтове.
  • Страници на прикачени файловеПренасочване към публикацията — и двата плъгина го предлагат с една отметка.
  • Резултати от търсенеnoindex.
  • ЕтикетиОставете ги индексируеми само ако реално ги ползвате като тематични страници със собствено описание.

Не изключвайте всичко „за всеки случай“. Категориите често са полезни входни точки и носят трафик. Целта е да няма адреси без стойност, не да няма архиви.

Изводът

Дублираното съдържание рядко е причина за срив. По-често е фонов шум, който прави всичко останало малко по-трудно: обхожданията се разпиляват, сигналите се разделят, а Google взима решения вместо вас.

Добрата новина е, че почти всичко се решава с настройки, а не с пренаписване. Половин ден работа върху архивите, каноничните адреси и остатъците от стари редизайни оставя сайта в състояние, в което всяка следваща оптимизация работи по-чисто.

Ако искате да проверим кои адреси на вашия сайт се дублират и какво Google е избрал за официална версия, това е част от техническия одит. За случаите, в които две различни страници се борят за една заявка, вижте статията за SEO канибализацията.

Владислав Влаев
Основател на WP Site BG · WordPress и SEO

Прави сайтове от 2006 г. Поддържа 46 сайта и работи по видимостта им в Google — с числа в отчета, не с обещания.

Сподели:

Често задавани въпроси

Наказва ли Google за дублирано съдържание?
Не. Google изрично посочва, че повечето дублирано съдържание не е измамно и не води до санкция. Последствието е друго: търсачката избира една версия, а сигналите се разпределят между адресите. Санкция може да има само при масово копиране на чуждо съдържание с цел манипулация.
Какво е каноничен адрес и задължителен ли е?
Каноничният адрес посочва коя версия на съдържанието е официалната. Не е задължителен, но е силно препоръчителен — при WordPress със SEO плъгин се поставя автоматично като самосочещ. Важното е да сочи към жив и правилен адрес.
Трябва ли да сложа noindex на категориите?
Обикновено не. Категориите често носят трафик и служат за навигация. Спрете от индекса архивите без стойност: по дата, по автор при един автор, етикети с по една публикация и резултати от търсене.
Дублирано съдържание ли е, ако имам сайт на два езика?
Не, ако е настроен коректно. Езиковите версии се обвързват с hreflang, за да разбере Google, че са варианти на едно съдържание за различни аудитории. Проблем възниква при машинен превод без разграничение.
Продуктовите описания от производителя вредят ли?
Не са дублирано съдържание в техническия смисъл, но са слаб сигнал — същият текст е на десетки магазина. Собствено описание, дори кратко, плюс реални снимки и отзиви е това, което отличава страницата.
Как да разбера коя версия Google е избрал?
В Search Console отворете проверката на конкретен адрес. Полето „Каноничен адрес, избран от Google“ показва избора му. Ако се разминава с вашия, сигналите ви си противоречат — обикновено заради вътрешни връзки или sitemap.

Проверете какво реално е в индекса

Намираме дублиращите се адреси, каноничните грешки и остатъците от стари редизайни — и ви даваме конкретен план какво да се изчисти.

Заявете SEO одит