SEO Sprendimai | Pasikartojantis turinys: kaip jį aptikti ir išspręsti

Turinys

Pasikartojantis turinys: kaip jį aptikti ir išspręsti

E-komercijos parduotuvė turi 800 produktų. Kiekvienas produktas – tris URL variantus: su filtru ?spalva=raudona, su rūšiavimu ?sort=kaina ir originalus. Google indekso 2400 URL, kuriuose 800 skirtingų puslapių – visi su praktiškai identišku turiniu. Crawl budget eikvojamas ant URL variacijų, originalūs puslapiai gauna silpną indeksavimo prioritetą, o pozicijos kovoja pačios su savimi. Tai klasikinis URL parametrų sukelto duplicate content scenarijus – ir jis egzistuoja daugelyje Lietuvos e-komercijos svetainių be jokio savininko žinojimo.

Pasikartojantis turinys yra ne tik turinio kopijų klausimas. Dažniausiai problema techninė, o ne redakcinė – ir ji sprendžiama kitais metodais.

Perskaitę žinosite, kokios situacijos sukuria duplicate content problemą, kaip ją aptikti per auditus ir kokis sprendimas tinka kuriai situacijai.

Kas iš tikrųjų laikoma pasikartojančiu turiniu Google akimis

Duplicate content – tai situacija, kai tas pats arba labai panašus turinys pasiekiamas per kelis skirtingus URL. Google tai mato kaip neaiškumą: kuris URL yra “tikrasis” šaltinis ir kurį rodyti paieškos rezultatuose?

Svarbus patikslinimas, kurį daugelis supranta neteisingai: Google nereiškia jokios tiesiogios penalizacijos už pasikartojantį turinį daugeliu atvejų. 2016 m. Gary Illyes iš Google patvirtino per Twitter, kad duplicate content penalty egzistuoja tik tada, kai dubliavimas tyčinis ir sukuria klaidinančią vartotojo patirtį – spam tipo atvejais. Tipinis techninis duplicate – URL parametrai, www/non-www variacija, print versijos – nesukelia baudos. Bet tai nereiškia, kad problema neegzistuoja. Jis sukelia kitą problemą: Google negali nuspręsti, kurį URL rodyti, ir dažnai renkasi ne tą, kurį jūs norėtumėte.

Vidinis pasikartojantis turinys: kur jis dažniausiai atsiranda

Internal duplicate – tai pasikartojantis turinys jūsų pačių svetainėje, skirtingais URL. Tai labiausiai paplitusi ir labiausiai neįvertinta kategorija.

URL parametrų problema yra dažniausia e-komercijoje. Produktų filtrai, rūšiavimo parinktys, paieškos rezultatų URL – visi jie generuoja unikalius URL su identiška arba beveik identiška turiniu. Parduotuvė su 500 produktų ir penkiais filtrų tipais teoriškai gali turėti 2500+ URL, kuriuos Google bando indeksuoti vietoje 500 originalių.

Paginacijos puslapiai/straipsnis/page/2, /kategorija/page/3 – techniškai yra skirtingi URL su persidengiančiu turiniu. Google paginaciją paprastai tvarko gerai, bet jei tie puslapiai neturi canonical žymos arba turi neteisingą, jie sukuria indeksavimo painiavą.

www vs. non-www ir HTTPS vs. HTTP – jei keturios URL versijos rodo tą patį turinį be peradresavimo į vieną kanoninę versiją, tai keturi indeksuoti puslapiai su identiška turiniu. URL normalizavimas čia reikalingas serverio lygio 301 peradresavimais, ne tik canonical žyma.

Trailing slash problemajusudomenas.lt/puslapis ir jusudomenas.lt/puslapis/ Google traktuoja kaip du skirtingus URL. Jei abu grąžina 200 kodą su turiniu – duplicate.

Išorinis pasikartojantis turinys: produktų aprašymų bėda

E-komercijoje išorinis duplicate content problema ypač aštri – ir daugelis jos net nelaiko problema.

Jei parduodate produktus su gamintojo pateiktais aprašymais ir tuos pačius aprašymus naudoja dar 30 kitų parduotuvių Lietuvoje bei Europoje – Google mato identiškus tekstus keliuose domenuose ir turi nuspręsti, kurį rodyti. Stipresnio autoriteto domenai dažniausiai laimi. Jūsų parduotuvė su tiekėjo tekstu reitinguos sunkiau nei originalų aprašymą turinti konkurentė – net jei jūsų domenas senesnis.

Sprendimas – ne perfrazavimas kaip forma, o tikros papildomos informacijos pridėjimas: vartotojų atsiliepimai, unikalūs gaminio naudojimo scenarijai, konkretūs matmenys ar techniniai duomenys, kurių tiekėjas nepateikia. Tekstas turi duoti papildomą vertę, o ne tiesiog perkelti tą pačią informaciją kitais žodžiais.

Canonical žyma: kaip ji veikia ir kur dažniausiai klysta

Canonical žyma – <link rel=”canonical” href=”tikrasis-url”> – tai HTML elemento nurodymas Google, kuris URL yra “originalas”. Ji leidžia turėti kelis URL su panašiu turiniu, bet aiškiai nurodyti, kurį indeksuoti.

Canonical žyma yra rekomendacija, ne komanda. Google ją dažniausiai gerbia – bet ne visada. Jei canonical žyma nurodo URL, kurio turinys labai skiriasi nuo puslapio turinio, arba jei yra canonical konfliktai (puslapis A nurodo B kaip kanoninį, o B nurodo save), Google gali ignoruoti abi žymas ir pats nuspręsti, kurį URL indeksuoti.

Dažniausias praktinis klaidos tipas, kurį galima pamatyti audituojant svetaines: paginacijos puslapiai su canonical žyma, nurodančia pirmą puslapį. /kategorija/page/3 canonical → /kategorija/ reiškia, kad trečio puslapio turinys nebus indeksuotas. Jei tame puslapyje yra produktai, kuriuos norite rodyti paieškoje – ši konfigūracija juos paslėps. Canonical žymą paginacijai reikia konfigūruoti atsargiai, ir dažniausiai teisingesnis sprendimas yra kiekvienas paginacijos puslapis nurodo save kaip kanoninį.

Kaip aptikti pasikartojantį turinį: audito metodai

Dvi pagrindinės priemonės, kurios kartu duoda pilną vaizdą.

Screaming Frog SEO Spider nuskaito visą svetainę ir identifikuoja: puslapius su identiškomis title žymomis, identiškomis meta aprašymų žymomis, canonical konfliktus ir URL, kurie grąžina tą patį turinį. Ataskaita “Duplicate Content” skiltis rodo, kurie puslapiai turi identiškus tekstinius hash – tai techniškai tikslus pasikartojimo signalas. Nemokama versija leidžia nuskaityti iki 500 URL.

Siteliner tikrina vidinius turinio pasikartojimus ir parodo, kiek procentų kiekvieno puslapio turinio dubliuojasi kitame savo svetainės puslapyje. Puslapis su 80%+ duplikatinio turinio yra problema. Copyscape atlieka tą pačią funkciją išoriniam turiniui – tikrina, ar jūsų tekstas nebuvo nukopijuotas kitų svetainių ar ar jūs pats nenaudojate tekstų, kurie jau egzistuoja kitur.

Google Search Console Coverage ataskaita rodo, kurie URL “indeksuoti, bet nerodomi kaip kanoniniai” – tai tiesioginė informacija apie puslapius, kuriuos Google mato, bet laiko duplicate variantais.

Turinio kanibalė: kai duplicate problema ir raktažodžių optimizavimas susipina

Duplicate content ir turinio kanibalė dažnai painiojami – bet tai skirtingos problemos su skirtingais sprendimais.

Turinio kanibalė yra situacija, kai keli puslapiai konkuruoja dėl to paties raktažodžio, bet jų turinys nebūtinai identiškas. Trys straipsniai apie “WordPress greičio optimizavimą” su skirtinga perspektyva – kanibalė, bet ne duplicate. Trys produktų puslapiai su tuo pačiu aprašymu ir skirtingomis spalvų variacijomis – duplicate, ir gali būti kanibalė.

Kanibalę sprendžia turinio strategija: konsolidavimas į vieną pilnesnį puslapį, airesnis temų diferencijavimas arba 301 peradresavimas silpnesnių puslapių į stipriausią. Duplicate sprendžia canonical žyma, 301 peradresavimas arba noindex žyma, priklausomai nuo situacijos.

Noindex vs. canonical vs. 301: kuris sprendimas tinka kada

Čia slypi daugiausia klaidų – ne aptikime, o sprendimo metodo parinkime.

Canonical žyma tinka, kai URL turi egzistuoti dėl techninių ar vartotojo patirties priežasčių (pvz., filtravimo URL, kurį vartotojas gali naudoti), bet neturėtų būti indeksuotas kaip atskiras puslapis. Canonical nurodo originalą, o filtruotas URL lieka prieinamas.

Noindex žyma tinka, kai puslapis turi egzistuoti ir būti pasiekiamas, bet nereikalingas paieškos indekse. Administratoriaus puslapiai, testavimo versijos, paginacijos puslapiai (kai pasirinkta ši strategija) – čia noindex. Svarbu: noindex nepanaikina Googlebot šliaužimo – jis vis tiek aplankys tą puslapį ir eiklos crawl budget.

301 peradresavimas tinka, kai senas URL visiškai nereikalingas – jis turi visam laikui nuvesti į kitą adresą. www → non-www, HTTP → HTTPS, senas produkto URL → naujas produkto URL.

Pasirinkimo klaidų kaina: noindex ant puslapio, kurį norite rodyti paieškoje – jis dingsta iš indekso. Canonical žyma ant puslapio su iš esmės skirtingu turiniu – Google ją ignoruoja. 301 ant URL, kuris dar naudojamas aktyviai – vartotojas nukreipiamas neplanuotai.

Kur duplicate content sprendimas nepadeda

Atvirai: canonical žyma ir kiti techniniai sprendimai nekompensuoja turinio kokybes problemos.

Jei produkto puslapyje yra vienas sakinys su tiekėjo aprašymu ir nieko daugiau – tai thin content problema, ne tik duplicate. Canonical žyma nepadidina puslapio turinio vertės Google akimis. Noindex pašalins jį iš indekso, bet nesugrąžins organinių pozicijų tik dėl to. Duplicate content sprendimas padeda, kai puslapio turinys yra kokybiškas, bet pasiekiamas per klaidingus URL variantus. Kai turinys pats silpnas – reikia pradėti nuo jo.

Kaip pradėti: du žingsniai pagal situaciją

Jei svetainė dar niekada nebuvo audituota dėl duplicate content – pradėkite nuo greito patikrinimo: Google paieškoje įveskite site:jusudomenas.lt ir peržiūrėkite, kiek URL rodoma. Jei skaičius žymiai didesnis nei faktinis puslapių skaičius – URL variacijų problema egzistuoja. Tada Screaming Frog ar Search Console Coverage ataskaita parodys detales.

Jei žinote, kad problema egzistuoja, bet nežinote, kur pradėti sprendimą – prioritetuokite: pirma, URL normalizavimas (www, HTTPS, trailing slash), nes tai veikia visą domeną. Antra, URL parametrų valdymas per Google Search Console parametrų konfigūraciją arba canonical žymas. Trečia, produktų aprašymų unikalinimas – tai turinyje apimties darbas, bet ilgalaikiai duoda geriausius pozicijų rezultatus.

Per artimiausias 30 dienų atidarykite Google Search Console → Indeksavimas → Puslapiai → “Indeksuoti, nors jų nereikia” ir “Dublikatai be vartotojo nurodyto kanoninio”. Jei abiejose kategorijose yra puslapių – tai diagnostiškai tikslus pasikartojančio turinio problemos sąrašas jūsų svetainėje šiuo metu, ir kiekvienas jų reikalauja atskiro sprendimo.

 

SEO Sprendimai atlieka duplicate content auditus Lietuvos verslo svetainėms – nuo URL parametrų konfigūracijos iki canonical žymų strategijos ir produktų aprašymų unikalinimo rekomendacijų. Susisiekite, jei norite sužinoti, kiek indeksuotų URL jūsų svetainėje šiuo metu konkuruoja pačios su savimi.