Bir sayfayı sitemap'e eklemek yeterli değildir. Googlebot sitemap'i referans alır; ama hangi URL'leri ne sıklıkla tararacağına iç link yapısı karar verir. Sitemap'te olan ama hiç iç link almayan bir sayfa, Googlebot'un ilk ziyaretinin ardından uzun süre tekrar taranmayabilir; hatta hiç indekslenmeyebilir.
Orphan page, site yapısı içinde herhangi bir iç linkle desteklenmemiş sayfa demektir. Teknik tanım bu kadar yalın; ama pratikte üç farklı biçimde karşınıza çıkar ve her biri farklı sorun üretir. Site büyüdükçe bu sorun da sessizce büyür: her yeni sayfa yayına girdiğinde iç link yapısına dahil edilmezse, aylarca fark edilmeden crawl kuyruğunda bekleyen URL sayısı artar.
İç link almayan sayfa nasıl taranır?
Googlebot bir siteyi tararken link grafiğini izler. Bir sayfaya ulaşabilmek için ya sitemap URL listesinde olması ya da başka bir sayfadan link alması gerekir. Bu iki kanalın pratikte farklı ağırlıkları var.
Sitemap'ten gelen URL'ler "bilinir"; ama tarama sırası crawl bütçesiyle belirlenir. Eğer bir sayfanın Googlebot gözünde algılanabilir bir değeri yoksa, yani başka hiçbir sayfa ona link vermiyorsa, tarama sıklığı düşer. Aylar boyunca sitemap'te duran ama hiç güncellenmemiş ve hiç iç link almamış bir sayfa, düşük öncelikli URL kuyrusunda bekleyebilir.
Buna karşılık birden fazla sayfadan link alan bir URL iki sinyali birden taşır: taranabilirlik ve alaka. Googlebot yüksek iç link alan sayfaları daha sık tekrar ziyaret eder; içerik değişikliklerini daha hızlı fark eder. Yalnızca sitemap kaydı, sayfanın düzenli taranacağını garanti etmez; asıl belirleyici olan iç link yapısıdır.
Üç farklı orphan page türü
Teknik orphan ile pratik orphan arasındaki fark çoğu kaynakta atlanır.
Teknik orphan: Siteye ait hiçbir iç sayfada bu URL'ye link yok. Header, footer, içerik; hiçbir yerden ulaşılamıyor. Googlebot bu sayfayı ancak sitemap üzerinden bulabilir ve onu da düşük öncelikli kuyruğa atar.
Pratik orphan: İç link teknik olarak var, ama sayfa 4 veya daha fazla tık derinliğinde. Anasayfadan başlayan bir tarama bu sayfaya makul sürede ulaşamaz. Özellikle kategori, alt kategori, filtre ve ürün zincirinin sonunda kalan sayfalarda bu durum yaygındır. 5000 veya daha fazla SKU'ya sahip bir e-ticaret sitesinde, filtre kombinasyonlarından oluşan URL'lerin önemli bir kısmı bu kategoriye girer.
Fonksiyonel orphan: Sitemap'te var, bir kez taranmış ve indekslenmiş, ama iç link almıyor. Sorun şu: içerik güncellense bile Googlebot güncellemeyi fark etmekte geç kalır. Düşük öncelikli URL olarak işaretlenmiş bir sayfada, yayına giriş ile tekrar taranma arasında haftalar geçebilir.
Bu üç tür arasında pratikte en çok zarar üreten pratik orphan'dır; çünkü teknik olarak iç link var gibi görünür ve sorun yakalanmaz. Sayfa zaman zaman Googlebot ziyareti alıyor olsa da, 4 veya daha fazla tık derinliği crawl bütçesini düşük getirili URL'lere yönlendiriyor demektir. Bu derinlikteki sayfaların tarama frekansı, anasayfadan 1-2 tık uzaklıktaki sayfalara kıyasla belirgin biçimde düşük kalır. Yoğun filtre kombinasyonları üretilen büyük katalog sitelerinde bu durum yüzlerce URL için aynı anda geçerli olabilir.
Orphan page nasıl bulunur?
Basit bir kontrol bulmaz. Karşılaştırma gerekir.
Crawl verisini sitemap verisiyle çakıştırmanız lazım; önce iç link grafiğini ve sayfa bağlantı yapısını çıkarmak için sitenizi bir crawler ile tarayın, ardından sitemap'teki tüm URL listesini alın ve iki listeyi karşılaştırın: sitemap'te olup crawler'ın hiç ulaşamadığı URL'ler potansiyel orphan adaylarıdır.
Karşılaştırmada bir ayrım kritiktir: JavaScript ile inject edilen linkler ve onclick eventleri, standart HTML tabanlı bir crawler'ın atlayabileceği bağlantılardır. Bunları ayrı değerlendirin; aksi hâlde gerçek orphan olmayan sayfalar listeye girebilir.
Sayfa bazında iç link dağılımını analiz etmek için hangi URL'lerin kaç iç link aldığını çıkartabilirsiniz. Sıfır değeri dönen sayfalar listesi, orphan adaylarınızdır. Bu listeyi noindex durumlarıyla çakıştırın: noindex olan sayfalar listeden çıkar; kalanlar gerçek sorun noktalarıdır.
Log analizi ekleyebiliyorsanız çok daha net bir tablo ortaya çıkar. Googlebot'un son 30 ila 90 günde hiç ziyaret etmediği URL'leri sunucu loglarından çekin. Bu iki listenin kesişimi, yani hem sitemap'te olan hem de son 90 günde taranmamış URL'ler, en öncelikli orphan adaylarıdır.
Google Search Console'un Kapsam (Coverage) raporu ek bir filtre sağlar. "Keşfedildi, şu an indekslenmedi" olarak işaretlenen URL'ler genellikle düşük öncelikli tarama kuyruğunda bekleyen sayfalardır. Bunların bir kısmı orphan'dır: Googlebot URL'yi sitemap üzerinden kaydetti ama link grafiğinde yeterince görünür olmadığı için taramayı erteledi. Bu listeyi crawler verisiyle kıyasladığınızda hangi sayfanın gerçekten iç link sorunu yaşadığı netleşir; "keşfedildi" ifadesi iç link yokluğunu değil yalnızca tarama sırasını yansıtır, bu ayrımı gözden kaçırmayın.
Sitemap kapsamını doğru kurgulamak bu sürecin temel adımlarından biridir; karşılaştırma yapabilmek için sitemap'in gerçek site içeriğini yansıtıyor olması gerekir.
Kasıtlı orphan page ne zaman sorun değildir?
Her iç link almayan sayfa düzeltilmesi gereken bir hata değildir.
Staging sayfaları, kullanım dışı kalmış eski landing page'ler, yalnızca doğrudan URL ile erişilen arama formu sayfaları; bunlar kasıtlı olarak link dışında tutulabilir. Bu durumda noindex etiketi varsa ve robots.txt'te disallow bloğu yoksa, teknik olarak zararsızdır. noindex ile disallow'un birbirinden nasıl ayrıştığını bilmeden her ikisini aynı sayfaya uygulamak bazen beklenmez sonuçlar üretir; ikisi farklı katmanlarda çalışır.
Asıl sorun belgelenmemiş belirsizliktir. Bir sayfa bugün bir kampanya için oluşturulur ve unutulur. Üç ay sonra başka biri aynı URL yapısını kullanmak ister ya da aynı URL yeni içerikle yayına girer ama eski sürüm önbelleklerde kalır. Bu tür durumların birikmesi, büyük sitelerde düzenli orphan denetimini zorunlu kılar.
Kasıtlı orphan'ı yönetmenin en temiz yolu bir kural koymaktır: noindex etiketi eklenmiş ve robots.txt'te disallow bloğu olmayan, sitemap'te yer almayan ve yönlendirme almayan sayfalar kasıtlı orphan olarak kabul edilir. Bu kural belgelenirse gelecekteki tarama raporlarında bu URL'ler gürültü üretmez. Kural yazılmazsa her orphan denetimi aynı sayfaları yeniden incelemeyi gerektirir.
Orphan page bağlarken yapılan hatalar
Sayfanın orphan olduğunu fark edince en kolay çözüm header veya footer'dan link vermek gibi görünür. Bu genellikle yanlış tercihtir.
Header ve footer linkleri tüm sayfalarda tekrarlandığı için, Googlebot bu bağlantıları sitenin gerçek içerik yapısını yansıtmıyor olarak değerlendirebilir; siteye özgü bir içerik ilişkisi kurmayan, evrensel şablondan gelen linkler tematik sinyal taşımaz. Tematik olarak ilgili bir sayfadan, konuyla bağlantılı bir bağlamda verilen iç link, link juice aktarımı açısından çok daha etkilidir. Kategori sayfasından veya tematik bir blog yazısından gelen bağlamsal link, footer'daki site geneli linklerden daha güçlü sinyal üretir.
İkinci yaygın hata: anchor text'i generic bırakmak. "Daha fazla bilgi için" veya "bu sayfaya bakın" gibi ifadeler Googlebot'a sayfanın içeriği hakkında hiçbir şey söylemez. Orphan page'i bağladığınızda anchor text, o sayfanın ana konusunu yansıtmalıdır. Aşırı optimize edilmiş, yani hedef sayfanın odak kelimesini birebir tekrarlayan anchor text de dikkat gerektirir; benzer içerikteki birden fazla sayfayı bağladığınızda anchor text çeşitliliği önem kazanır.
Mevcut iç link yapınızı analiz ederek hangi sayfaların hiç link almadığını ve hangi sayfaların aşırı link aldığını görmeniz, orphan sorununun yanı sıra link dağılımındaki dengesizlikleri de ortaya koyar. Yüzlerce iç link alan bir anasayfa ile sıfır link alan kategori alt sayfaları arasındaki dağılım farkı, crawl bütçesinin nereye harcandığını doğrudan etkiler.
Üçüncü yaygın hata ise derinlik gözetmeksizin bağlamak. 4. veya 5. tık seviyesindeki bir sayfayı yine benzer derinlikteki bir sayfaya bağlamak sorunu çözmez; sayfayı site yapısında gerçekten yukarı taşımak gerekir. Bunun için en uygun bağlama noktaları şunlardır: konu başlığıyla örtüşen bir kategori sayfası, ilgili bir blog yazısı ya da o konuya değinen merkezi bir içerik. Hub page mantığıyla çalışıyorsanız, orphan'ın hub üzerinden link grafiğine dahil edilmesi tarama önceliğini değiştirir; anchor text ve kaynak sayfanın otoritesi bu etkiyi belirler.
Son bir nokta: orphan page bağlama işlemi tek seferlik değildir. Yeni sayfalar yayınlandıkça, eski içerikler kaldırıldıkça veya site yapısı değiştikçe link grafı değişir. Düzenli tarama ve sitemap karşılaştırması bu değişimleri erken yakalar; kör noktalar birikmeden müdahale etmenizi sağlar.
Orphan page sorunu çoğu zaman ani bir hata olarak değil, site büyüdükçe biriken küçük ihmallerden oluşur. İlk yüz sayfada takip edilmesi kolaydır; bin sayfaya gelindiğinde yapısal bir süreç olmadan yönetmek mümkün değildir. Periyodik link grafı denetimini teknik SEO rutininin bir parçası olarak tanımlayanlar, bu sorunun birikmeden önce fark edilmesini sağlar.