Teknik SEO Nedir? Tarama, Dizin ve Site Sağlığı Kontrolleri

Teknik SEO Nedir? Tarama, Dizin ve Site Sağlığı Kontrolleri

Sayfaların taranmasını ve dizine girmesini engelleyen teknik sorunları, hız metriklerini ve yapılandırılmış veriyi Search Console üzerinden kontrol etme rehberi.

Kategori: SEO#SEO#Teknik SEO#Search Console#Core Web Vitals
ChatGPT ile özetle

Teknik SEO, içeriğin kalitesinden bağımsız olarak sitenin taranabilir, dizinlenebilir ve kullanılabilir olmasını sağlayan çalışmalardır. En iyi içerik bile teknik bir engelin arkasındaysa hiçbir sorguda yarışamaz. Bu yüzden teknik taraf, SEO’nun görünmeyen ama zemini oluşturan katmanıdır.

İyi haber şu: çoğu site için teknik SEO, sürekli uğraş gerektiren bir alan değil, bir kez doğru kurulup arada denetlenen bir altyapıdır. Kötü haber ise tek bir yanlış satırın (örneğin robots.txt’deki bir Disallow) tüm siteyi sonuçlardan düşürebilmesidir.

Bu yazıdaki kontrollerin resmi dayanakları şunlar: robots.txt dokümanı tarama kurallarını, site haritası dokümanı keşif dosyasını, canonical dokümanı kopya URL yönetimini, web.dev’in Core Web Vitals rehberi ise hız metriklerini tanımlar.

Teknik SEO Denetim Listesi

Teknik denetimde her sorun aynı öncelikte değildir. Taranmayı ve dizine girmeyi engelleyen sorunlar, hız veya schema iyileştirmelerinden önce çözülür.

KontrolRiskÖncelik
HTTPS kullanımıGüven uyarısı, zayıf kullanıcı deneyimi ve sinyal kaybı.Yüksek
Site versiyonlarıhttp, https, www ve www olmayan sürümlerde sinyal bölünmesi.Yüksek
robots.txtÖnemli dizinlerin yanlışlıkla taramaya kapatılması.Yüksek
Tarama hataları404, 5xx, yönlendirme döngüsü veya robots engeli sorunları.Yüksek
SitemapÖnemli URL’lerin keşif listesinden eksik kalması.Orta
CanonicalKopya URL’lerde yanlış resmi adres seçimi.Yüksek
Kırık bağlantılarBot ve kullanıcı akışının bozulması.Orta
HTTPS sayfada HTTP kaynakMixed content ve güven sorunları.Orta
URL yapısıAnlamsız, parametreli veya sürekli değişen adresler.Orta
Sayfa derinliğiÖnemli sayfanın ana sayfadan çok tık uzakta kalması.Orta
Yönlendirmeler302’nin kalıcı taşıma için kullanılması veya zincir oluşması.Orta
Yapılandırılmış veriSayfanın türünün ve ilişkili bilgilerin makineye eksik anlatılması.Düşük-Orta
Core Web VitalsBenzer kalitedeki sonuçlarda kullanıcı deneyimi dezavantajı.Orta

Bu tabloyu crawler çıktısı, Search Console dizin raporu ve URL Inspection sonuçlarıyla birlikte kullan. Tek araç yeterli değildir: crawler sitenin gördüğü yapıyı, Search Console ise Google’ın gerçekten gördüğü sonucu anlatır.

Tarama Katmanı: Googlebot Siteye Ulaşabiliyor mu?

robots.txt: tarayıcıya çizilen sınır

Sitenin kökünde duran bu düz metin dosyası, tarayıcıların hangi bölümlere girebileceğini söyler. Yönetim panelini veya filtre parametrelerini kapatmak meşru kullanımdır; risk, geniş yazılmış bir kuralın gerekli bölümleri de kapatmasıdır. Disallow: / satırı tek başına tüm siteyi taramaya kapatır. Site yayına alınırken test ortamından kalan böyle bir satır, en klasik teknik SEO kazasıdır.

Bir uyarı daha: robots.txt dizinden çıkarma aracı değildir. Engellenen sayfa, başka yerlerden bağlantı alıyorsa dizinde görünmeye devam edebilir; dizinden çıkarmanın doğru yolu noindex etiketidir.

AI botları: GPTBot, OAI-SearchBot ve CCBot aynı şey değil

AI arama görünürlüğü konuşulurken “GPTBot’u engelleme” cümlesi sık geçiyor; fakat botların görevleri aynı değil. OpenAI’nin crawler dokümanına göre OAI-SearchBot, ChatGPT’nin arama özelliklerinde web sitelerini sonuçlarda göstermek için kullanılır. OpenAI, ChatGPT Search görünürlüğü için robots.txt’de OAI-SearchBot erişimine izin verilmesini önerir. GPTBot ise üretken temel modellerin eğitiminde kullanılabilecek içerikleri taramak için kullanılır; bunu engellemek, içeriğin model eğitimi için kullanılmaması yönünde sinyal verir. ChatGPT-User ise otomatik web taraması değil, kullanıcının başlattığı bazı ChatGPT işlemleri için kullanılır; OpenAI, arama görünürlüğünün bu ajan üzerinden yönetilmemesi gerektiğini belirtir.

Common Crawl tarafında CCBot, web crawl verisi üreten ayrı bir bottur. Common Crawl, CCBot’un robots.txt’yi önce kontrol ettiğini, user-agent değerinin CCBot olduğunu ve engellemek için User-agent: CCBot / Disallow: / kuralının kullanılabileceğini açıklar.

Bu ayrım pratikte şu anlama gelir:

BotTemel amaçrobots.txt kararı
OAI-SearchBotChatGPT arama sonuçlarında web sitelerini göstermekChatGPT Search görünürlüğü isteniyorsa engellenmemeli.
GPTBotOpenAI temel modelleri için eğitim amaçlı crawlModel eğitimi kullanımı istenmiyorsa ayrıca engellenebilir.
ChatGPT-UserKullanıcının başlattığı ChatGPT ziyaretleriArama görünürlüğü kararı bu ajan üzerinden verilmez.
CCBotCommon Crawl veri seti için web crawlAçık veri/crawl stratejisine göre izin verilir veya engellenir.

Kısacası “AI aramalarında görünmek istiyorum” kararıyla “model eğitimine veri vermek istiyorum” kararı aynı şey değil. robots.txt dosyasını kontrol ederken Googlebot ve Bingbot yanında bu AI botlarını da ayrı satırlar olarak düşün; ticari, hukuki ve içerik lisansı boyutunu ise sıradan bir teknik SEO maddesi gibi işaretleyip geçme.

Site haritası: keşif için davet listesi

sitemap.xml, dizine girmesini istediğin URL’leri listeleyen dosyadır. Garanti değil davettir; ama özellikle yeni, büyük veya iç bağlantısı zayıf sitelerde keşfi belirgin hızlandırır. Search Console’a gönderdikten sonra asıl iş başlar: “gönderilen” ile “dizine alınan” sayıları arasındaki fark düzenli izlenmeli. Fark büyükse dizinleme raporundaki nedenlere bakma zamanı gelmiştir.

Dizin Katmanı: Sayfa Kayıtlı mı, Doğru Adresle mi Kayıtlı?

Canonical: aynı içeriğin tek resmi adresi

Aynı içerik birden fazla URL’den açılabiliyorsa (http/https, www’lu-www’suz, parametreli varyasyonlar) Google bunları ayrı sayfalar olarak görebilir ve sinyaller bölünür. Canonical etiketi, varyasyonlar arasından resmi adresi ilan eder. Kural basit: her sayfa kendi temiz URL’ini canonical olarak göstermeli, varyasyonların tümü tek adrese işaret etmeli.

URL Inspection: tek sayfanın röntgeni

Bir sayfanın dizin macerasını tahmin etme; URL Inspection aracına yapıştır ve bak. Araç sayfanın dizinde olup olmadığını, en son ne zaman tarandığını, hangi canonical’ın seçildiğini ve varsa engelin nedenini gösterir. Yeni yayınlanan önemli bir sayfa için “dizine eklenmesini iste” butonu keşfi öne çekebilir. Dizin durumu kavramlarının tanımları için sözlükteki Search Console bölümüne bakabilirsin.

Kullanılabilirlik Katmanı: Hız, Mobil ve Güvenlik

Core Web Vitals, Google’ın sayfa deneyimini ölçtüğü üç metriktir ve Search Console’da site geneli raporlanır:

MetrikNeyi ölçer”İyi” eşiği
LCPAna içeriğin ekrana gelme süresi≤ 2,5 sn
INPEtkileşime yanıt verme süresi≤ 200 ms
CLSYüklenirken içeriğin kayması≤ 0,1

Bu metrikler sıralamayı tek başına belirlemez; benzer kalitedeki sonuçlar arasında ayrıştırıcı rol oynar. Yani hız optimizasyonu, zayıf içeriği kurtarmaz ama iyi içeriğin hakkını almasını sağlar. Pratikte en büyük LCP kazancı çoğu zaman tek bir işten gelir: sayfanın en büyük görselini sıkıştırmak ve modern formatta sunmak.

Mobil uyum artık ayrı bir kontrol maddesi olmaktan çıktı; Google dizinlemeyi zaten mobil sürüm üzerinden yapıyor. Masaüstünde zengin, mobilde budanmış içerik sunan siteler bu yüzden kendi dizin kaydını zayıflatır. HTTPS ise tartışma konusu bile değil: sertifikasız site hem tarayıcı uyarısı yer hem de güven sinyali kaybeder.

Yapılandırılmış Veri: İçeriği Makineye Tarif Etmek

Yapılandırılmış veri, sayfanın içeriğini schema.org sözlüğüyle etiketleyen koddur: bu bir makale, şu tarihte yayınlandı, yazarı bu. Doğru işaretleme, sonuçlarda yıldız, SSS ve benzeri zengin görünümlerin kapısını açar; zengin görünüm ise aynı pozisyonda daha fazla tıklama demektir.

Sınırını bilerek kullan: yapılandırılmış veri içeriği olduğundan farklı gösteremez. Sayfada görünmeyen bilgiyi işaretlemek zengin sonuç kazandırmaz, aksine manuel işlem riski doğurur.

Özet

Teknik SEO üç soruya indirgenebilir: Googlebot sayfaya ulaşabiliyor mu (robots.txt, site haritası, iç bağlantı), sayfa doğru adresle dizinde mi (canonical, noindex, URL Inspection) ve sayfa kullanılabilir mi (Core Web Vitals, mobil, HTTPS)? Bu üçü sağlamsa teknik taraf görevini yapıyor demektir; görünürlüğün kalan kısmı içerik kalitesine ve dış bağlantılarla kurulan otoriteye bağlıdır.

İlgili Yazılar

Terim sözlüğü

Bu yazıdaki terimler

Bu yazıda geçen platform terimleri merkezi sözlükten çekilir; İngilizce arayüz terimi, Türkçe karşılığı ve kısaltma birlikte gösterilir.

Araştırma notu

Kaynaklar ve örnek çalışmalar

Bu bölümde yazıda yararlanılan dış kaynaklar ve her kaynağın hangi bağlamda kullanıldığı yer alır.

Teknik SEO kaynakları sorunları katmanlara ayırır: taranabilirlik, dizinlenebilirlik ve kullanılabilirlik. Yazıdaki kontroller bu katman sırasına göre dizildi; çünkü alt katmandaki bir engel üst katmandaki tüm çalışmayı geçersiz kılar.

  • robots.txt dokümanı, engellenen sayfanın dizinde kalabileceğini; dizinden çıkarmanın doğru yolunun noindex olduğunu belirtir.
  • Sitemap dokümanı, site haritasının garanti değil keşif daveti olduğunu ve özellikle yeni sitelerde fayda sağladığını açıklar.
  • web.dev, Core Web Vitals eşiklerini (LCP ≤ 2,5 sn, INP ≤ 200 ms, CLS ≤ 0,1) saha verisiyle tanımlar.
  • OpenAI ve Common Crawl kaynakları, AI crawler kararlarında arama görünürlüğü, model eğitimi ve açık web crawl amaçlarının ayrılması gerektiğini gösterir.
  1. Introduction to robots.txtGoogle Search Central
    Tarama kurallarını ve robots.txt’in dizinden çıkarma aracı olmadığını açıklayan resmi kaynak.
  2. Learn about sitemapsGoogle Search Central
    Site haritasının hangi sitelerde fayda sağladığını ve keşif sürecindeki rolünü tanımlar.
  3. How to specify a canonical with rel="canonical" and other methodsGoogle Search Central
    Kopya URL varyasyonlarının tek resmi adreste birleştirilmesi gerektiğini açıklar.
  4. Web Vitalsweb.dev (Google)
    LCP, INP ve CLS metriklerinin tanımı ve “iyi” eşik değerleri için birincil kaynak.
  5. Introduction to structured data markupGoogle Search Central
    Yapılandırılmış verinin zengin sonuçlarla ilişkisini ve sınırlarını tanımlar.
  6. Overview of OpenAI CrawlersOpenAI Developers
    OAI-SearchBot, GPTBot ve ChatGPT-User ajanlarının farklı amaçlarla kullanıldığını ve robots.txt kararlarının buna göre ayrılması gerektiğini açıklar.
  7. Common Crawl CCBotCommon Crawl
    CCBot user-agent değerini, robots.txt ile engelleme örneğini ve doğrulama/IP bilgilerini resmi kaynaktan açıklar.

Bu konuyu bir seri içinde oku

Bu yazı tek başına okunabilir ya da ilgili konuları daha düzenli bir sırayla görmek için seriler bölümünden devam edilebilir.

Serilere bakGeri bildirim gönder

Değerlendirme

Bu yazı ne kadar faydalıydı?

1 ile 5 arasında puanla

Değerlendirme

Bu yazı işine yaradı mı?

Tek tıkla puanlayabilirsin.

1 ile 5 arasında puanla