Araçlar

Log Dosyası Analizi

Log analizi ile sunucu loglarınızda Googlebot'un ve yapay zeka botlarının neyi, ne sıklıkla taradığını görün. Sahte botları resmi IP listeleriyle ayıklayın, tarama bütçesi israfını ve sitemap farkını bulun. Log tarayıcınızda işlenir, yüklenmez.

Sunucu erişim loguApache, Nginx, IIS, Cloudflare, AWS, Caddy; .log ve .gz
Log tarayıcınızda işlenir, sunucuya yüklenmez.

Örnek veri kurgusaldır: hayali bir ayakkabı mağazasının 14 günlük logu tarayıcınızda üretilir. Bot adresleri resmi listelerden, ziyaretçi ve taklitçi adresleri belgeleme aralıklarından seçilir.

Ayarlar
Biçim çoğu logda kendiliğinden tanınır. Tanınmazsa buradan seçin.

Tek günlük log az şey söyler; en az 7, tercihen 30 günlük log yükleyin.

Sonuç

Log raporu Bekliyor
Toplam istek0-
Bot payı0-
Benzersiz URL0-
Googlebot0-
Sahte bot0-
Log dosyası yükleyin ya da örnek veriyi açın; botlar, Googlebot taraması ve yapay zeka botları burada görünecek.
Hazırlayan
  • Dijital Pazarlama Uzmanı
  • Google Partner
  • Full Stack Developer
Son güncelleme
Dayanak
5 kaynak

Log Dosyası Analizi nasıl kullanılır?

  1. Erişim loglarını indirin

    Hosting panelinizden, sunucunuzdan ya da CDN'den en az 7, tercihen 30 günlük erişim logu alın. Ham dosya, eski günlerin .gz arşivi ve birden çok dosya birlikte olur.

  2. Dosyaları araca bırakın

    Dosyaları yükleme alanına sürükleyin ya da seçin. Araç dosyayı tarayıcınızda parça parça okur; bu sayede çok büyük loglar bile cihazınızdan çıkmaz.

  3. Biçimi ve doğrulamayı kontrol edin

    Araç biçimi kendisi tanır. IP doğrulamasını açık bırakın; araç yalnız resmi bot IP listelerini indirir ve her botu doğrulandı, sahte ya da doğrulanamadı diye işaretler.

  4. Dört sekmeyi okuyun

    Özet ile başlayın. Ardından Googlebot sekmesinde durum kodlarına ve tarama israfına, yapay zeka sekmesinde eğitim, arama ve kullanıcı botlarına, Sitemap sekmesinde boşluklara bakın.

  5. CSV alın ve düzeltin

    Her tabloyu CSV olarak indirin. Googlebot'un sürekli çarptığı yönlendirmeleri ve hataları düzeltin, her sürümden sonra analizi tekrarlayın.

Araç rakamları nasıl hesaplar?

Her rakam logunuzdaki satırlardan gelir. Araç, Googlebot ve yapay zeka rakamlarını saymadan önce sahte botları ayıklar.

Bot payıbot istekleri / tüm istekler
DoğrulandıIP adresi, sahibinin yayımladığı CIDR listesinin içinde
Sahte (UA taklidi)kullanıcı ajanında bot adı var, IP ise o sahibin hiçbir listesinde yok
Doğrulanamadısahibi IP listesi yayımlamıyor ya da doğrulama kapalı
Tarama israfı(304 hariç 3xx + 4xx + 5xx) / Googlebot istekleri
Parametreli URL payıadresinde ? olan Googlebot istekleri / Googlebot istekleri

Araç 304 yanıtını israfa katmaz: Google'ın tarama bütçesi rehberi, Googlebot önbellekteki kopyayı kullanabilsin diye 304 desteği önerir.

Araç tek tek log satırlarından ne sonuç çıkarır?

Aşağıdaki satırlar örnek veriden gelir. Her biri bir isteği, aracın verdiği sonucu ve sonraki adımı gösterir.

Log satırı (kısa)SonuçNe yapmalı
66.249.66.1, Googlebot smartphone ajanıDoğrulandı: IP, Google'ın ortak tarayıcı listesindeBir şey yapmayın; gerçek tarama olarak değerlendirin
192.0.2.44, Googlebot ajanıSahte: hiçbir Google listesinde bu IP yokGüvenlik duvarında sınırlayın ya da engelleyin; robots.txt işe yaramaz
20.171.207.12, GPTBot ajanıDoğrulandı: OpenAI eğitim tarayıcısıPolitikanıza göre robots.txt içinde GPTBot'a izin verin ya da engelleyin
104.210.139.200, ChatGPT-User ajanıDoğrulandı: kullanıcı tetiklemeli getirmeSayfayı, insanların ChatGPT'ye sorduğu bir konu olarak değerlendirin
198.51.100.5, YandexBot ajanıDoğrulanamadı: Yandex IP listesi yayımlamıyorTrafik önemliyse ters DNS sorgusuyla kontrol edin
Googlebot GET /eski-sayfa/, durum 301Tarama israfıİç linkleri ve sitemap'i son adrese çevirin

Örnek log kurgusaldır. Ziyaretçi ve taklitçi adresleri belgeleme aralıklarından (RFC 5737, RFC 3849) gelir; hiçbiri gerçek bir kişiye ait değildir.

Hangi yapay zeka botlarını ve jetonlarını bilmelisiniz?

Tablo, aracın tanıdığı yapay zeka botlarını listeler. İki satır yalnız robots.txt jetonudur: Google-Extended ve Applebot-Extended logunuzda kullanıcı ajanı olarak hiç çıkmaz.

AdSahibiKategorirobots.txt jetonuIP listesi
GPTBotOpenAIYapay zeka eğitimiGPTBotVar
OAI-SearchBotOpenAIYapay zeka aramasıOAI-SearchBotVar
ChatGPT-UserOpenAIKullanıcı tetiklemeliChatGPT-User (geçmeyebilir)Var
ClaudeBotAnthropicYapay zeka eğitimiClaudeBotVar
Claude-SearchBotAnthropicYapay zeka aramasıClaude-SearchBotVar
Claude-UserAnthropicKullanıcı tetiklemeliClaude-UserVar
PerplexityBotPerplexityYapay zeka aramasıPerplexityBotVar
Perplexity-UserPerplexityKullanıcı tetiklemeliPerplexity-User (genelde yok sayar)Var
CCBotCommon CrawlYapay zeka eğitimiCCBotVar
Meta-ExternalAgentMetaYapay zeka eğitimimeta-externalagentYok
AmazonbotAmazonYapay zeka eğitimiAmazonbotYalnız web sayfası
Google-ExtendedGoogleYalnız jetonGoogle-ExtendedTarayıcı değil
Applebot-ExtendedAppleYalnız jetonApplebot-ExtendedTarayıcı değil

Talha Aslan ve ekibi adları, rolleri ve listeleri 29 Eylül 2026'da OpenAI, Anthropic, Perplexity, Google, Apple, Common Crawl, Meta ve Amazon'un resmi sayfalarından kontrol etti. ByteDance, Bytespider için belge yayımlamıyor; bu yüzden araç onu diğer botlar altında gösterir.

Log analizi nedir, SEO için neden önemlidir?

Log analizi, web sunucunuzun erişim logunu okuyup hangi botun hangi adresi ne zaman ve hangi sonuçla istediğini gösterir. Search Console tarama etkinliğinin bir özetini verir; sunucu logu ise her isteği kaydeder, Google'ın raporlarında hiç çıkmayanlar dahil.

Bu yüzden log, teknik SEO için en dürüst kaynaktır. Örneğin Googlebot'un ziyaretlerini ürün sayfalarına mı, yoksa filtre adreslerine, yönlendirmelere ve hatalara mı harcadığını görürsünüz. Ayrıca log, içeriğinizi hangi yapay zeka botlarının okuduğunu ve kendini Googlebot diye tanıtan ziyaretçinin gerçekten Google olup olmadığını ortaya koyar.

Talha Aslan ve ekibi olarak SEO danışmanlığı kapsamındaki her teknik denetimde log dosyalarını inceliyoruz. Bu araç aynı ilk bakışı tarayıcınıza taşır. Dosyayı hiçbir yere yüklemez; analiz cihazınızda çalışır, böylece paylaşma izniniz olmayan logları da kontrol edebilirsiniz.

Sunucu erişim loglarını nereden alırsınız?

Barındırma firmalarının çoğu her site için erişim logu tutar. cPanel kullanan paylaşımlı hostingde Metrics bölümünden Raw Access ekranını açın; güncel logu ya da .gz arşivlerini buradan indirirsiniz. Önce arşiv seçeneğini açın, çünkü aksi halde cPanel eski veriyi her istatistik güncellemesinden sonra siler.

Kendi sunucunuzda Apache çoğunlukla /var/log/apache2/access.log, Nginx ise /var/log/nginx/access.log dosyasına yazar. Eski günler .1 ya da .gz uzantısıyla durur; hepsini birlikte bırakabilirsiniz. Ancak CDN arkasındaysanız sunucunuz yalnız içeri geçen trafiği görür. Bu durumda uç logları alın: Cloudflare Logpush JSON satırları yazar, AWS ise ALB ve CloudFront loglarını S3'e bırakır.

Araç combined ve common biçimlerini, IIS W3C, ALB, CloudFront, Cloudflare ve Caddy loglarını kendisi tanır. Üstelik en az bir haftalık veri tutmak işinizi kolaylaştırır. Tek gün, sitemap'in haftalık taranması gibi düzenleri gizler.

Log analizi sahte Googlebot'u nasıl yakalar?

Herkes kullanıcı ajanına Googlebot yazabilir. Veri kazıyıcılar ve açık tarayıcıları tam olarak bunu yapar, çünkü birçok site Google'a sınırsız geçiş verir. Yani kullanıcı ajanı tek başına hiçbir şey kanıtlamaz.

Google, doğrulama sayfasında iki yöntem anlatır. İlk olarak IP adresinin ters DNS sorgusu googlebot.com, google.com ya da googleusercontent.com altında bir ad döndürmeli, o adın ileri sorgusu da aynı IP'yi vermelidir. İkinci yöntem büyük loglar içindir: Google IP aralıklarını JSON dosyaları olarak yayımlar ve siz her adresi bu listelerle eşleştirirsiniz.

Bu log analizi aracı ikinci yöntemi kullanır. Sunucumuz Google, Bing, OpenAI, Anthropic, Perplexity, Apple, DuckDuckGo, Common Crawl ve Ahrefs'in resmi listelerini günde bir kez indirir; tarayıcınız da her bot adresini IPv4 ve IPv6 olarak bu listelerle eşleştirir. Eşleşme varsa bot doğrulanmış olur. Sahibinin listeleri dışındaki bir adresten gelen bot adı ise sahtedir. Yandex, Baidu ya da Meta gibi liste yayımlamayan sahiplerde sonuç doğrulanamadı olur; onlar için ters DNS kullanın.

Loglarda hangi yapay zeka botları çıkar ve ne ister?

Yapay zeka botlarını üç grupta toplayabilirsiniz ve her grup ayrı bir karar ister. GPTBot, ClaudeBot ve CCBot gibi eğitim tarayıcıları model eğitimi için sayfa toplar. OAI-SearchBot, Claude-SearchBot ve PerplexityBot gibi arama tarayıcıları yapay zeka cevaplarının arkasındaki dizini kurar. ChatGPT-User, Claude-User ve Perplexity-User gibi kullanıcı tetiklemeli ajanlar ise bir kişi o anda soru sorduğu için sayfayı açar.

Son gruba özellikle dikkat edin. ChatGPT-User'ın bir sayfayı getirmesi tarama değil, taleptir. Bu nedenle yapay zeka botları sekmesi bu ajanların en çok açtığı sayfaları listeler. OpenAI ve Perplexity de kullanıcı tetiklemeli isteklerin robots.txt kurallarına uymayabileceğini belirtir, çünkü isteği bir kişi başlatır.

İki ad logda hiç çıkmaz. Google-Extended ve Applebot-Extended yalnız robots.txt jetonudur; Apple'ın açıklamasına göre Applebot-Extended tarama yapmaz. Erişimi düzenlemek için robots.txt oluşturucu ile kurallarınızı yazın, ardından AI crawler rehberimizi okuyun.

Tarama bütçesi israfını loglarda nasıl bulursunuz?

Google'ın tarama bütçesi rehberine göre Google'ın ne kadar tarayacağını tarama kapasitesi ve tarama talebi belirler. Rehber büyük siteleri hedefler; yine de Googlebot ziyaretlerini önemli sayfalara harcadığında her site kazanır. Logunuz bu ziyaretlerin nereye gittiğini gösterir.

Araç yönlendirmeleri (3xx), istemci hatalarını (4xx) ve sunucu hatalarını (5xx) israf olarak sayar ve tüm Googlebot istekleri içindeki paylarını verir. 304 yanıtı istisnadır: Google'a önbellekteki kopyayı kullanmasını söyler, böylece kaynak kazandırır. Sunucu hatalarının başka bir önemi de var; Google'a göre 5xx yanıtları ve 429 sinyalleri Googlebot'u yavaşlatır.

Uygulamada URL başına tarama tablosunda israf sütununa bakın. Googlebot'un hâlâ istediği eski adresler çoğunlukla iç linklerde ya da sitemap'te durur; önce bu linkleri düzeltin. Ardından yönlendirme zincirlerini yönlendirme denetleyici ile test edin ve parametreli adreslere bakın, çünkü filtreler ve sıralamalar aynı sayfayı çoğaltabilir.

Log kayıtlarını sitemap ile nasıl karşılaştırırsınız?

Sitemap dizine girmesini istediğiniz adresleri listeler, log ise Googlebot'un gerçekten istediği adresleri gösterir. Sitemap sekmesi ikisini yan yana koyar ve iki liste verir.

İlk liste, log döneminde Googlebot'un hiç istemediği sitemap adresleridir. Bu sayfalar yeni, zayıf linkli ya da Google gözünde düşük değerli olabilir. Onlara iç link ekleyin ve durumlarını URL Denetleme aracında kontrol edin; Search Console rehberimiz bu adımları anlatır.

İkinci liste, 200 yanıtı verip Googlebot'un istediği ama sitemap'te olmayan HTML sayfalarıdır. Bir kısmı sitemap'e girmeli; site içi arama sonuçları gibi diğerleri ise taramadan çıkmalıdır. Sitemap'iniz eskiyse XML sitemap oluşturucu ile temiz bir sitemap hazırlayın. Araç sunucumuz üzerinden en çok 5.000 sitemap adresi okur ve yolları karşılaştırır; alan adı sonucu değiştirmez.

IP adresi içeren logları incelemek güvenli mi?

Erişim logları IP adresi içerir ve KVKK ile GDPR'a göre IP adresi kişisel veri sayılabilir. Bu yüzden araç dosyayı yalnız tarayıcınızda işler. Log sunucumuza hiç ulaşmaz; dışarı çıkan tek istekler resmi bot IP listeleri ve isterseniz sitemap'inizdir.

Yine de log dosyalarına özen gösterin. Onları yalnız ihtiyacı olan kişilerle paylaşın, gizlilik politikanızın belirttiğinden uzun saklamayın ve bir ajansa göndermeden önce ziyaretçi adreslerinin son bölümünü maskeleyin. Örneğin 203.0.113.25 adresi 203.0.113.0 olur. Resmi listelerdeki bot adresleri şirket ağlarıdır; doğrulama için onları olduğu gibi bırakabilirsiniz.

Sonuçları bir uzmanla birlikte okumak isterseniz ekibimiz log verisini Search Console ve site taramasıyla birleştirir. Sonuç olarak elinize yeni bir rapor değil, kısa bir düzeltme listesi geçer.

Log analizinde sık yapılan hatalar

  • HataYalnız kullanıcı ajanına güvenmekDoğrusuIP adresini resmi listeyle ya da ters DNS ile doğrulayın; sahte Googlebot çok yaygındır.
  • Hata304 yanıtlarını israf saymakDoğrusu304'ü ayrı tutun: Googlebot'un önbellekteki kopyayı kullanmasını sağlar ve kaynak kazandırır.
  • HataChatGPT'den çıkmak için ChatGPT-User'ı engellemekDoğrusuHer bot için ayrı karar verin: GPTBot eğitimi, OAI-SearchBot aramayı belirler; kullanıcı tetiklemeli istekler robots.txt'yi yok sayabilir.
  • HataTek günlük loga bakarak karar vermekDoğrusuEn az 7, tercihen 30 gün inceleyin; haftalık düzenler ve sürüm etkileri ancak böyle ortaya çıkar.
  • HataHam logu e-postayla göndermekDoğrusuÖnce ziyaretçi IP adreslerini maskeleyin ve yalnız gereken dönemi ve alanları paylaşın.

Sıkça Sorulan Sorular

Loglarınız tarama sorunu mu gösteriyor?

Talha Aslan ve ekibi olarak log, Search Console ve site yapısını birlikte inceliyor, tarama bütçesini doğru sayfalara yönlendiriyoruz.

SEO Hizmetini İncele

İlgili Araçlar

Tüm Araçlar (83)
SEO Analiz AracıBir URL'nin başlık, meta açıklama, başlık etiketleri, canonical, indekslenebilirlik ve hız sinyallerini ücretsiz tarayıp SEO puanı ve yapılacaklar listesi verir.
Yapay Zeka Görünürlük TestiSitenizin ChatGPT, Perplexity ve Google AI Overviews gibi yapay zeka aramalarında okunmaya ve alıntılanmaya hazır olup olmadığını robots.txt, llms.txt, schema ve içerik yapısıyla puanlar.
Robots.txt OluşturucuWordPress ve e-ticaret şablonlarıyla doğru robots.txt dosyanızı dakikada kurun.
404 Yönlendirme EşleştiriciKırık ya da eski URL'leri sitemap'teki en uygun canlı sayfayla adres ve başlık benzerliğine göre eşler, güven puanı verir; .htaccess, nginx ve CSV 301 listesi üretir.
Whois Sorgulama ve Domain YaşıBir alan adının kimde kayıtlı olduğunu, ne zaman alındığını, ne zaman biteceğini ve boşta olup olmadığını ücretsiz, kayıt olmadan gösterir.
Site Çöktü mü? Erişim TestiBir site herkes için mi kapalı, yoksa sorun sizde mi? Durum kodu, yanıt süresi, DNS ve SSL kontrolüyle saniyeler içinde öğrenin.