PDF SEO: PDF Dosyaları Google'da Sıralanır mı, Dizinden Nasıl Çıkarılır?

PDF SEO nedir: PDF dosyaları Google'da sıralanır mı?
Evet, PDF dosyaları Google'da dizine girebilir ve arama sonuçlarında sıralanabilir. PDF SEO, bu dosyaların doğru başlıkla, okunabilir metinle ve doğru sayfaya yönlenen sinyallerle dizine girmesini sağlama işidir. Google, Adobe PDF biçimini dizine eklediği dosya türleri arasında resmen sayıyor.
PDF SEO konusunda internette çok fazla kesin görünen ama kaynağı belirsiz tavsiye dolaşıyor. Biz bu yazıda yalnızca resmi belgelerle doğrulayabildiğimizi kesin söylüyoruz. Bu yazıda tek bir soruya odaklanıyoruz: PDF dosyalarınız Google'da nasıl davranır ve bu davranışı nasıl yönlendirirsiniz? Genel SEO anlatımına girmiyoruz. Bu nedenle ilgili konuları ayrı yazılarımıza bağlıyoruz. Konunun resmi kaynağı, Google Search Central'daki dizine eklenebilen dosya türleri belgesidir.
Not: Bu yazıda yalnızca resmi belgelerde doğrulayabildiğimiz Google davranışlarını kesin yazdık. Doğrulayamadıklarımızı açıkça "resmi belgelerde net bir ifade bulamadık" diye belirttik.
PDF SEO için Google hangi dosya türlerini dizine ekler?
Google'ın resmi belgesi, desteklenen dosya türlerini gruplar halinde listeler. Listede Adobe Portable Document Format, yani PDF, "kodlanmış dosyalar" grubuna girer. Bu grup, insan tarafından okunabilir metni çıkarmak için özel bir ayrıştırıcı gerektiren ikili dosyaları kapsar.
Aynı belgeye göre Google, dosya türünü önce sunucunun gönderdiği içerik türü üstbilgisinden anlar. Üstbilgi eksik ya da yanlışsa uzantıya bakabilir veya dosyayı başka bir ayrıştırıcıyla yeniden okuyabilir. Yani sunucunuzun PDF'i doğru türle sunması önemlidir.
Kendi sitenizdeki PDF'leri görmek için arama kutusuna örneğin "site:example.com filetype:pdf" yazabilirsiniz. Google belgeleri, filetype operatörünün sonuçları belirli bir dosya türüne daraltmak için kullanılabildiğini söylüyor. Böylece hangi PDF'lerin dizinde olduğunu hızlıca görürsünüz.
Bu arama bir sayım aracı değildir; sonuç sayısı yaklaşık bir göstergedir. Yine de beklemediğiniz bir PDF'in listede çıkması, temizlik gerektiren bir dosyanız olduğunu gösterir. Örneğin eski bir fiyat listesi ya da iç kullanım için yüklediğiniz bir form listede belirebilir.
Metin seçilebilir PDF ile taranmış görüntü PDF arasındaki fark nedir?
Metin seçilebilir PDF, içinde gerçek metin katmanı taşır. Siz fareyle bir cümleyi seçip kopyalayabilirsiniz. Taranmış görüntü PDF ise sayfaların fotoğrafını saklar; ekranda metin gibi görünse de dosyada yalnızca piksel vardır.
Google'ın PDF'lere ilişkin resmi blog duyurusunda, metin görüntü olarak gömülmüşse görüntülerin OCR algoritmalarıyla işlenebildiği anlatılıyor. Aynı duyuruda pratik bir kural var: PDF'teki metni kopyalayıp düz bir metin belgesine yapıştırabiliyorsanız Google'ın da o metni dizine ekleyebilmesi beklenir. Bu ayrıntıyı güncel yardım sayfalarında birebir bulamadık; bu nedenle garanti olarak değil, genel bir ilke olarak okuyun.
Bizim saha önerimiz basit: Mümkün olduğunca metin katmanlı PDF yayınlayın. OCR sonucu bozuk ya da eksik çıkabilir, üstelik okuyucu için de erişilebilirlik sorunu doğar.
PDF SEO çalışmasının ilk adımı metin katmanını doğrulamaktır. Test için üç hızlı yol var. Hiçbiri özel yazılım gerektirmez.
- PDF'i tarayıcıda açın ve bir paragrafı fareyle seçmeyi deneyin. Seçilemiyorsa büyük olasılıkla görüntü PDF'tir.
- Seçtiğiniz metni basit bir not defterine yapıştırın. Harfler bozuk ya da boşluklar yanlışsa metin katmanı sorunludur.
- PDF içinde bir kelime arayın. Arama sonuç vermiyorsa metin katmanı yok ya da eksiktir.
Bu üç testi yeni yayınladığınız her PDF için yapmanızı öneririz. Özellikle yazıcıdan taranan evraklarda, üçüncü testte sorun çıkma ihtimali yüksektir.
Sonuç olumsuzsa kaynak belgeyi (Word, tasarım dosyası) yeniden dışa aktarın. Taranmış bir evrak şartsa, metin tanıma çalıştırın ve sonucu elle kontrol edin. Ayrıca aynı içeriği bir HTML sayfada da yayınlamak, hem okuyucu hem de arama motoru için en sağlam çözümdür.
PDF'in başlığı Google'da nasıl belirlenir?
Google'ın PDF'lere ilişkin resmi blog duyurusuna göre arama sonucundaki başlık için iki sinyal öne çıkar: dosyanın kendi meta verisindeki başlık ve o PDF'e veren bağlantıların bağlantı metni. Google, algoritmalara güçlü bir sinyal vermek için ikisini de güncellemenizi öneriyor.
Burada bir dürüstlük notu gerekiyor. Google'ın HTML sayfalar için yazdığı başlık bağlantısı belgesi PDF'lerden söz etmiyor. Dolayısıyla PDF başlığının tam algoritmasını resmi belgelerde açıkça bulamadık. Google ayrıca başlığı kendi seçimiyle de değiştirebilir; bu davranış HTML sayfalar için resmen anlatılıyor.
Bir başka ipucu da arama sonucunda başlığı gözlemlemektir. Başlık beklediğinizden farklı çıkıyorsa, önce dosya meta verisindeki başlığı, sonra PDF'e veren bağlantı metinlerini kontrol edin. Böylece sorunun kaynağını daraltırsınız.
Pratik sonuç şu: PDF'in belge başlığını doldurun, dosyaya veren bağlantıları açıklayıcı yazın ve sonucu arama sonuçlarında izleyin.
PDF SEO'da dosya meta verisini nasıl doldurursunuz?
PDF SEO için meta veri, yani dosya özelliklerinde duran başlık, yazar, konu ve anahtar sözcük alanlarıdır; bu tanım Adobe biçimine değil, genel kullanıma dayanır. Çoğu tasarım ve ofis programı bunu dışa aktarma sırasında doldurmanıza izin verir. Menü adları programdan programa değiştiği için burada kesin buton adı vermiyoruz; ilgili programın "belge özellikleri" bölümüne bakın.
Başlık alanını boş bırakmayın. Aksi halde program, dosya adını ya da taslaktan kalan bir adı başlık yapabilir. Örneğin "Yeni Belge Son v3" gibi bir başlık, arama sonucunda kötü bir ilk izlenim bırakır.
Yazar ve konu alanlarına da dikkat edin. Ayrıca bu alanlarda kişisel ad, iç proje kodu ya da gizli bilgi kalmasın. Google'ın gizli bilgi belgesi, dosyalarda görünmeyen meta verinin dosyaya erişen ya da düzenleyen kişilerin adlarını taşıyabileceği konusunda uyarır.
Başlığı kısa ve konuya odaklı tutun. Örneğin "Tedarikçi Seçim Kontrol Listesi" gibi, kullanıcının aradığı ifadeyi başa alan bir başlık işinizi görür. Marka adını sona koyabilirsiniz.
Görsellerin kendi meta verisi ayrı bir konudur; onu Google Görseller ve IPTC meta verisi yazımızda anlattık.
PDF SEO'da PDF'ler HTML sayfayla neden yarışır?
PDF SEO'da en sık karşılaşılan sorun budur. Aynı içeriği hem PDF hem HTML olarak yayınlarsanız, ikisi de aynı sorguya aday olur. Yani kendi sayfanızla kendiniz yarışırsınız. Sonuçta bazen PDF öne çıkar ve kullanıcı, menüsü, formu ve dönüşüm yolu olmayan çıplak bir dosyaya iner.
Bu durum bir ceza değildir, yani sitenize otomatik bir zarar gelmez; kopya içerik davranışına benzer bir sinyal dağılmasıdır. Kopya içeriğin SEO'ya gerçek etkisini kopya içerik rehberimizde anlattık, burada tekrar etmiyoruz.
Çözüm genellikle şudur: Kullanıcıya göstermek istediğiniz sürümü seçin, diğerini bu sürüme yönlendiren sinyaller verin. Çoğu işletme için tercih edilen sürüm HTML sayfadır. Çünkü HTML sayfa site menüsünü, iç bağlantıları, ölçümü ve dönüşüm alanını taşır.
PDF ile HTML aynı içeriği taşıyorsa hangisi kanonik olmalı?
Genel kural: Sizin için iş değeri üreten sürüm kanonik olmalı. Bu çoğunlukla HTML sayfadır. PDF ise "indirilebilir kopya" rolünde kalır.
İstisnalar vardır. Örneğin teknik bir şartname yalnızca PDF olarak yayınlanıyorsa, o PDF zaten tek sürümdür ve kanonik yönlendirmeye gerek kalmaz. Ayrıca tek sayfalık bir HTML özetinin yanında, ayrıntıları taşıyan ayrı bir PDF rapor olabilir. İçerikler gerçekten farklıysa ikisi de bağımsız kalabilir.
Bu kararı bir kez verip tüm PDF'lere uygularsanız yönetim kolaylaşır. Dosya sayınız çoksa, önce en çok bağlantı alan ve en çok aranan PDF'lerden başlayın. Küçük bir envanter tablosu burada çok işe yarar.
Karar vermek için kendinize şunu sorun: Bu içeriği arayan kişi PDF'e mi, sayfaya mı inmeli? Cevap sayfaysa PDF için kanonik sinyali HTML sayfayı göstermelidir. Kanonik etiketinin mantığını kanonik etiketi rehberimizden hatırlayabilirsiniz.
Kanonik HTTP üstbilgisi PDF için ne yapar ve neyi garanti etmez?
PDF dosyasının içine HTML etiketi koyamazsınız. Bu yüzden kanonik sinyali, sunucunun PDF yanıtıyla birlikte gönderdiği bir HTTP üstbilgisi taşır. Google'ın yinelenen adresleri birleştirme belgesi bu yöntemi açıkça destekler: PDF ya da Word gibi birçok biçimde, her biri kendi adresinde yayın yapıyorsanız kanonik adresi bir HTTP üstbilgisiyle bildirebilirsiniz.
Aynı belge iki sınırı da belirtir. Google bu yöntemi yalnızca web arama sonuçları için destekler. Ayrıca belgedeki örnek, bir Word dosyasının PDF sürümünü kanonik göstermesidir. PDF'in HTML sayfayı göstermesi de aynı mantıkla çalışır; ancak kanonik bir ipucudur, emir değildir. Son kararı Google verir.
Üstbilgiyi eklemek sunucu ayarı ister. Biz burada kod vermiyoruz; geliştiricinize ya da sunucu yöneticinize "PDF yanıtlarına kanonik üstbilgi eklenebilir mi?" diye sorun. Kanonik sorunlarını izleme yöntemini kanonik hataları yazımızda bulursunuz.
PDF SEO açısından PDF mi HTML sayfa mı daha doğru?
Aşağıdaki tablo, iki biçimi SEO ve kullanıcı açısından karşılaştırır. Bu, saha tecrübemize dayalı genel bir değerlendirmedir; her işletmenin durumu farklıdır.
| Ölçüt | HTML sayfa | PDF dosyası |
|---|---|---|
| --- | --- | --- |
| Site menüsü ve iç bağlantılar | Var | Yok |
| Ölçüm ve dönüşüm alanı | Kurulabilir | Sınırlı |
| Mobilde okunabilirlik | Genelde iyi | Cihaza göre değişir |
| Yazdırma ve çevrimdışı saklama | Zayıf | Güçlü |
| Metin güncelleme kolaylığı | Yüksek | Dosyayı yeniden üretmek gerekir |
| Başlık kontrolü | Sayfa başlığı ile | Dosya meta verisi ve bağlantı metni ile |
| Kanonik sinyali | Sayfanın içinde | HTTP üstbilgisi ile |
PDF SEO kararını bu tabloyla verirken önceliğinizi netleştirin. Özetle, okunması ve dönüşümü önemli içeriği HTML yapın. Yazdırılacak, imzalanacak ya da arşivlenecek içeriği PDF olarak sunun ve HTML sayfadan bağlayın.
İstenmeyen bir PDF Google'da görünüyorsa önce ne yapmalısınız?
Önce sakin olun ve nedenini ayırın. İki farklı durum var: PDF'in sıralanmasını istemiyorsunuz ya da PDF'te olmaması gereken bir bilgi var. İkincisi daha acildir.
- PDF'in gerçekten dizinde olduğunu doğrulayın. Google'da "site:example.com filetype:pdf" aramasını deneyin.
- Dosyada gizli ya da kişisel bilgi var mı bakın. Varsa önce dosyayı sunucudan kaldırın ve aşağıdaki "hassas bilgi" bölümüne geçin.
- Dosya yayında kalacaksa, dizine girmesini engelleyen bir kural seçin: HTTP üstbilgisiyle noindex ya da dosyayı kaldırmak.
- Robots.txt ile engellemeyin; nedenini sonraki bölümde anlatıyoruz.
- Değişikliğin Google'a ulaşmasını bekleyin ve sonucu yeniden kontrol edin.
Her adımdan sonra sonucu not alın; böylece hangi değişikliğin işe yaradığını görürsünüz. Ekiplerin en sık yaptığı hata, aynı anda birden fazla şeyi değiştirip hangisinin etkili olduğunu bilememektir.
Hiçbir yöntem anında sonuç garantisi vermez. Google'ın dosyayı yeniden taraması gerekir.
X-Robots-Tag ile PDF dizinden nasıl çıkarılır?
PDF içine noindex etiketi koyamadığınız için Google, X-Robots-Tag adlı HTTP yanıt üstbilgisini önerir. Google'ın robots meta belgesi, HTML olmayan kaynakları (PDF, video, görsel) dizinden hariç tutmak için bu üstbilgiyi kullanmanızı söyler.
Mantık şöyle işler: Sunucu PDF'i gönderirken yanıta "bu dosyayı dizine ekleme" anlamına gelen bir noindex kuralı ekler. Google dosyayı tarar, üstbilgiyi okur ve dosyayı dizinden düşürür. Kuralı tek tek dosyalara ya da tüm PDF'lere uygulayabilirsiniz; bunun ayrıntısı sunucu yazılımınıza bağlıdır.
Aynı belge, belirli bir tarihten sonra sonuçlardan çıkarmak için bir "unavailable_after" kuralından da söz eder. Süreli kampanya kataloglarında işe yarayabilir. Ancak bu kuralın tarihini ve davranışını resmi robots belgesinden kontrol edin.
Noindex kavramının kendisini noindex yazımızda anlattık; burada tekrar etmiyoruz.
Robots.txt PDF'i dizinden çıkarır mı?
Hayır, çoğu zaman çıkarmaz. Robots.txt taramayı engeller, dizine eklemeyi değil. Google, adresi başka sayfalardaki bağlantılardan öğrenirse içeriği okuyamasa bile adresi dizinde tutabilir.
Daha önemli bir tuzak var: Noindex kuralının işlemesi için Google'ın dosyayı tarayabilmesi gerekir. Robots.txt PDF'i engellerse Google, X-Robots-Tag üstbilgisini hiç göremez. Yani hem robots.txt ile engelleyip hem noindex üstbilgisi eklemek çelişkili bir ikilidir.
Bu nedenle sıra şöyle olmalı: Önce PDF'in taranabilir kalmasını sağlayın, noindex üstbilgisini ekleyin, Google dizinden düşürene kadar bekleyin. İsterseniz sonra robots.txt kuralı ekleyebilirsiniz. Farkı ayrıntılı görmek için noindex ile nofollow karşılaştırmasına bakın.
Hassas bilgi içeren PDF'i Google'dan nasıl kaldırırsınız?
Bu bölüm hukuki danışmanlık değildir; kişisel veri içeren dosyalarda hukuk danışmanınıza başvurun. Teknik olarak Google'ın gizli bilgiyi Google'dan uzak tutma belgesi dört adım önerir.
- Canlı belgeyi yayınlandığı yerden kaldırın.
- Doğrulanmış siteniz için Removals tool (Search Console'daki kaldırma aracı) ile ilgili adresleri aramadan kaldırın.
- Düzeltilmiş belgeyi farklı bir adreste yayınlayın.
- Başka sitelerde kopyaları varsa onlardan kaldırma isteyin.
Kaldırma aracı geçici bir önlemdir. Kalıcı çözüm, dosyayı sunucudan silmek ya da erişimi kapatmaktır. Aynı belge, PDF gibi biçimlerde değişiklik geçmişinin ve görünmeyen meta verinin kalabileceğini de belirtir. Yani karartılmış bir bölümün altında eski metni fark etmeden bırakmış olabilirsiniz. Bu nedenle belgeyi yeniden dışa aktarın.
PDF içindeki bağlantılar SEO'ya etki eder mi?
PDF içindeki bağlantılar kullanıcı için değerlidir: okuyucuyu ilgili sayfaya, forma ya da fiyat bölümüne götürür. SEO etkisine gelince, Google'ın resmi belgelerinde PDF içi bağlantıların nasıl değerlendirildiğine dair açık bir ifade bulamadık. Bu yüzden kesin bir iddiada bulunmuyoruz.
Elimizdeki güvenli yaklaşım şöyle: PDF içinde mutlaka tam adresli, açıklayıcı bağlantılar kullanın. Bağlantı metni "tıklayın" yerine hedefi anlatsın. Böylece okuyucu da, dosyayı ayrıştıran sistemler de bağlantının nereye gittiğini anlar.
Ayrıca ölçüm tarafını düşünün. PDF içindeki bir bağlantıya tıklandığında sitenizdeki sayfa ölçüm araçlarınız devreye girer. Bunun için hedef sayfaya UTM gibi etiketler ekleyebilirsiniz. Yazı yazarken etiketleri düzenli üretmek için UTM oluşturucumuzu kullanabilirsiniz.
PDF'e veren bağlantı metni neden önemlidir?
Başlık sinyallerinden biri PDF'e veren bağlantıların metnidir. Siz sitenizde "Rapor", "İndir" ya da "Tıklayın" yazarsanız, Google'a PDF hakkında pek bir şey söylemezsiniz. "Tedarikçi seçim kontrol listesi (PDF)" gibi bir metin ise hem insana hem arama motoruna net bilgi verir.
PDF'e veren her iç bağlantıyı gözden geçirin. Menülerde, blog yazılarında ve ürün sayfalarında aynı PDF'e farklı metinlerle bağlanıyorsanız, bunları tutarlı hale getirin. Ayrıntılar için bağlantı metni rehberimize bakın.
Ayrıca PDF'e giden bağlantıyı açıkça belirtin; kullanıcı beklemediği bir dosya indirmesin. Metne "(PDF)" eklemek ve mümkünse dosya boyutunu yazmak iyi bir alışkanlıktır.
PDF dosya adı ve URL adresi nasıl seçilir, kampanya PDF'leri aynı adreste mi kalmalı?
PDF adresi, dosyanın ilk izlenimidir. "scan0042final2.pdf" gibi bir ad hiçbir şey anlatmaz; "tedarikci-secim-kontrol-listesi.pdf" ise konuyu söyler. Küçük harf, tire ve Türkçe karaktersiz yazım güvenli bir tercihtir.
Adreste yıl, sürüm ya da "son" gibi eklerden kaçının. Çünkü içeriği her güncellediğinizde adresi değiştirirseniz, bağlantı geçmişini ve dizin kaydını da sıfırlama riskine girersiniz. Dosyayı aynı adreste güncellemek çoğu durumda daha sağlıklıdır. Ayrıca kısa adresler paylaşırken de daha rahat kullanırsınız.
Adres yazım kuralları için URL slug rehberimizi, hızlı üretim için slug oluşturucu aracımızı kullanabilirsiniz.
Kampanya ve katalog PDF'lerinde de aynı ilke geçerlidir: Çoğu durumda adresi sabit tutun. Sezonluk bir katalog ya da kampanya PDF'i her dönem yeni bir adresle yayınlanırsa, önceki adresin biriktirdiği bağlantılar ve dizin geçmişi boşa gider. Eski adres açık kalır, yeni adres sıfırdan başlar.
Daha iyi yaklaşım: Güncel PDF'i sabit bir adreste tutun, eski sürümleri gerektiğinde arşiv sayfasında ayrı adreslerle saklayın. Eski sürümün sıralanmasını istemiyorsanız noindex ya da kanonik üstbilgi kullanın.
Bu tür dosyalar için ayrı bir arşiv bölümü öneriyoruz. Böylece güncel sürüm net kalır, eski sürümü isteyen okuyucu da arşive ulaşır.
Aynı mantığın sayfa tarafını kampanya sayfası adresleri yazımızda ele aldık. PDF için de ilke aynıdır: Adres değişikliğini zorunlu olmadıkça yapmayın.
PDF dosyalarının performansını nasıl izlersiniz?
PDF'lerin kendisinde sayfa takip kodu çalıştıramazsınız. Bu yüzden ölçümü dolaylı yoldan kurarsınız. Bu yaklaşım ilk başta eksik görünebilir. Ancak pratikte işinizi görür. Önce hangi PDF'lerin dizinde olduğunu "site:" ve "filetype:" aramasıyla görün. Sonra Search Console'da PDF adresini URL inceleme aracıyla (URL Inspection) kontrol edin; aracın adı arayüzde değişebilir.
İkinci adımda bağlantılara bakın: PDF'e hangi sayfalar bağlanıyor, tıklamalar hangi sayfadan geliyor? Bunun için sayfadaki indirme bağlantısına olay ölçümü ekleyin. Böylece indirme sayısını bir sayfa bağlamında görürsünüz.
Dizin taramasını toplu görmek için Search Console rehberimizden yararlanın. Dizinde gereksiz çok sayıda PDF birikmişse, dizin şişmesi yazımız sizi ilgilendirir.
PDF SEO'da dosya dizine girmiyorsa nedenleri neler olabilir?
Bir PDF'in dizinde görünmemesinin birkaç yaygın nedeni vardır. Hepsi Google'ın bir dosyayı bulup okuyabilmesiyle ilgilidir. Aşağıdaki liste, ekibimizin ilk baktığı noktaları sıralar.
- Dosyaya hiçbir sayfa bağlanmıyordur; Google dosyayı keşfedemez.
- Robots.txt dosyası PDF'in bulunduğu klasörü engelliyordur.
- Dosya bir oturum açma ya da form duvarının arkasındadır.
- Sunucu dosyayı yanlış türle sunuyordur ya da hata kodu döndürüyordur.
- Dosyaya noindex üstbilgisi eklenmiştir ve unutulmuştur.
Bunlardan sunucu kaynaklı olanları, geliştiricinizle birlikte kontrol edin. Dizin raporlarını okumayı dizinlenmeyen sayfaları tespit etme yazımızda anlattık. PDF'ler için de aynı mantık geçerlidir.
Form arkasındaki PDF'ler Google'da görünür mü?
Hayır, çoğu zaman görünmez; çünkü Google bir formu doldurup dosyayı indirmez. E-posta karşılığı verilen rehber ya da teknik doküman bu gruba girer. Bu sizin bilinçli tercihinizse sorun yoktur: PDF'in sıralanmasını değil, kayıt toplamayı hedefliyorsunuzdur.
Ancak bir çelişkiye dikkat edin. PDF'in doğrudan adresi başka bir yerde yayınlanmışsa, Google dosyayı yine de bulabilir. Yani form arkasına koyduğunuz dosyanın adresi sızmışsa, aramada görünmesini istemiyorsanız noindex üstbilgisi ekleyin ya da erişimi gerçekten kapatın.
Kayıt toplayan PDF'in tanıtımını HTML sayfada yapın. Sayfada içeriğin kısa bir özetini verin. Okuyucu neyi alacağını anlasın. Bu sayfa sıralanabilir, PDF ise kullanıcıya formdan sonra verdiğiniz bir ödül olur. Böylece SEO ve dönüşüm birbirini engellemez.
PDF SEO ve erişilebilirlik birbirine nasıl bağlanır?
Erişilebilir PDF; okuma sırasını, işaretli başlıkları ve metin katmanını barındıran PDF demektir. Bu özelliklerin Google'ın sıralamasını doğrudan etkilediğine dair resmi bir ifade bulamadık; bu nedenle bunu bir sıralama vaadi olarak sunmuyoruz.
Yine de pratik bir yararı var. Metin katmanı olan, düzgün başlıkları bulunan bir PDF hem ekran okuyucu kullanan okuyucular hem de metni ayrıştıran sistemler için daha güvenilir bir kaynaktır. Dolayısıyla erişilebilirlik çalışması, PDF SEO işini de dolaylı olarak destekler.
Bu işi bir kerede bitirmeniz gerekmiyor. Basit bir başlangıç yapın: Kaynak belgede gerçek başlık stillerini kullanın, görsellere açıklama ekleyin ve dışa aktarırken etiketli PDF seçeneğini işaretleyin. Menü adları programa göre değiştiği için kesin yol vermiyoruz.
Aynı PDF birden fazla adreste duruyorsa ne olur?
Aynı dosya hem ana klasörde hem bir kampanya klasöründe, hem de parametreli bir adreste durabilir. Google bunları ayrı adresler olarak görür. Sinyaller dağılıyor, dolayısıyla aramada hangisinin çıkacağı belirsizleşiyor.
Önce kopyaları envanterde bulun. Bunun için site aramasına ve kendi dosya yöneticinize bakın. Ardından tek bir asıl adres seçin; diğerlerini silin, yönlendirin ya da kanonik üstbilgiyle asıl adrese bağlayın. Silme ve yönlendirme en temiz yoldur; üstbilgi ise dosyanın yerinde kalması gerektiğinde işe yarar.
Bu konuyu parametreli adresler açısından URL parametreleri yazımızda işledik. Aynı ilke PDF adresleri için de geçerlidir.
PDF SEO'da en sık yapılan hatalar nelerdir?
Sahada gördüğümüz hatalar şaşırtıcı biçimde tekrar eder. Aşağıdaki liste, yeni bir PDF yayınlarken kaçınmanız gereken beş hatayı toplar. Bunlar saha gözlemimizdir, Google'ın resmi uyarı listesi değildir.
- Dosya adını ve belge başlığını boş ya da anlamsız bırakmak.
- Metin katmanı olmayan taranmış evrakı tek sürüm olarak yayınlamak.
- Aynı içeriği PDF ve HTML olarak, aralarında ilişki kurmadan yayınlamak.
- İstenmeyen PDF'i robots.txt ile engelleyip noindex kuralını okutamamak.
- Eski kampanya dosyalarını silmeden bırakıp dizinde eski fiyatların görünmesine yol açmak.
Bu hataların hepsini küçük bir envanter çalışmasıyla yakalarsınız. Bunun için bir tablo hazırlayın: adres, başlık, metin katmanı var mı, hangi HTML sayfayla ilişkili, dizinde kalacak mı? Dosya sayınız birkaç yüzü geçiyorsa bile bu tablo sizi çok zaman kaybından kurtarır.
Hataların bir kısmı iç bağlantı düzeninden kaynaklanır; konuyu iç linkleme rehberimizde ele aldık.
PDF SEO için yayın öncesi hangi kontrol listesini uygulamalısınız?
Aşağıdaki liste, PDF yayınlamadan önce ekibimizin geçtiği temel kontrolleri toplar. Her madde Google'ın resmi belgelerinden ya da saha pratiğimizden gelir.
- Metin katmanı var mı? Metni seçip kopyalayarak doğrulayın.
- Belge başlığı dolu ve anlamlı mı?
- Kişisel ad, iç not ve gizli bilgi meta veride kalmış mı?
- Dosya adı konuyu anlatıyor mu, yıl ve sürüm eki var mı?
- PDF'e veren bağlantı metinleri açıklayıcı mı?
- Aynı içerik HTML olarak varsa, kanonik sinyal doğru sürümü gösteriyor mu?
- Dizinde olmaması gereken PDF'lere noindex üstbilgisi eklendi mi ve robots.txt ile engellenmedi mi?
- Dosya boyutu makul mü, mobilde rahat açılıyor mu?
Listeyi yazdırıp ekibinizle paylaşın. Yeni bir PDF yayınlayan herkes maddeleri tek tek işaretlesin. Bu listeyi her PDF için tekrarlamak, sonradan yapacağınız temizlikten çok daha ucuzdur.
Ekip olarak PDF SEO denetimini nasıl yaparız?
Talha Aslan ve ekibi olarak PDF denetimine dizindeki dosyaları çıkararak başlarız. Ardından her dosyayı üç gruba ayırırız: sıralanmasını istediklerimiz, HTML sayfaya yönlendirmek istediklerimiz ve dizinden çıkarmamız gerekenler. Sonuçları örnek bir tabloyla sunarız; rakam uydurmayız, garanti vermeyiz.
Teknik üstbilgi ayarlarını sunucu yöneticinizle birlikte planlarız, çünkü sunucu işletmesi bizim işimiz değildir. Genel SEO denetimi gerekiyorsa SEO danışmanlığı hizmetimize bakabilirsiniz. Hızlı bir ön kontrol için SEO analiz aracımızı ve arama sonucu görünümünü denemek için SERP önizleme aracımızı kullanabilirsiniz.



