#
llms.txt
llms.txt, site kök dizinine yerleştirilen ve yapay zeka sistemlerine hangi sayfaların en önemli olduğunu ve sitenin nasıl organize edildiğini anlatan, öneri aşamasındaki düz metin dosyasıdır. Erişimi denetleyen robots.txt dosyasının aksine llms.txt, dil modelleri için öncelikli içeriği derler. Benimsenme henüz erken ama artıyor; dosyayı yayınlamak düşük maliyetli bir hazırlık sinyalidir.
#
Yapay Zeka Botları için robots.txt
Yapay zeka botları için robots.txt, GPTBot, ClaudeBot ve PerplexityBot gibi yapay zeka tarayıcılarına user-agent kurallarıyla izin verme veya onları engelleme pratiğidir. Engellemek siteyi eğitimden ve canlı getirmeden çıkarır; izin vermek atıfların önünü açar. Her motor kendi user-agent adlarını yayınlar, bu yüzden kurallar bot bazında güncel tutulmalıdır.
#
GPTBot
GPTBot, OpenAI tarafından model eğitimi için içerik toplamak amacıyla çalıştırılan web tarayıcısıdır; ChatGPT için canlı arama getirmelerini ise ilişkili ajanlar yapar. Site sahipleri GPTBot erişimini robots.txt user-agent kurallarıyla yönetir. GPTBot iznini vermek, içerik koruması ile ChatGPT cevaplarındaki görünürlük arasında stratejik bir tercihtir.
#
Yapay Zeka Tarayıcıları (AI Crawlers)
Yapay zeka tarayıcıları, yapay zeka sistemleri için web içeriği çeken botlardır: OpenAI için GPTBot ve OAI-SearchBot, Anthropic için ClaudeBot, Perplexity için PerplexityBot, Gemini eğitimi için Google-Extended. Eğitim tarayıcıları ve canlı getirme botları olarak ikiye ayrılırlar; hangilerinin siteyi gerçekten ve hangi sıklıkla ziyaret ettiğini sunucu logları gösterir.
#
Yapılandırılmış Veri (Structured Data)
Yapılandırılmış veri, bir sayfadaki varlıkları ve olguları etiketleyen makine tarafından okunabilir işaretlemedir; en yaygın biçimi Schema.org sözlüğünü kullanan JSON-LD formatıdır. Kimin yazdığını, neyi anlattığını, ne zaman değiştiğini belirtir. Yapılandırılmış veri, arama motorları ve yapay zeka sistemleri için tahmin payını ortadan kaldırır; zengin sonuç uygunluğunu ve doğru atıfları güçlendirir.
#
JSON-LD
JSON-LD (bağlı veri için JavaScript nesne gösterimi), yapılandırılmış veriyi sayfaya gömmek için önerilen formattır: görünür HTML kodundan ayrı bir script bloğu içinde varlıkları ve ilişkilerini tanımlar. Google, yazması, doğrulaması ve bakımı daha kolay olduğu için JSON-LD formatını microdata ve RDFa yerine açıkça tercih eder.
#
Schema.org
Schema.org; Google, Microsoft, Yahoo ve Yandex tarafından kurulan ve yapılandırılmış veride kullanılan tür ile özellikleri tanımlayan ortak sözlüktür: Article, Person, Organization, FAQPage, Product ve yüzlerce diğer tür. Bir sayfanın, makinelerin güvenebileceği olguları ifade etmek için kullandığı ortak dildir.
#
JSON-LD @graph Yöntemi
@graph yöntemi, bir sayfadaki tüm yapılandırılmış veriyi her varlığın @id taşıdığı ve varlıkların birbirine referans verdiği tek bir JSON-LD bloğunda birleştirir: WebPage yazarına, yazar Organization varlığına bağlanır. Bağlantılı graflar, sayfaya dağılmış izole schema parçalarına göre varlıkları çok daha güvenilir biçimde çözümler.
#
FAQPage Şeması
FAQPage şeması, bir sayfadaki soru-cevap çiftlerini işaretleyen yapılandırılmış veridir. Google, SSS zengin sonuçlarını artık yalnızca dar bir otoriter site kümesine gösterir; ancak işaretleme AEO için değerini korur: cevap motorlarına, kullanıcıların sorgu biçimiyle örtüşen, önceden paketlenmiş ve çıkarılabilir soru-cevap birimleri sunar.
#
HowTo Şeması
HowTo şeması; adımları, sıralarını, gereken araçları ve tahmini süreyi tanımlayan, adım adım talimatlara özel yapılandırılmış veridir. Google, HowTo zengin sonuçlarını 2023 yılında kaldırdı; yine de bu işaretleme, yapay zeka sistemlerinin süreç içeriğini temiz ve sıralı adımlara ayrıştırmasına yardım eder. Asistanlar nasıl-yapılır sorularını yanıtlarken bu formatı yeniden kullanır.
#
Speakable İşaretlemesi
Speakable işaretlemesi, bir sayfada sesli okumaya en uygun pasajları gösteren yapılandırılmış veridir (SpeakableSpecification): asistanın sesli okuyabileceği kısa ve kendi başına yeterli özetler. Destek sınırlı ve haber odaklıdır; ancak dayattığı disiplin — kısa ve çıkarılabilir bloklar yazmak — her cevap yüzeyine fayda sağlar.
#
Kanonik URL
Kanonik URL, kopyalar veya varyantlar bulunduğunda bir sayfanın yetkili sürümü olarak bildirilen tek adrestir. Tutarlı kanonikler sinyalleri tek URL üzerinde toplar; bu, yapay zeka getirmesi için kritiktir çünkü motorlar tek bir adresi kaynak gösterir ve bölünmüş sinyaller, birbirine karşı yarışan daha zayıf pasajlar demektir.
#
Taranabilirlik (Crawlability)
Taranabilirlik, botların bir sayfayı çekip okuyabilme derecesidir: erişilebilir URL, izin veren robots kuralları, hızlı HTML yanıtı ve JavaScript ile işlenmeye muhtaç olmayan içerik. Yapay zeka araması için kapı koşuludur; erişilemeyen bir sayfa getirilemez, temellendirilemez ve kaynak gösterilemez.