AI erişim kontrolü: yanıtlarda görünür, eğitimde kendi kararınızla.

Sitenize hangi yapay zekâ tarayıcılarının geldiğini günlüklerden çıkarıyor, kimliklerini IP ve DNS ile doğruluyor, robots.txt’den CDN’e kadar kuralları bot bot yazıyoruz. Ölçtüğümüz şey, arama botlarının içeriğe ulaşması, eğitim botlarının sizin kararınıza uyması ve kuralların uygulanması.

Yapay zekâ görünürlüğü içinGEO Danışmanlığı
1Sunucu günlüğünde istekOAI-SearchBot/1.4 · GET /fiyatlar
2IP ve DNS kontrolüIP, OpenAI’ın searchbot.json listesinde; istek gerçek.Doğrulandı
3markaniz.com › fiyatlarMarkanız | Fiyatlar · 200 OK
  • TV8
  • Hesap.com.tr
  • ikas
  • DoktorSitesi
  • Acıbadem
  • Sina Pırlanta
  • Multinet Up
  • Türkiye İş Bankası
  • İstikbal
  • Microsoft
  • Mastercard
  • Vitabiotics
  • Sabancı Holding
  • Memorial
  • Logo Yazılım
  • Opet
  • Duru
  • Interesting Engineering
  • Webtekno
  • Western Union
  • Zen Pırlanta
  • Sopyo
  • Bahçeşehir Üniversitesi
  • Madame Coco
  • Hairtec
  • Haliç Üniversitesi
  • Liv Hospital
  • Üsküdar Üniversitesi
  • Scooter
  • Kentkart

AI erişim kontrolü üç katmanda kurulur.

Tarayıcı envanteri

Hangi botun sitenize ne sıklıkla, hangi yollara geldiğini tahminle değil, günlükteki doğrulanmış isteklerle çıkarıyoruz.

Günlük çıkarımı

Sunucu ve CDN günlüklerinden bot isteklerini, istenen yolları ve durum kodlarını birlikte ayıklıyoruz.

User-agent ayrımı

İstekleri ürün adına göre arama, kullanıcı adına getirme ve model eğitimi olarak sınıflandırıyoruz.

IP ve DNS doğrulama

Beyan edilen adı sağlayıcının yayımladığı IP listesiyle ya da ters ve ileri DNS kontrolüyle doğruluyoruz.

Taklit ve yük

Kendini bilinen bot gibi tanıtan ama doğrulanmayan istekleri ve sunucuya yük bindiren taramaları ayrı raporluyoruz.

Kural yazımı

Her bota amacına göre ayrı kural yazıyor, robots.txt kararını sayfa başlıkları ve CDN kurallarıyla tutarlı hâle getiriyoruz.

robots.txt, bot bot

Arama, kullanıcı ve eğitim botları için ayrı gruplar yazıyor; yıldızlı grubun hangi botlara uygulanmadığını test ediyoruz.

Google-Extended

Gemini eğitimi ve grounding tercihini, Arama’yı etkilemeyen bu denetim adıyla ayrıca belirliyoruz.

Meta robots ve X-Robots-Tag

Sayfa, PDF ve görsel düzeyinde noindex, nosnippet ve max-snippet kurallarını HTML ya da HTTP başlığıyla veriyoruz.

CDN kuralları

Kurala uymayan ya da kimliği doğrulanmayan botları CDN’de, robots.txt ve llms.txt adreslerini açık bırakarak durduruyoruz.

llms.txt ve izleme

Dil modellerine sitenin kısa haritasını veriyor, kuralların etkisini günlükte izleyip yeni botlar geldikçe güncelliyoruz.

llms.txt taslağı

Sitenin özetini ve önemli sayfalarını llmstxt.org önerisindeki Markdown biçimiyle kök dizine yazıyoruz.

Site haritası

Site haritasını robots.txt’de bildiriyor, llms.txt’deki bağlantılarla tutarlı ve güncel tutuyoruz.

Günlük izleme

Kural değişikliğinden sonra botların davranışını günlükte izliyor, kurala uymayan istekleri raporluyoruz.

Yeni botlar

Sağlayıcılar yeni bot ya da ürün adı duyurdukça envanteri ve kuralları kaynaktan doğrulayıp güncelliyoruz.

Bir bot isteği nasıl karşılanır?

Sitenize gelen her yapay zekâ isteği bir ad beyanıyla başlar; bu ad, IP adresi ve DNS kaydıyla doğrulanmadan kimlik sayılmaz. Doğrulanan bot kendi robots.txt grubuna ve CDN kuralına göre içeriği alır ya da durdurulur, her adım günlüğe yazılır.

24 saatrobots.txt değişikliği anında yansımaz; RFC 9309’a göre tarayıcı önbellekteki kopyayı 24 saate kadar kullanabilir.8

3 türGoogle isteklerini üçe ayırır; kullanıcı tetiklemeli getiriciler, kullanıcı istediği için robots.txt’yi yok sayar.7

robots.txt’nizi bot bot kurun

İşareti kaldırdığınız bot, belirttiğiniz yoldan uzak tutulur. Kural bir istektir: resmî botlar uyar, kullanıcı isteğiyle gelen ziyaretçiler her zaman uymayabilir; hassas içerik erişim denetimiyle korunur.

Arama ve yanıt
Model eğitimi
Kullanıcı isteğiyle
robots.txt

        Googlebot’a dokunulmaz: kapatmak sayfalarınızı Google Arama’dan ve yapay zekâ özetinden de çıkarır. llms.txt için ücretsiz AI görünürlük analizimiz sitenize göre taslak üretir.
        

AI erişim kontrolü adım adım.

  1. 01

    Tanışma

    Sitenizi, içeriğinizin yapay zekâ yanıtlarındaki yerini ve eğitim ile tarama yükü konusundaki tercihlerinizi dinliyor, kapsamı birlikte belirliyoruz.

  2. 02

    Günlük ve kural denetimi

    Sunucu ve CDN günlüklerinden bot envanterini çıkarıyor, kimlikleri doğruluyor ve mevcut robots.txt, meta robots ve CDN kurallarını yazılı raporluyoruz.

  3. 03

    Karar tablosu

    Her bot için izin, kısıt ya da engel kararını gerekçesiyle birlikte sizinle yazıyor, eğitim tercihini ve korunacak yolları netleştiriyoruz.

  4. 04

    Kurulum

    robots.txt’yi bot bot yazıyor, gereken sayfa ve dosyalara meta robots ya da X-Robots-Tag ekliyor, CDN kurallarını kurup llms.txt’yi yayına alıyoruz.

  5. 05

    İzleme ve güncelleme

    Günlükleri düzenli okuyor, kurala uymayan istekleri raporluyor, sağlayıcılar yeni bot duyurdukça kuralları güncelliyoruz.

Çalıştığımız platformlar ve araçlar.

Google Data Studio perspektif analiz.

markentionData StudioSina Pırlanta22 Jun – 19 Sep 2026 ▾

Overview

Clicks400K▲ 28%prev. 312K
Impressions4.0M▲ 22%prev. 3.28M
URL CTR10.0%▲ 0.4 ptprev. 9.6%
Avg. Position8.0▼ 3.0prev. 11.0
Unique Queries24.8K▲ 19%prev. 20.8K
Unique Pages6.2K▲ 7%prev. 5.8K
Performance over TimeUrl Clicks (last 90 days)previous 90 daysJulAugSep
veriler temsilidir.
Sayfaları çevirmek için tıklayın

Pano, Search Console ve Analytics verisini aynı anda çeker. Filtreleri projenin hedeflerine göre güncelliyor, dönüşüm adımının tipine göre yeni ekran kuruyoruz.

Google’ın kendi arayüzünde bulunmayan filtrelerle ekran kuruyoruz. Sorgularınızı ilk 3, 4–10, 10–20 ve 20+ pozisyon gruplarında ayrı ayrı izliyoruz.

Anahtar kelimeleri kümelere ayırıyor, projenin yalnız o kelime öbeğinden aldığı trafiği bir bütün olarak ele alıyoruz. Bir e-ticaret sitesinin çanta ve ayakkabı kümesini aynı ekranda, arama niyetine göre geçen dönemle karşılaştırabiliyoruz; başarıyı böyle daha verimli ölçüyoruz.

Organik büyümeyi sağlıklı raporlamak için trafiği markalı ve markasız aramalar olarak ikiye ayırıyoruz. Markasız trafiği ayrıca analiz ediyoruz; SEO çalışmasının etkisi en net orada görünür.

Bu kadar filtre kayıpları da gösterir: 310 ekranın hepsi yeşil vermez. Aynı ekranlar güncellemelerin yarattığı depremleri de ortaya çıkarır; potansiyeli kurtarma çalışmasına buradan başlıyoruz.

Her kelimeyi tek tek izliyoruz: gösterim, tıklama, CTR ve konum aynı satırda. Konumu yükselip tıklaması artmayan kelimelerde başlık ve açıklama çalışması açıyoruz.

Trafiğin hangi şehirden geldiğini ayrı bir ekranda tutuyoruz. Mağazası olan markalarda şehir kırılımı, bütçenin ve içeriğin nereye gideceğini belirliyor.

Geçen yılın aynı dönemiyle karşılaştırıyoruz: mevsimsellik mi, gerçek büyüme mi. Önceki 90 gün iyi görünen bir ekran, geçen yıla göre yerinde sayıyor olabilir.

25
ekran
310
bağımsız veri tipi
7/24
telefon ve bilgisayar
Search Console ve Analytics
Search Console + Analytics

AI erişim kontrolü nasıl işler?

İçindekiler 10 başlık

Bu rehberi, içeriğinin yapay zekâ yanıtlarında kaynak olarak görünmesini isteyen ama sitesine hangi botun neden geldiğini ve yazdığı kuralların uygulanıp uygulanmadığını net göremeyen yayıncılar, e-ticaret ve kurumsal site ekipleri için yazdık. Anlattığımız her kural IETF’in robots.txt standardına; Google, OpenAI, Anthropic, Perplexity ve Common Crawl’un bot belgelerine, llmstxt.org önerisine ve Cloudflare belgelerine dayanıyor. Bot adlarını Eylül 2026 itibarıyla kaynaktan doğruladık; sağlayıcılar listelerini sık güncellediği için kurulumda yeniden kontrol ediyoruz. Kendi saha gözlemlerimizi “Uzman notu” başlığıyla ayrı işaretledik.

AI erişim kontrolünde işimiz üç katmanda ilerler: tarayıcı envanterini günlüklerden çıkarıp kimlikleri doğrulamak, her bot için robots.txt’den CDN’e kadar kuralları yazmak, llms.txt’yi kurup erişimi izlemek. Bu sayfa, GEO danışmanlığının teknik erişim katmanını derinleştirir.

AI erişim kontrolü neyi çözer?

AI erişim kontrolü, sizi yapay zekâ yanıtlarına taşıyan botların içeriğinizi okuyabilmesini, model eğitimi için veri toplayan botlarınsa sizin kararınıza göre çalışmasını sağlar. Siteye gelen yapay zekâ trafiği tek bir “AI botu” değildir; sağlayıcılar botlarını amaçlarına göre ayırıyor ve her birine robots.txt’de ayrı bir ad veriyor. OpenAI, ChatGPT araması için OAI-SearchBot’u, model eğitimi için GPTBot’u ayrı yönetiyor ve bu ayarların bağımsız olduğunu, OAI-SearchBot’a izin verip GPTBot’u engelleyebileceğinizi yazıyor.1 Anthropic’in ClaudeBot, Claude-SearchBot ve Claude-User ayrımı da aynı mantıktadır.2

Bu ayrım bir karar alanı açar. Yayıncı, yanıtlarda anılmak isteyip eğitim kullanımını kısıtlayabilir; e-ticaret sitesi ürün sayfalarını yapay zekâ aramalarına açıp sepet ve hesap sayfalarını bütün botlara kapatır; kurumsal site tarama yükünü denetlemek ister. Çözüm hiçbirinde “hepsini aç” ya da “hepsini kapat” değildir; kural bot bot, amaç amaç yazılır.

Yapay zekâ tarayıcıları hangi amaçlarla gelir?

Yapay zekâ tarayıcıları üç amaçla gelir: arama dizini kurmak, bir kullanıcının sorusu için anlık sayfa getirmek ve model eğitimi için veri toplamak. Bu grupların robots.txt’ye tutumu farklıdır; tablo, günlüklerde en sık gördüğümüz ürün adlarını sağlayıcıların kendi tanımlarıyla özetler.

Ürün adı (token) Ne için gelir robots.txt’ye tutumu
Googlebot Google Arama; yapay zekâ özeti ve modu Arama’nın parçasıdır3 Otomatik taramada her zaman uyar4
Google-Extended Ayrı bot değil; Gemini eğitimi ve grounding için denetim adı4 Yalnız robots.txt’de okunur
OAI-SearchBot ChatGPT aramasında siteleri göstermek Engelleyen site ChatGPT arama yanıtlarında gösterilmez1
GPTBot OpenAI’ın temel model eğitimi Engellemek, eğitimde kullanılmama tercihini bildirir1
ChatGPT-User Kullanıcının ChatGPT’de başlattığı eylemler robots.txt uygulanmayabilir1
ClaudeBot Anthropic modellerinin eğitimi Uyar; standart dışı Crawl-delay’i de destekler2
Claude-SearchBot / Claude-User Claude’un arama sonuçları; kullanıcı isteğiyle sayfa getirme Uyar2
PerplexityBot Perplexity arama sonuçları; model eğitiminde kullanılmaz robots.txt ile yönetilir5
Perplexity-User Kullanıcının sorusu için sayfa ziyareti Genellikle yok sayar5
CCBot Common Crawl’un herkese açık tarama arşivi “User-agent: CCBot” ile engellenir6

En önemli ayrım, kullanıcı adına gelen getiricilerdir. Google da isteklerini üçe ayırıyor: robots.txt’ye her zaman uyan ortak tarayıcılar, uyup uymaması işleve göre değişen özel tarayıcılar ve kullanıcı istediği için robots.txt’yi yok sayan kullanıcı tetiklemeli getiriciler.7 OpenAI, ChatGPT-User’ın otomatik tarama yapmadığını ve Arama’da görünmeyi belirlemediğini ayrıca belirtiyor.1 Bu yüzden kullanıcı adına gelen trafiği ayrı bir satırda ölçüyoruz. Reklam verenler için bir bot daha var: OAI-AdsBot yalnız ChatGPT’de reklam olarak gönderilen açılış sayfalarını politika uyumu için ziyaret eder ve topladığı veri eğitimde kullanılmaz;1 ayrıntısı ChatGPT Ads danışmanlığı sayfamızda.

Sunucu günlüğünden bot envanteri nasıl çıkarılır?

Bot envanteri, sunucu ve CDN günlüklerinde her isteğin user-agent’ını, IP adresini, istenen yolu ve durum kodunu birlikte okuyarak çıkarılır. RFC 9309’a göre tarayıcı robots.txt’de kendini bir ürün adıyla (product token) tanıtır ve bu adın isteğin User-Agent başlığında da geçmesi beklenir;8 günlükte aradığımız şey tam dizge değil, bu addır. Google, dizgelerdeki Chrome sürüm numarası değiştiği için aramada sürüm yerine joker karakter kullanılmasını öneriyor.4 OpenAI ise robots.txt isteklerinde user-agent’a “robots.txt” işareti ekleyebildiğini yazıyor;1 bu işaret, yol tutmayan günlüklerde robots.txt okumalarını ayırmayı kolaylaştırır.

Gruplamadan sonra her bot için dört soruya bakıyoruz: hangi yolları istiyor, ne sıklıkla geliyor, hangi durum kodunu alıyor, kapattığımız yollara istek gönderiyor mu. Arama botlarının ürün sayfalarına ulaşıp ulaşmadığı ve eğitim botlarının sunucuya bindirdiği yük bu tablodan okunur. OpenAI, iki bota da izin veren sitelerde tek bir taramanın sonucunu iki amaç için kullanabildiğini yazıyor;1 istek sayıları bu yüzden amaçların payını birebir göstermez.

Bir botun gerçekten o bot olduğu nasıl doğrulanır?

Bir botun kimliği user-agent dizgesiyle değil, isteğin geldiği IP adresinin sağlayıcının yayımladığı listede ya da doğru alan adında olmasıyla doğrulanır. Google, HTTP user-agent dizgesinin taklit edilebileceğini yazıyor;4 Common Crawl da kendini CCBot diye tanıtan sahte tarayıcılar konusunda uyarıyor.6 Doğrulama sırası:

  1. Ters DNS: günlükteki IP için ters DNS sorgusu yapılır; Google tarayıcılarında ad googlebot.com, google.com ya da googleusercontent.com ile bitmelidir.7 Common Crawl’da IPv4 adreslerinin ters DNS adı crawl.commoncrawl.org ile biter.6
  2. İleri DNS: dönen ad için ileri sorgu yapılır, sonucun günlükteki IP ile aynı olduğu kontrol edilir.7
  3. IP listeleri: yüksek hacimde sağlayıcıların JSON listeleri kullanılır: Google’ın common-crawlers.json ve getirici listeleri,7 OpenAI’ın searchbot.json, gptbot.json ve chatgpt-user.json dosyaları,1 Anthropic’in bots.json listesi,2 Perplexity’nin iki listesi5 ve Common Crawl’un ccbot.json dosyası.6
  4. Karar: ad ile IP tutuyorsa istek doğrulanmıştır; ad bilinen bir botu söylüyor ama IP listede değilse istek taklit olarak ayrı raporlanır.
Ad beyandır, kimlik değildir

Perplexity, botlarına güvenlik duvarında (WAF) izin verirken user-agent eşleşmesiyle IP doğrulamasının birlikte kullanılmasını öneriyor.5 Aynı ilkeyi engellemede de uyguluyoruz: kendini GPTBot diye tanıtan her isteği GPTBot saymıyoruz. Aksi hâlde taklit trafik gerçek botun davranışı gibi raporlanır ve kural yanlış bota yazılır.

robots.txt kuralları bot bot nasıl yazılır?

robots.txt’de her bot kendi ürün adına uyan grubun kurallarına uyar; kendi grubu yoksa yıldızlı (*) gruba, o da yoksa hiçbir kurala bağlı değildir.8 Ad eşleşmesi büyük/küçük harfe duyarsızdır; aynı ada uyan gruplar tek grupta birleştirilir.8 Grup içinde en uzun, yani en özel yol eşleşmesi geçerlidir; eşdeğer bir izin (allow) ile yasak (disallow) çakışırsa izin kazanır.8 Dosya hizmetin kök yolunda /robots.txt adıyla durur;8 her alt alan adı kendi dosyasını ister, Anthropic de engellemenin her alt alan adı için ayrı yapılmasını söylüyor.2

Karar sırası buradan çıkar. Önce arama botlarını açık tutuyoruz; OpenAI, OAI-SearchBot’u engelleyen sitelerin ChatGPT arama yanıtlarında gösterilmediğini, yalnız gezinme bağlantısı olarak görünebildiğini yazıyor.1 Sonra eğitim botları ve Google-Extended için markanın tercihini, en son da sepet, hesap ve site içi arama gibi hiçbir botun taramasına gerek olmayan yolları her gruba ayrı ayrı yazıyoruz.

Grup Yazdığımız kural Neden
Googlebot, OAI-SearchBot, Claude-SearchBot, PerplexityBot İçerik açık; ortak yasak yollar kapalı Arama sonuçlarında ve yapay zekâ yanıtlarında görünürlük
GPTBot, ClaudeBot, CCBot Markanın kararına göre açık, kısmen açık ya da kapalı Model eğitimi ve herkese açık arşiv
Google-Extended Markanın kararına göre Gemini eğitimi ve grounding; Arama’yı etkilemez
Yıldızlı grup (*) Ortak yasak yollar Kendi grubu olmayan bütün botlar

Google-Extended ne yapar, ne yapmaz?

Google-Extended, Google’ın taradığı içeriğin Gemini modellerinin eğitiminde ve grounding’de (yanıt anında Arama dizininden modele içerik verilmesi) kullanılıp kullanılmayacağını belirleyen bir robots.txt denetim adıdır; ayrı bir tarayıcı değildir.4 Kendi user-agent dizgesi yoktur, tarama Google’ın mevcut dizgeleriyle yapılır;4 günlükte “Google-Extended” adlı istek aramak sonuçsuz kalır. Tercih, Gemini uygulamalarını ve Vertex AI’daki Gemini API’yi etkiler.4

Google-Extended Arama’yı etkilemez: Google, bu adın siteyi Arama’ya dahil etmeyi etkilemediğini ve sıralama sinyali olmadığını yazıyor.4 Yapay zekâ özeti ve modu ise Arama’nın parçasıdır; Google burada denetimin Googlebot’a yazılan robots.txt kuralları olduğunu, gösterilecek bilgiyi sınırlamak için nosnippet, data-nosnippet, max-snippet ya da noindex kullanılmasını söylüyor.3 Bir sayfanın yapay zekâ özetinde destek bağlantısı olabilmesi için de dizinde ve snippet ile gösterilmeye uygun olması gerekiyor.3

Yapay zekâ özetinden çıkmak ne demek?

Google-Extended’ı engellemek sayfanızı yapay zekâ özetinden çıkarmaz. İçeriğin yapay zekâ özetine ve moduna doğrudan girdi olmasını istemiyorsanız nosnippet gerekir; bu kural arama sonucundaki metin önizlemesini de kaldırır.9 Bu kararı sayfa bazında, çoğu zaman yalnız belirli bölümler için data-nosnippet ile veriyoruz.

Meta robots ve X-Robots-Tag ne zaman gerekir?

Meta robots ve X-Robots-Tag, robots.txt’nin veremediği sayfa ve dosya düzeyindeki dizine alma ve gösterim kararları için gerekir. Meta etiket HTML sayfasının içinde durur; X-Robots-Tag aynı kuralları HTTP yanıt başlığında taşır ve Google, PDF, görsel ya da video gibi dosyalarda bu başlığın kullanılmasını söylüyor.9 Bot adı verilmeyen kural bütün tarayıcılar için geçerlidir; çelişen kurallarda daha kısıtlayıcı olan uygulanır.9 Bu etiketler URL tarandığında okunur: robots.txt ile taraması engellenen sayfadaki kurallar bulunamaz ve yok sayılır.9 Bir sayfayı hem robots.txt’de kapatıp hem noindex koymak, noindex’in hiç görülmemesi demektir.

Denetim Nerede Ne yapar Sınırı
robots.txt Kök yolda tek dosya Bot bot tarama tercihi Erişim yetkilendirmesi değildir8
Meta robots HTML sayfası Sayfa düzeyinde dizin ve önizleme Sayfa taranmazsa okunmaz
X-Robots-Tag HTTP yanıt başlığı PDF ve öteki dosyalarda aynı kurallar Sunucu ya da CDN ayarı gerekir
CDN kuralı CDN ya da güvenlik duvarı İsteği sunucuya ulaşmadan durdurur Doğrulanmış kimliğe dayanmalıdır

Meta robots ve X-Robots-Tag’i Google ayrıntılı belgeliyor; OpenAI, Anthropic ve Perplexity ise denetimi robots.txt üzerinden tarif ediyor.125 Eğitim tercihini bu yüzden robots.txt’de yazıyoruz.

CDN kuralları robots.txt’nin yetmediği yerde nasıl devreye girer?

CDN kuralları, robots.txt’ye uymayan, kullanıcı adına gelip kuralı yok sayan ya da kimliği doğrulanamayan istekleri sunucuya ulaşmadan durdurmak için devreye girer. RFC 9309, robots.txt kurallarının erişim yetkilendirmesi olmadığını, güvenlik önleminin yerine geçmediğini ve dosyada listelenen yolların herkese açık hâle geldiğini yazıyor.8 Gizli bir yolu robots.txt’ye yazmak onu saklamaz, bulunur kılar.

robots.txt bir ricadır, CDN kuralı bir kapıdır; ikisini birbirinin yerine değil, birlikte kullanıyoruz.

Cloudflare’de bu işi AI Crawl Control yapar: yapay zekâ tarayıcılarını, istek sayılarını ve robots.txt ihlallerini bot bot listeler, her biri için izin ya da engel seçilir.10 Engelleme bir WAF özel kuralı olarak yazılır ve yol bazlı istisnalar eklenebilir; ücretli planlarda bota 403 ya da 402 (ödeme gerekli) yanıtı döndürülebilir, ücretsiz planda tespit kendini user-agent ile tanıtan tarayıcılarla sınırlıdır.10 Cloudflare botları arama, ajan ve eğitim olarak üç davranış sınıfına ayırıyor; ajan sınıfı kullanıcı adına çalışan sohbet getiricilerini ve tarayıcı ajanlarını kapsıyor.11 Cloudflare ayrıca 15 Eylül 2026 için yeni alan adlarında eğitim ve ajan sınıfının reklam gösteren sayfalarda engellendiği, arama botlarının açık kaldığı bir varsayılan duyurdu.11 Yani reklamlı bir yayıncı sayfası, bir asistanın kullanıcı için yaptığı anlık getirmeye de kapanabilir. Google da taramaya robots.txt’nin yanında CDN ve barındırma altyapısında da izin verilmesini öneriyor;3 CDN ayarlarını bu yüzden robots.txt kararlarıyla aynı tabloda tutuyoruz.

llms.txt nedir, ne işe yarar?

llms.txt, bir sitenin dil modellerine ve yapay zekâ ajanlarına kısa bir özet ve önemli sayfalarının bağlantılarını sunmak için kök dizine ya da bir alt yola konan Markdown dosyasıdır.12 Jeremy Howard’ın Eylül 2024’te yayımladığı bir standartlaşma önerisidir; bugün “v2” başlığıyla yayında, son güncellemesi Ağustos 2026.12 Dosya şu sırayla yazılır:12

  • H1 başlık: sitenin adı; tek zorunlu bölüm.
  • Özet alıntı bloğu: dosyanın geri kalanını anlamak için gereken kısa açıklama.
  • Açıklama bölümleri: başlıksız paragraf ve listelerle ayrıntı.
  • H2 dosya listeleri: her satırda bir Markdown bağlantısı ve isteğe bağlı not.
  • “Optional” bölümü: bağlam dar olduğunda atlanabilecek ikincil bağlantılar.

Öneri, bilgi içeren sayfaların aynı adreste .md uzantılı temiz bir sürümünün de yayımlanmasını istiyor.12 robots.txt hangi erişimin kabul edildiğini söyler; llms.txt ise ajan kullanıcıya yardım ederken ihtiyaç duyduğunda okunur. Site haritası dil modeline uygun sürümleri listelemediği ve çoğu zaman bağlama sığmayacak kadar büyük olduğu için bu işi görmez.12

llms.txt bir erişim kuralı değildir

llms.txt hiçbir bota izin vermez ya da yasaklamaz; erişim kararı robots.txt’de ve CDN’de kalır. Google da yapay zekâ özeti ve modunda görünmek için yapay zekâ metin dosyası ya da özel işaretleme gerekmediğini yazıyor.3 llms.txt’yi bu yüzden sıralama aracı olarak değil, ajanların siteyi doğru okumasına yardım eden düşük maliyetli bir özet olarak kuruyoruz.

Dosyayı kurumsal bilgi, ürün ya da hizmet grupları, fiyat ve teslimat politikaları, destek sayfaları gibi bir ajanın doğru yanıt vermesi için gereken sayfalarla sınırlı tutuyoruz. Ücretsiz AI görünürlük analizimiz tarayıcı erişiminizi denetler ve bir llms.txt taslağı üretir; kurulumda bu taslağı robots.txt kararlarınızla birlikte son hâline getiriyoruz.

İlk 30 gün: erişim kararları nasıl alınır?

İlk 30 günün işi kuralları hemen değiştirmek değil; önce kimin geldiğini ölçmek, sonra her bot için kararı yazılı almak ve kuralları test ederek devreye almaktır.

  1. 1. hafta · Envanter: sunucu ve CDN günlükleri alınır, istekler gruplanıp IP ve DNS ile doğrulanır; mevcut robots.txt, meta robots ve CDN kuralları çıkarılır.
  2. 2. hafta · Karar tablosu: her bot için izin, kısıt ya da engel kararı sizinle birlikte yazılır; eğitim tercihi ve yük sınırları netleşir.
  3. 3. hafta · Kurulum: robots.txt bot bot yazılır, gereken yerlere meta robots ya da X-Robots-Tag eklenir, CDN kuralları kurulur, llms.txt yayına alınır.
  4. 4. hafta · İlk okuma: günlükler yeniden okunur; kurala uymayan istekler, yanlışlıkla engellenen arama botları ve robots.txt durum kodları raporlanır.

Değişikliklerin etkisi hemen görünmez: RFC 9309 robots.txt’nin önbellekteki kopyasının 24 saate kadar kullanılabileceğini söylüyor;8 OpenAI yansımanın yaklaşık 24 saat,1 Perplexity 24 saate kadar sürebileceğini yazıyor.5 İlk okumayı bu yüzden kurulumdan birkaç gün sonra yapıyoruz.

Bir ortakla görüşürken şu soruların somut yanıtını almak işe yarar: botları neye göre doğruluyorsunuz, arama ve eğitim botlarını nasıl ayırıyorsunuz, CDN kuralını robots.txt ile nasıl tutarlı tutuyorsunuz, değişiklikten sonra neyi ölçüyorsunuz. Sitenizin bugün hangi botlara açık olduğunu birlikte okumak isterseniz aşağıdan size uygun bir görüşme günü seçebilirsiniz.

AI erişim kontrolü hakkında merak edilenler.

AI erişim kontrolü hizmetinin ücreti nasıl belirleniyor?

Ücret; alan adı ve alt alan adı sayısına, sunucu ve CDN günlüklerine erişim yoluna, güvenlik duvarı yapısına ve izlemenin süresine göre belirleniyor. Kapsamı ilk görüşmede birlikte çıkarıyor, ardından yazılı teklif veriyoruz. Tek seferlik kurulum ile düzenli izleme ayrı kalemler olarak konuşulabilir.

robots.txt nedir, yapay zekâ botlarında ne işe yarar?

robots.txt, sitenin kök dizininde duran ve tarayıcılara hangi adreslere erişebileceklerini söyleyen düz metin dosyasıdır. Yapay zekâ botlarının çoğu kendi kullanıcı aracısı (user-agent) adıyla bu dosyaya bakar; kurallar bot adıyla yazılarak arama, model eğitimi ve kullanıcı isteği botları ayrı ayrı yönetilebilir. robots.txt bir erişim isteğidir, zorunlu bir engel değildir; uymayan botlar için CDN ve sunucu kuralları gerekir.

Yapay zekâ botlarını engellersek Google sıralamamız etkilenir mi?

Hangi botu engellediğinize bağlı. Google-Extended, Gemini eğitimi ve grounding için bir denetim adıdır; Google bu adın Arama’ya dahil olmayı etkilemediğini ve sıralama sinyali olarak kullanılmadığını yazıyor. Googlebot’u engellemek ise Google’ın sayfalarınızı taramasını durdurur; bu da Arama’daki ve Arama’nın parçası olan yapay zekâ özetindeki görünürlüğünüzü doğrudan düşürür. Bu yüzden Googlebot’a dokunmadan eğitim tercihlerini ayrı adlarla yazıyoruz.

GPTBot’u engellersek ChatGPT’de görünmez miyiz?

Hayır; OpenAI eğitim ve arama için ayrı botlar kullanıyor ve bu ayarların birbirinden bağımsız olduğunu yazıyor. GPTBot’u engellemek, içeriğinizin temel model eğitiminde kullanılmaması tercihini bildirir. ChatGPT arama yanıtlarında görünmek için OAI-SearchBot’un açık olması gerekir; OAI-SearchBot’u engelleyen siteler arama yanıtlarında gösterilmez, yalnız gezinme bağlantısı olarak görünebilir.

Google’ın yapay zekâ özetinde içeriğimizin kullanılmasını istemiyorsak ne yapmalıyız?

Google-Extended bu işi görmez; yapay zekâ özeti ve yapay zekâ modu Google Arama’nın parçasıdır. İçeriğin bu özelliklere doğrudan girdi olmasını sınırlamak için nosnippet, data-nosnippet ya da max-snippet kuralları kullanılır. nosnippet arama sonucundaki metin önizlemesini de kaldırdığı için bu kararı sayfa ya da bölüm bazında, trafiğe etkisini hesaba katarak veriyoruz.

robots.txt’ye yazdık ama botlar hâlâ geliyor; neden?

Birkaç nedeni olabilir. robots.txt bir erişim yetkilendirmesi değildir; ChatGPT-User ve Perplexity-User gibi kullanıcı adına çalışan getiriciler kuralı uygulamayabilir. Tarayıcılar robots.txt’yi 24 saate kadar önbellekte tutabildiği için değişiklik gecikmeli yansır. Kendini bilinen bir bot gibi tanıtan taklit istekler de olabilir; bu yüzden istekleri IP ve DNS ile doğruluyor, gerekiyorsa CDN kuralıyla durduruyoruz.

llms.txt kurmak yapay zekâ görünürlüğümüzü artırır mı?

llms.txt, llmstxt.org’da yayımlanan bir standartlaşma önerisidir ve görünürlük garantisi vermez. Google, yapay zekâ özeti ve yapay zekâ modunda görünmek için yapay zekâ metin dosyası ya da özel işaretleme gerekmediğini yazıyor. Dosya, ajanların sitenizi doğru okumasına yardım eden kısa bir özet olarak işe yarar ve maliyeti düşüktür. Ücretsiz AI görünürlük analizimiz sitenize uygun bir llms.txt taslağı üretir.

Model eğitimini engellemek daha önce toplanan veriyi siler mi?

robots.txt ileriye dönük bir tercihtir. Anthropic, ClaudeBot’u kısıtlamanın sitenin gelecekteki içeriğinin eğitim veri kümelerinden çıkarılması gerektiği anlamına geldiğini yazıyor; OpenAI de GPTBot engelini içeriğin eğitimde kullanılmaması tercihi olarak tanımlıyor. Daha önce toplanmış veriyle ilgili talepler robots.txt’nin kapsamında değildir. Bu konuda sağlayıcıların başvuru yollarını hukuk danışmanınızla birlikte değerlendirmenizi öneriyoruz.

Sunucu günlüklerimize erişim veremezsek çalışma yapılabilir mi?

Yapılabilir, ama görebildiğimiz alan daralır. Günlük olmadan hangi botun gerçekten geldiğini, ne sıklıkla geldiğini ve kurala uyup uymadığını ölçemeyiz; robots.txt, meta robots ve CDN ayarlarını yapılandırma üzerinden denetleriz. CDN kullanıyorsanız CDN’in bot raporları bu boşluğun bir kısmını kapatır. Günlük paylaşımını gereken alanlarla sınırlı ve sizin güvenlik kurallarınıza uygun biçimde planlıyoruz.

Cloudflare kullanmıyoruz; CDN kuralları yine de kurulabilir mi?

Evet. Temel ilke, user-agent eşleşmesini sağlayıcının yayımladığı IP listesiyle birlikte kullanmaktır ve bu ilke başka CDN’lerde, güvenlik duvarlarında ve doğrudan web sunucusu yapılandırmasında da uygulanır. Perplexity de kendi belgesinde Cloudflare’in yanında AWS WAF için aynı yapıyı tarif ediyor. Kuralı hangi katmanda kuracağımıza altyapınızı inceledikten sonra karar veriyoruz.

Hangi botlara izin verileceğine kim karar veriyor?

Karar sizindir. Her bot için ne işe yaradığını, engellemenin neyi değiştireceğini ve sitenizde bugün ne yaptığını gösteren bir karar tablosu hazırlıyoruz. Arama botlarını kapatmanın yapay zekâ yanıtlarındaki görünürlüğe, eğitim botlarını açmanın içerik kullanımına etkisini bu tabloda yan yana görürsünüz. Kurulumu bu tabloya göre yapıyor, kararınızı değiştirdiğinizde kuralları güncelliyoruz.

Değişikliklerin etkisini ne zaman görürüz?

robots.txt değişikliği anında yansımaz; standart, tarayıcıların dosyayı 24 saate kadar önbellekte kullanmasına izin veriyor, OpenAI ve Perplexity de yansımanın 24 saate kadar sürebileceğini yazıyor. Google’daki önizleme kurallarında süre sayfanın yeniden taranmasına bağlıdır; Google bunun birkaç günden birkaç aya kadar sürebileceğini belirtiyor. İlk okumayı kurulumdan birkaç gün sonra günlüklerden yapıyor, dördüncü haftanın sonunda raporluyoruz.

Bu çalışma bir kez yapılınca biter mi, işi kim yapıyor?

Kurulum bir kez yapılır, ama bot listesi sabit değildir: sağlayıcılar yeni botlar ekliyor, adları ve IP aralıklarını güncelliyor. Bu yüzden düzenli izlemeyi öneriyor; günlükleri belirli aralıklarla okuyup yeni botları kaynaktan doğruladıktan sonra kurallara ekliyoruz. Çalışmayı markention ekibi yürütür; biz firmanıza modüler olarak eklenen bir pazarlama ve iş geliştirme operasyonuyuz. robots.txt, llms.txt ve CDN kuralları sizin sunucunuzda ve hesabınızda durur, çalışma bittiğinde her şey belgeleriyle sizde kalır.

Kaynakça 12 resmî kaynak

  1. Overview of OpenAI CrawlersOpenAI
  2. Does Anthropic crawl data from the web, and how can site owners block the crawler?Anthropic (Claude Help Center)
  3. AI features and your websiteGoogle Search Central
  4. List of Google's common crawlersGoogle for Developers (Crawling infrastructure)
  5. Perplexity CrawlersPerplexity
  6. CCBotCommon Crawl
  7. Verify requests from Google crawlers and fetchersGoogle for Developers (Crawling infrastructure)
  8. RFC 9309: Robots Exclusion ProtocolIETF (RFC Editor)
  9. Robots meta tag, data-nosnippet, and X-Robots-Tag specificationsGoogle Search Central
  10. Manage AI crawlersCloudflare Docs (AI Crawl Control)
  11. Block AI BotsCloudflare Docs (Bots)
  12. The /llms.txt file, v2llmstxt.org (Jeremy Howard)

Operasyonun ritmi: ay, hafta, gün, saat.

Projenizde bir mentor ve iki uzman çalışır. Kullandığımız araçlar: Claude, Search Console, Semrush, Yandex, Screaming Frog, Google Analytics, ChatGPT · Codex, Google Ads, Ahrefs, Data Studio, Merchant Center, Google Trends, Meta Business, My Business. Search Console ve Analytics’inizi her gün kontrol ederiz; Merchant Center ayda bir gün, diğer araçlar takvimdeki işe göre devreye girer.

markention’lu 28 gün

2 strateji toplantınız · 7/24 yaşayan Data Studio raporunuz · 8 operasyon toplantısı · ağırlığınca fırsat çalışması
  1. 10:00PztPlanlamaPazartesi, 1. hafta: Haftanızı planlıyoruzAya, Merchant Center’daki ürün akışınızı kontrol ederek başlıyoruz; haftanın önceliklerini 10:00–11:00 ekip toplantımızda netleştiriyoruz.
  2. SalStratejiSalı, 1. hafta: Strateji oturumunuzMentorunuz ve uzmanlarınız bir araya geliyor: projenizin genel durumuna bakıyor, fikirleri tartışıyor ve Perşembe günü sizinle yapacağımız toplantının gündemini hazırlıyoruz.
  3. ÇarTaramaÇarşamba, 1. hafta: Sitenizin teknik taramasıSitenizi Screaming Frog ile baştan sona tarıyoruz: kırık bağlantılar, yönlendirmeler ve indeksleme sorunları iş listenize giriyor.
  4. PerToplantıPerşembe, 1. hafta: Sizinle toplantıİki haftada bir görüşüyoruz. Mentorunuz ve iki uzmanınız masada; görüşmeyi kayda alıyor, kararları yazıya döküyoruz.
  5. 16:00CumKapanışCuma, 1. hafta: Haftanın değerlendirmesiHaftayı 16:00’daki ekip değerlendirmemizle kapatıyoruz: yapılanları ve sıradaki işleri gözden geçiriyoruz.
  6. 10:00PztPlanlamaPazartesi, 2. hafta: Haftanızı planlıyoruzGüne Google Ads ve Meta Business hesaplarınızı gözden geçirerek başlıyoruz; haftanın önceliklerini 10:00–11:00 ekip toplantımızda netleştiriyoruz.
  7. SalBacklinkSalı, 2. hafta: Bağlantı profilinizin denetimiAhrefs ile bağlantı profilinize bakıyoruz: kazanılan, kaybedilen ve riskli bağlantıları ayırıyoruz.
  8. ÇarPazarÇarşamba, 2. hafta: Pazar ve rakip araştırmanızSemrush ile pazarınızı ve rakiplerinizi tarıyoruz: sıralamalar, yeni fırsatlar ve kaybedilen sorgular iş listenize giriyor.
  9. PerRaporPerşembe, 2. hafta: Google Data Studio raporunuzSitenizi yeniden tarıyoruz; toplantı olmayan haftada, 310 benzersiz veri tipini bir araya getiren güncel panonuzla birlikte raporunuzu gönderiyoruz.
  10. 16:00CumKapanışCuma, 2. hafta: Haftanın değerlendirmesiHaftayı 16:00’daki ekip değerlendirmemizle kapatıyoruz: yapılanları ve sıradaki işleri gözden geçiriyoruz.
  11. 10:00PztPlanlamaPazartesi, 3. hafta: Haftanızı planlıyoruzGüne Yandex’teki görünürlüğünüzü ve Google İşletme Profili’nizi kontrol ederek başlıyoruz; haftanın önceliklerini 10:00–11:00 ekip toplantımızda netleştiriyoruz.
  12. SalStratejiSalı, 3. hafta: Strateji oturumunuzMentorunuz ve uzmanlarınız bir araya geliyor: projenizin genel durumuna bakıyor, fikirleri tartışıyor ve Perşembe günü sizinle yapacağımız toplantının gündemini hazırlıyoruz.
  13. ÇarYapay zekâÇarşamba, 3. hafta: Yapay zekâ yanıtlarında markanızChatGPT ve Claude yanıtlarında markanızın nasıl geçtiğine bakıyoruz; yanıtsız kalan soruları içerik planınıza alıyoruz.
  14. PerToplantıPerşembe, 3. hafta: Sizinle toplantıİki haftada bir görüşüyoruz. Mentorunuz ve iki uzmanınız masada; görüşmeyi kayda alıyor, kararları yazıya döküyoruz.
  15. 16:00CumKapanışCuma, 3. hafta: Haftanın değerlendirmesiGoogle Trends ile alanınızda yükselen aramalara bakıyoruz; haftayı 16:00’daki ekip değerlendirmemizle kapatıyoruz.
  16. 10:00PztPlanlamaPazartesi, 4. hafta: Haftanızı planlıyoruzGüne Google Ads ve Meta Business hesaplarınızı gözden geçirerek başlıyoruz; haftanın önceliklerini 10:00–11:00 ekip toplantımızda netleştiriyoruz.
  17. SalAnalizSalı, 4. hafta: Trafik ve dönüşüm analizinizGoogle Analytics’te ziyaretçilerinizin nereden geldiğine ve hangi sayfalarınızın dönüşüm getirdiğine bakıyoruz; bulgular Perşembe günkü raporunuza giriyor.
  18. ÇarAI OverviewsÇarşamba, 4. hafta: Google’ın yapay zekâ yanıtlarında markanızGoogle’ın AI Overviews ve AI Modu yanıtlarında markanızın kaynak gösterilip gösterilmediğine bakıyoruz; yanıtsız kalan soruları içerik planınıza alıyoruz.
  19. PerRaporPerşembe, 4. hafta: Google Data Studio raporunuzToplantı olmayan haftada, güncel panonuzla birlikte raporunuzu gönderiyoruz.
  20. 16:00CumKapanışCuma, 4. hafta: Haftanın değerlendirmesiHaftayı 16:00’daki ekip değerlendirmemizle kapatıyoruz: yapılanları ve sıradaki işleri gözden geçiriyoruz.

Örnek akış: toplantı gününüz Perşembe ise.

Pazartesi1. hafta Haftanızı planlıyoruz

Aya, Merchant Center’daki ürün akışınızı kontrol ederek başlıyoruz; haftanın önceliklerini 10:00–11:00 ekip toplantımızda netleştiriyoruz.

Tanışmak için

Yol haritanızı birlikte çıkaralım. Bilgilerinizi bırakın; ekip sitenize bakıp size dönsün.