Kapı açık, ama bekçi içeri almıyor

GoPersona araştırma notu: 30 Türk markasının sitesi, yapay zeka motorlarının gördüğü şekilde ölçüldü. robots.txt’si okunabilen hiçbir marka yapay zeka tarayıcılarını engellemiyor — ama her dört siteden biri tarayıcıyı kapıda 403 ile geri çeviriyor.

0 / 19 — robots.txt’si okunan markadan yapay zekayı engelleyen. 7 / 30 — tarayıcıyı kapıda 403 ile geri çeviren. %35 — ana sayfasında JSON-LD bulunan.

GoPersona Araştırma Notu 01 — 1 Ağustos 2026. Türkiye’nin en büyük 30 markasının sitesini, yapay zeka motorlarının gördüğü şekilde ölçtük. Buradaki her sayı, elinde curl olan herkesin bugün tekrar üretebileceği bir sayı.

“Türk markaları yapay zeka yanıtlarında ne kadar görünüyor?” sorusu daha çekici ama daha zayıf bir araştırma: her marka için her soruyu bir motora sormak gerekir, sonuç modelin o günkü hâline bağlıdır ve kimse dışarıdan doğrulayamaz. Bunun yerine dışarıdan tam olarak doğrulanabilir bir şeyi ölçtük: markanın kendi sitesi, yapay zeka tarayıcılarına ne söylüyor ve onlara ne veriyor.

Bulgu 1 — İzin. robots.txt dosyası okunabilen 19 markanın 0’ı yapay zeka tarayıcılarını engelliyor. GPTBot, ClaudeBot, PerplexityBot, Google-Extended, CCBot, OAI-SearchBot, Bingbot, Googlebot: sekiz tarayıcının hiçbiri, hiçbir markada engellenmiş değil. Üstelik bir kısmı bunu bilerek yapıyor; Turkcell’in robots.txt dosyası on altı tarayıcıyı tek tek adıyla sayıp hepsine izin veriyor.

Bulgu 2 — Erişim. İzin verilmiş olması içeri girilebildiği anlamına gelmiyor. 30 markanın 7’si, tarayıcı kimliğiyle gelmeyen bir istemciyi ana sayfada HTTP 403 ile reddetti. Bu markaların robots.txt’si “buyurun” diyor, sunucu önündeki bot koruması “hayır” diyor. İkisi genellikle iki farklı ekibin kararı ve kimse ikisini yan yana koymuyor.

Bulgu 3 — Yapısal veri. Ana sayfası okunabilen 20 markanın yalnızca 7’sinde JSON-LD var (%35). Bir motorun markayı bir varlık olarak tanıması için yapısal veri gerekiyor; üçte ikisinde hiç yok. Motor markayı serbest metinden tahmin etmek zorunda kalıyor.

Bulgu 4 — llms.txt. Ölçülebilen 22 markanın 8’inde gerçek bir llms.txt var (%36). Beklediğimizden yüksek ve bu notun tek olumlu sürprizi; telekom ve bankacılık öncülük ediyor.

Bu bulgunun sınırı: bize 403 dönen bir sitenin GPTBot’u da engellediğini kanıtlamış olmuyoruz. Büyük bot koruma sistemleri doğrulanmış tarayıcıları IP aralığından tanıyıp beyaz listeye alabiliyor. Kanıtladığımız daha dar ve hâlâ önemli: bu siteler istemciler arasında kenar katmanında ayrım yapıyor, ve markanın robots.txt’si hikâyenin tamamı değil. Gerçek cevap yalnızca kendi sunucu günlüklerinizde.

Yöntem: her marka için robots.txt, llms.txt ve ana sayfa çekildi; başarısız olan istekler 1,5 saniye arayla bir kez daha denendi. robots.txt ana sayfadan bağımsız çekildi, çünkü bazı siteler ana sayfayı 403’lerken robots.txt’yi sorunsuz veriyor. Durum kodları yalan söyler: tek sayfalık uygulamalar her yola 200 döner, o yüzden içerik kontrol edildi. Her alan üç değerli — var / yok / bilinmiyor — ve “bilinmiyor” hiçbir yüzdenin ne payına ne paydasına giriyor.

Örneklem amaca yönelik seçildi: ciro sıralamasına göre değil, tanınırlık ve sektör dağılımına göre 30 tüketiciye dönük marka. Bu, Türkiye pazarının istatistiksel olarak temsili bir kesiti değildir ve öyle okunmamalıdır.

Ölçüm kimlik gizlenmeden yapıldı; tarayıcı taklidi yapılmadı, hiçbir koruma aşılmaya çalışılmadı. 403 alan adreslerde 403 raporlandı — bu, bulgunun kendisidir: bir yapay zeka tarayıcısı da tam olarak bu muameleyle karşılaşır.

Ölçülebilen markalarda sinyal oranları. meta description: %95. canonical: %70. hreflang: %40. llms.txt: %36,4. JSON-LD: %35. YZ tarayıcı engeli: %0. Her oranın paydası farklıdır: ölçülemeyen hiçbir site yüzdeye dâhil edilmedi.

Ana sayfa erişimi — 30 marka. Durum: HTTP 200, Marka sayısı: 20, Ne anlama geliyor: ölçülebildi. Durum: HTTP 403, Marka sayısı: 7, Ne anlama geliyor: site ayakta, tarayıcı kimliği taşımayan istemciyi reddediyor. Durum: Yanıt vermedi, Marka sayısı: 3, Ne anlama geliyor: ölçülemedi — hiçbir orana dâhil edilmedi.

GO robot maskotu kapalı bir kapının önünde duruyor
GO robot maskotu kapalı bir kapının önünde duruyor

Veri seti paylaşılıyor mu?

Evet, talep üzerine. Ham ölçüm ve toplama betiği saklanıyor; her sayı curl ile bağımsız olarak tekrar üretilebilir.

Bu bir pazar araştırması mı?

Hayır. Amaca yönelik seçilmiş 30 markada gözlemlenen bir durumu bildiriyor; Türkiye pazarının istatistiksel temsili bir kesiti değil. Her sektörde 2-4 marka var; bu bir eğilimi işaret etmeye yeter, kanıtlamaya yetmez.

403 dönen siteler yapay zekayı gerçekten engelliyor mu?

Bunu kanıtlamıyoruz. Büyük bot koruma sistemleri doğrulanmış tarayıcıları IP aralığından tanıyıp beyaz listeye alabiliyor, dolayısıyla bu sitelerin bir kısmı GPTBot’u geçirip bizi geçirmiyor olabilir. Kanıtladığımız şey, sitelerin istemciler arasında ayrım yaptığı ve robots.txt’nin hikâyenin tamamı olmadığı.

Kişisel veri işlendi mi?

Hayır. Ölçülen her şey şirketlerin kendi yayımladığı teknik yapılandırma: robots.txt, llms.txt, HTTP durum kodları ve sayfa yapısal verisi. KVKK ve GDPR kişisel veriyi gerçek kişiye bağlar; tüzel kişilere ait teknik yapılandırma bu kapsamda değildir.