Nixeny Dijital - Mersin / AI Readiness 2026
Mersin’de 3.395 işletme sitesinin robots.txt dosyası tarandı, 3.382 ana sayfası makine okunabilirliği açısından incelendi. Bir asistanın “bu işletme nerede, ne zaman açık, telefonu ne” sorusunu doğrudan siteden yanıtlayabildiği site oranı %4,5. Tek soru: Mersin’in işletmeleri makineye ne anlatıyor?
Bu sayılar neyi ölçüyor, neyi ölçmüyor
Bu çalışmada hiçbir yapay zekâ modeline soru sorulmadı. Asistanların gerçekte hangi işletmeyi alıntıladığı ölçülmedi. Ölçülen tek şey, bir asistanın bu siteden yanıt üretebilmesi için gereken koşulların sağlanıp sağlanmadığı. "Yapay zekâ bu işletmeyi bulamıyor" cümlesi bu veriden çıkarılamaz.
Yapay zekâ botlarını engellemek meşru bir karardır ve bu raporda bir hata olarak değil, bir karar olarak sayılır. "Hiç kural tanımlamamış" 3.021 site ile "bilinçli engellemiş" 331 site hiçbir tabloda birleştirilmez: birincisi konuyu hiç konuşmamış, ikincisi konuşup karar vermiştir.
İçerik ve yapılandırılmış veri ölçümleri yalnızca ana sayfa üzerinden yapıldı. İç sayfalardaki şema, hizmet listesi veya sık sorulan sorular görülmez. Bu, buradaki bütün şema ve içerik oranlarının bir ALT SINIR olduğu anlamına gelir: gerçek oran daha yüksek olabilir, daha düşük olamaz.
Bot adları ve politikaları aylar içinde değişir; bugün var olmayan bir bot gelecek yıl listenin başında olabilir. Buradaki oranlar yalnızca yanlarındaki 19 bot'luk listeyle birlikte anlamlıdır ve başka bir tarihe taşınamaz.
Sözlük · her terim bir kez açıklanır
- Yapay zekâ görünürlüğü
- Bu raporun konusu: bir yapay zekâ asistanının bir işletme sitesinden yanıt üretebilmesi için gereken koşulların ne kadarının sağlandığı. Bir kalite yargısı değil, bir okunabilirlik ölçüsüdür.
- Payda
- Bu raporda üç ana payda kullanılır: 3.395 robots.txt'i taranan site, 3.382 ana sayfası okunabilen site ve 4.167 denetlenen alan adı. Bölüm içinde daha dar paydalar da vardır (llms.txt üreticileri 352 dosya üzerinden). Her oranın yanında hangisi olduğu yazılıdır.
- robots.txt
- Bir sitenin kök dizininde duran, hangi botun nereye girebileceğini söyleyen düz metin dosyası. Bağlayıcı değil, gönüllüdür: botlar uymayı seçer. Bu çalışmada her bot için yalnızca kök dizin ("/") değerlendirilmiştir.
- Eğitim botu / arama botu
- Eğitim botu (GPTBot, ClaudeBot, Google-Extended) modeli eğitmek için içerik toplar. Arama botu (OAI-SearchBot, PerplexityBot) bir soru sorulduğunda kaynağı bulup alıntılar. İkisini aynı kuralla engellemek, alıntılanma ihtimalini de kapatır.
- Kural koymamak ≠ engellemek
- robots.txt'te bir bot için kural yoksa varsayılan davranış erişime izin vermektir. Bu yüzden "hiç kural tanımlamamış" siteler ile "bilinçli engellemiş" siteler bu raporda hiçbir yerde aynı kovaya konmaz.
- Yapılandırılmış veri (JSON-LD)
- Sayfanın içine gömülen, makinenin doğrudan okuyabileceği biçimdeki bilgi: ad, adres, telefon, çalışma saatleri. İnsan için görünmez. Bu çalışmada yalnızca JSON-LD okunmuştur; mikroveri ve RDFa kapsam dışıdır.
- LocalBusiness şeması
- Yapılandırılmış verinin "bu bir yerel işletmedir" diyen türü. Bir sitenin kendini makineye işletme olarak tanıtmasının standart yolu budur; yoksa asistan sayfanın ne olduğunu metinden tahmin etmek zorunda kalır.
- Ad-adres-telefon üçlüsü
- Yapılandırılmış veride işletmenin adı, açık adresi ve telefonunun üçünün birden bulunması. Üçünden biri eksikse asistan cevabı ya vermez ya da başka bir kaynaktan — çoğu zaman bir dizinden — alır.
- llms.txt
- Yapay zekâ asistanlarına sitenin içeriğini özetlemek için önerilen dosya. Henüz bir taslak öneridir, standart değildir. Bu yüzden yokluğu bir eksiklik olarak değil, benimsenme ölçüsü olarak raporlanır.
- Yanıtlanabilirlik
- Bir asistanın "bu işletme nerede, ne zaman açık, telefonu ne" sorusunu doğrudan siteden yanıtlayabilmesi için gereken dört koşulun tamamının sağlanması: arama engellenmemiş, ad-adres-telefon tam, çalışma saatleri var ve içerik JavaScript olmadan görünüyor.
- JavaScript bağımlılığı
- Statik HTML'de 120 kelimeden az metin varken, tarayıcının çalıştırdığı sayfanın 2,5 kattan fazla metin göstermesi. Bu sitelerin ana sayfası, JavaScript çalıştırmayan bir tarayıcıya boş görünür.
- Görünürlük skoru
- Altı bileşenin ağırlıklı 0-100 birleşimi: erişim izni (25), yapılandırılmış veri (25), içerik derinliği (20), teknik temel (15), yanıt hazırlığı (10), llms.txt (5). Ölçülemeyen bileşen hem paydan hem paydadan düşer; kapsam %60'ın altındaysa skor yayımlanmaz.
Yüz siteden dördü bir soruyu yanıtlayabiliyor
Bir yapay zekâ asistanının bir işletme hakkındaki en sıradan soruyu — nerede, ne zaman açık, telefonu ne — doğrudan o işletmenin sitesinden yanıtlayabilmesi için dört şey gerekir: robots.txt aramayı engellemiyor olmalı, yapılandırılmış veride ad-adres-telefon üçlüsü tam olmalı, çalışma saatleri orada bulunmalı ve içerik JavaScript çalıştırılmadan da görünmeli.
Dördünü birden sağlayan site sayısı 152 — %4,5. Bu siteler 170 işletmeyi temsil ediyor. Kalan siteler için asistan ya susar ya da yanıtı başka bir yerden, çoğunlukla bir dizinden alır.
Her çubuk, o tek koşulu sağlayamayan site sayısıdır. Bir site aynı anda üç koşulda birden takılabildiği için satırlar toplanmaz ve bir bölüntü olarak okunamaz; sıralama, koşulun ne sıklıkla ısırdığına göredir.
Sitelerin %89,0'ı yapay zekâ için tek kural yazmamış
robots.txt, bir sitenin hangi botu nereye aldığını söylediği dosyadır. 2.227 sitede (%65,6) böyle bir dosya var; ama içinde yapay zekâ botları için tek bir kural bulunan site sayısı yalnızca 374. Kalan 3.021 site için konu henüz açılmamış.
Kural koymamak, engellemek değildir: robots.txt’te bir bot için hüküm yoksa varsayılan davranış erişime izin vermektir. Bu yüzden bu iki satır raporun hiçbir yerinde birleştirilmez. Biri konuyu hiç konuşmamış, diğeri konuşup karar vermiştir.
Yedi okuma, aynı dosyadan ve aynı payda üzerinden. “En az bir kural tanımlı” satırı, izin ve engelleme kararlarının toplamıdır; altındaki iki satır o toplamı böler. Googlebot satırı kontrol grubudur.
Sitelerin hangi hâlde olduğunu tek bir bölüntüyle görmek mümkün. Aşağıdaki dört kova 3.395 sitenin tamamını kapsıyor ve toplamları paydayı verir — ama “kapalı” kovası bir sıralamanın en altı değil, diğer üçünün dışıdır. Orada duran bir site soruyu yanıtlamış; “görünmez” kovasındaki site soruyla hiç karşılaşmamıştır.
Yüz karenin her biri yaklaşık 34 siteyi temsil eder. Kovalar birbirini dışlar ve toplamları paydaya eşittir.
Yapay zekâ botları arama motorlarından 25 kat sık engelleniyor
Engellemenin genel bir kapalılık mı yoksa yapay zekâya özel bir ayrım mı olduğunu anlamanın tek yolu, aynı sitelerin klasik arama botlarına ne yaptığına bakmak. 331 site en az bir yapay zekâ botunu kök dizinden engelliyor; Googlebot ve Bingbot’u engelleyen site sayısı 13. Aradaki fark 25,5 kat.
Yani reddedilen şey taranmak değil, taranan şeyin belirli bir kullanımı. Aynı siteler arama motorlarını içeri alıyor.
Dört grup, aynı payda. Kontrol grubu klasik arama botlarıdır: Googlebot ve Bingbot. “Anılan” sütunu, sitenin o grubu robots.txt'te adıyla yazdığı durumları sayar — anmak engellemek değildir, izin vermek için de anılabilir.
Bot bot bakıldığında engellemenin bir liste işi olduğu görülüyor: eğitim botlarının engellenme oranları birbirine çok yakın, çünkü aynı siteler onları tek bir blokta sayıyor. Birkaç satırda engellenen sayı anılan sayıdan büyük — orada kuralı yazan joker (*) grubudur, botun kendi adı dosyada hiç geçmez.
Her satır bir user-agent token'ı. Renk botun işini gösterir: kırmızı eğitim, koyu mavi arama, açık mavi kullanıcı isteğiyle getirme, gri klasik arama (kontrol).
| Bot | İşi | Anılan | Engelleyen | Oran |
|---|---|---|---|---|
| GPTBot (OpenAI, eğitim) | eğitim | 346 | 312 | %9,2 |
| OAI-SearchBot (ChatGPT arama) | arama | 62 | 40 | %1,2 |
| ChatGPT-User (kullanıcı isteğiyle) | kullanıcı isteği | 160 | 135 | %4,0 |
| ClaudeBot (Anthropic, eğitim) | eğitim | 336 | 308 | %9,1 |
| Claude-User (kullanıcı isteğiyle) | kullanıcı isteği | 40 | 40 | %1,2 |
| Claude-SearchBot (Claude arama) | arama | 43 | 41 | %1,2 |
| PerplexityBot (arama dizini) | arama | 171 | 131 | %3,9 |
| Perplexity-User (kullanıcı isteğiyle) | kullanıcı isteği | 32 | 38 | %1,1 |
| Google-Extended (Gemini eğitimi) | eğitim | 334 | 305 | %9,0 |
| Applebot-Extended (Apple Intelligence) | eğitim | 316 | 305 | %9,0 |
| meta-externalagent (Meta AI) | eğitim | 214 | 218 | %6,4 |
| Bytespider (ByteDance) | eğitim | 309 | 313 | %9,2 |
| CCBot (Common Crawl) | eğitim | 320 | 318 | %9,4 |
| Amazonbot | eğitim | 303 | 308 | %9,1 |
| cohere-ai | eğitim | 44 | 45 | %1,3 |
| YouBot (You.com) | arama | 127 | 131 | %3,9 |
| Diffbot | eğitim | 125 | 136 | %4,0 |
| Googlebot (klasik arama) | klasik arama | 68 | 11 | %0,3 |
| Bingbot (klasik arama + Copilot) | klasik arama | 40 | 13 | %0,4 |
352 sitenin llms.txt'i var, yarısını bir eklenti yazdı
llms.txt, yapay zekâ asistanlarına sitenin içeriğini özetlemek için önerilen bir dosya. Henüz bir standart değil, taslak bir öneri — bu yüzden yokluğu bir eksiklik olarak değil, benimsenme ölçüsü olarak okunmalı. 352 sitede (%10,4) var; daha ayrıntılı olan llms-full.txt yalnızca 30 sitede.
Asıl bulgu sayının kendisi değil, kimin yazdığı. Bu 352 dosyanın 183 tanesi (%52,0) bir eklenti veya platform tarafından otomatik üretilmiş. Yani bu sayı, işletmelerin yapay zekâ hakkındaki kararını değil, kullandıkları aracın sürüm notlarını ölçüyor.
İki farklı payda, üst üste. Alt bloktaki oranlar var olan dosyaların dağılımıdır, site toplamının değil: 3.395 üzerinden okunursa her satır bir büyüklük mertebesi yanlış çıkar.
Çalışma saatini makinenin okuyabildiği site: yüzde 5,7
Yapılandırılmış veri, sayfanın içine gömülen ve yalnızca makinenin gördüğü bilgidir: ad, adres, telefon, çalışma saatleri. Ana sayfasında herhangi bir JSON-LD bloğu bulunan site oranı %33,9. Ama oradan aşağıya doğru her adımda sayı düşüyor: kendini işletme olarak tanıtan %10,7, ad-adres-telefon üçlüsü tam olan %13,5, çalışma saatlerini veren %5,7.
Bu düşüş raporun konusu. Bir asistanın “şu an açık mı” sorusuna yanıt verebilmesi için gereken tek alan, sitelerin yirmide birinde var.
Daralan bir sıra: herhangi bir JSON-LD, sonra işletme türleri, sonra bir asistanın soruyu yanıtlamak için gerçekten ihtiyaç duyduğu üç bilgi.
Sekiz alan üzerinden hesaplanan tamlık yüzdesi. Medyan sıfır: sitelerin yarısından fazlasında sayılabilecek hiçbir alan yok, bu yüzden bir ortalama yerine dağılımın kendisi veriliyor.
Bir asistanın doğrudan alıntılayabileceği türler. FAQPage ve Question bir soruya hazır yanıt taşır; Offer, Service ve Product bir hizmetin ne olduğunu ve ne kadar olduğunu söyler.
155 sitenin ana sayfası tarayıcıya boş görünüyor
Yapılandırılmış veri yoksa geriye metnin kendisi kalır. Ana sayfaların medyan kelime sayısı 382; dörtte biri 176,25 kelimenin altında. Çoğu site için okunacak bir şey var: sitelerin %81,7’i “yeterli” ya da “zengin” kovasında.
Sorun uçlarda. 155 sitenin içeriği yalnızca JavaScript çalıştırıldığında geliyor — yani JavaScript çalıştırmayan bir yapay zekâ tarayıcısı o ana sayfayı boş görür. Ayrıca 150 sitenin ana sayfasında 120 kelimeden az metin var.
Ana sayfadaki statik metnin kelime sayısına göre dört kova. Kovalar birbirini dışlar ve toplamları paydaya eşittir.
Yapılandırılmış veri yokken bir asistanın metinde arayacağı altı işaret. Telefon bağlantısı (tel:) hiçbir şema gerektirmeden makine okunurdur; yarının üzerinde olan tek satır bu.
Bu iki satır aynı siteler değildir ve toplanmaz: birincisi metni sonradan yükleyen siteleri, ikincisi ana sayfasında hiç metin bulunmayanları sayar. İkisinin de sonucu aynı: sayfayı bir tarayıcı gibi çalıştırmayan bir bot, orada okunacak bir şey bulamaz.
Medyan site altı bileşenin ikisinden sıfır alıyor
Altı bileşen, ağırlıklı bir 0-100 skoru veriyor: erişim izni (25), yapılandırılmış veri (25), içerik derinliği (20), teknik temel (15), yanıt hazırlığı (10) ve llms.txt (5). Medyan 53,8, çeyrekler 44,5 ile 63,7 arasında.
Skor bir kalite yargısı değil, bir görünürlük ölçüsü: düşük skor kötü işletme demek değil, makinenin okuyabileceği daha az şey demek. Bileşenlere bakıldığında dağılımın nereden geldiği görülüyor — medyan site erişim izninden tam puan, iki bileşenden ise sıfır alıyor.
Beş kova, toplamları paydaya eşit. Dağılım ortada toplanıyor: sitelerin yarısı 40-59 bandında.
Yüz karenin her biri yaklaşık 34 siteyi temsil eder.
Bileşenin ağırlığı yanında yazılı. İki bileşenin medyanı sıfır: bu bir veri boşluğu değil, bulgunun kendisi — sitelerin yarısından fazlasında ne yapılandırılmış veri ne llms.txt var.
Belirleyici olan sektör değil, kurulan altyapı
Sektörler arasındaki fark dar. 30 sektörün medyanları 33,8 ile 64,4 arasında sıkışıyor ve medyanları 52,9. Platformlar arasındaki fark daha büyük: Wix’te 68,9, özel geliştirmede 48,8.
Bunu en açık gösteren satır LocalBusiness şeması: Wix sitelerinin %53,7’i kendini makineye işletme olarak tanıtıyor, özel geliştirmelerin %8,9’i. Bir avukatın sitesi ile bir oto servisin sitesi arasındaki farkı, avukatlık ile oto servis değil, iki sitenin kurulduğu araç yaratıyor.
Satırdaki iki payda aynı değil ve olmamalı: medyan skor taranan sitelerin tamamı üzerinden, LocalBusiness oranı ise ana sayfası okunabilenler üzerinden hesaplanır.
| Altyapı | Site | Medyan skor | LocalBusiness | Ad-adres-tel. | Yanıtlanabilir |
|---|---|---|---|---|---|
| Wix | 121 | 68,9 | %53,7 | %43,8 | %1,6 |
| Ticimaxkarşılaştırma | 48 | 66,9 | %4,2 | %81,3 | %4,2 |
| Next.js | 146 | 61,4 | %39,0 | %39,0 | %19,2 |
| WordPress | 559 | 59,4 | %7,7 | %8,8 | %3,8 |
| WooCommerce | 386 | 58,8 | %5,2 | %5,7 | %2,3 |
| IdeaSoftkarşılaştırma | 37 | 56,3 | %0,0 | %5,4 | %0,0 |
| Özel geliştirme | 1.912 | 48,8 | %8,9 | %11,2 | %4,6 |
Her çentik bir sektörün medyan skoru. Çentik yüksekliği bir veri taşımaz; yalnızca yan yana düşen değerleri sayılabilir tutmak için üç adımlı bir döngüyle değişir. Kırmızı çizgi sektör medyanlarının medyanı.
Bu şeklin bulgusu düzlüğüdür. Serinin diğer ölçümlerinde ilçeler arasında kat kat fark varken, yapay zekâ görünürlüğü coğrafyayla birlikte hareket etmiyor.
Bu çalışma hiçbir yapay zekâya soru sormadı
Bu raporun bütün sayıları bir hazırlığı ölçüyor: bir asistanın bu siteden yanıt üretebilmesi için gereken şeylerin ne kadarının yerinde olduğunu. Hiçbiri, bir asistanın gerçekte ne yaptığını ölçmüyor.
Bu çalışmada hiçbir modele tek bir soru sorulmadı. “Çalışma saatleri yapılandırılmış veride yok” cümlesi doğrudur ve doğrulanabilir; “yapay zekâ bu işletmeyi bulamıyor” cümlesi bu veriden çıkmaz. Asistanlar dizinlerden, harita servislerinden ve bu çalışmanın hiç bakmadığı kaynaklardan da yanıt üretir. Aradaki mesafe, bu raporun kapatmayı amaçlamadığı bir mesafedir.
Aynı şekilde 331 sitenin yapay zekâ botlarını engellemesi bir kusur değil. Bir işletme içeriğinin model eğitiminde kullanılmasını istemeyebilir ve bunu söylemenin yolu tam olarak budur. Bu rapor o kararı sayar, değerlendirmez.
- Yerel işletme sitelerinin yapay zekâ asistanlarına yanıt verecek biçimde yapılandırılmadığı — dört koşulun tamamını sağlayan site oranı %4,5.
- Yapay zekâ botları konusunun yerel işletmelerin gündeminde henüz olmadığı: sitelerin %89,0'ı bu botlar için tek bir kural bile tanımlamamış.
- Engellemenin yapay zekâya özel bir ayrım olduğu: aynı siteler klasik arama botlarını içeri alıyor, fark 25 katın üzerinde.
- Farkın büyük ölçüde kullanılan altyapının varsayılanlarından kaynaklandığı: platformlar arası medyan farkı, sektörler arası farktan büyük.
- İçeriği yalnızca JavaScript ile gelen 155 sitenin, JavaScript çalıştırmayan tarayıcılara boş göründüğü.
- "Yapay zekâ bu işletmeleri bulamıyor" — hiçbir modele soru sorulmadı; koşullar ölçüldü, sonuç değil.
- "Şu site yapay zekâyı engellediği için yanlış yapıyor" — engelleme meşru bir tercihtir ve bu raporda karar olarak sayılır.
- "Sitelerin %X'inde şema yok" — doğrusu: "ana sayfasında tespit edilemedi"; iç sayfalar ve JSON-LD dışı biçimler görülmedi.
- Bot oranlarının kalıcı olduğu — bot adları ve politikaları aylar içinde değişir.
- llms.txt yayımlayan sitelerin yapay zekâ konusunda bir karar verdiği — dosyaların yarıdan fazlasını bir eklenti otomatik üretti.
Sınırlılıklar
- Tek kesit.
- robots.txt ve llms.txt, tarama anındaki hâliyle ölçülmüştür. Bir site ertesi gün kuralını değiştirmiş olabilir; bu çalışma değişimi değil, o anı gösterir.
- Sonuç değil, koşul ölçüldü.
- Asistanların gerçekte hangi siteyi alıntıladığı ölçülmemiştir. İzin verilmiş olmak alıntılanmayı garanti etmez; engellenmiş olmak da hiç görünmemek anlamına gelmez.
- Botlar robots.txt'e uymak zorunda değildir.
- Dosya gönüllü bir sözleşmedir. Bazı botlar uymaz. Bu yüzden "engelledi" ifadesi "girmedi" anlamına gelmez, "girmemesini istedi" anlamına gelir.
- Yalnızca JSON-LD okundu.
- Yapılandırılmış veri yalnızca JSON-LD blokları üzerinden değerlendirilmiştir. Mikroveri (microdata) ve RDFa kapsam dışıdır; bu biçimleri kullanan siteler burada "şeması yok" görünür.
- İçerik ölçümleri ana sayfayla sınırlı.
- Blog, hizmet ve iletişim sayfalarındaki derinlik görülmez. Zengin bir iç yapıya sahip bir site, ince bir ana sayfa yüzünden düşük görünebilir.
- Sektör ataması bir heuristiktir.
- Sektör, işletmeyi bulan arama teriminden türetilir. Çok hizmetli işletmelerde başka bir atama da savunulabilir; sektör sıralamaları bu kurala bağlıdır.
- İlçe farkları küçük örneklem taşır.
- Üç ilçede denetlenmiş site sayısı 30'un altındadır. Bu satırlar tabloda kalır ama karşılaştırmaya girmez ve manşete taşınmaz.
Alıntı kuralları
Bu altı kural üslup tercihi değil. Bu raporda bir sayıyı yanlış çerçevelemek, bir tercihi kusura ya da bir hazırlık ölçüsünü bir kehanete çevirir.
- 01Engelleme bir hata değil, bir tercihtir; "kural koymamış" ile "engellemiş" ayrı raporlanır.
- 02Skor bir kalite yargısı değil, görünürlük ölçüsüdür; düşük skor kötü işletme demek değildir.
- 03Yalnızca ana sayfa ölçüldüğü için içerik ve şema oranları alt sınırdır.
- 04Bot listesi tarih damgalıdır; başka bir tarihte başka botlar olacaktır.
- 05"Yapay zekâ bu işletmeyi bulamıyor" denmez; "bu siteden yanıt üretebilmesi için gereken koşullar eksik" denir.
- 06llms.txt henüz taslak bir öneridir; yokluğu eksiklik olarak değil, benimsenme ölçüsü olarak sunulur.
Yöntem, kısaca
- 01EvrenMersin / State of Digital 2026 çalışmasının veri seti: 4.167 denetlenen alan adı, bunların 3.395'i erişilebilir. İşletme evreni Google'da aktif görünen 19.615 yerel işletmedir; bu sitelerin arkasında 3.928 işletme vardır.
- 02Tarama ve nezaket kurallarıAlan adı başına en fazla üç GET: /robots.txt, /llms.txt, /llms-full.txt. Kendini tanıtan bir User-Agent, düşük eşzamanlılık ve istekler arası bekleme kullanıldı. robots.txt önce okundu ve bu araştırma botunu engelleyen sitelerde llms.txt istekleri hiç yapılmadı. Sonuçlar veritabanına yazıldığı için tekrar çalıştırmak yeni istek üretmez.
- 03robots.txt değerlendirmesiHer bot için yalnızca kök dizin ("/") değerlendirildi. Eşleşme büyük/küçük harf duyarsız, en uzun yol kuralı kazanır, eşitlikte allow öne geçer, tam token eşleşmesi joker grubunu ezer. "Kural yok" ile "engellendi" ayrı sayıldı.
- 04Yapılandırılmış veri ve içerikAna sayfa HTML'i 2026·08·25 önbelleğinden okundu; bu bölüm için yeni istek yapılmadı. JSON-LD blokları ayrıştırıldı, bozuk bloklar ayrı sayıldı. İçerik ölçümleri statik HTML üzerinden yapıldı.
- 05JavaScript testiStatik HTML'de 120 kelimeden az metin varken Playwright'ın gördüğü sayfa 2,5 kattan büyükse içerik JavaScript'e bağımlı sayıldı. Bu test 3.364 site üzerinde çalıştırılabildi.
- 06Skor ve eşiklerAltı bileşenin ağırlıklı 0-100 birleşimi; ölçülemeyen bileşen paydan ve paydadan düşer, kapsam %60'ın altındaysa skor yayımlanmaz. 3.382 site skorlandı, 13'ü skorlanamadı. Sektörler karşılaştırmaya yalnızca 50 ve üzeri denetlenmiş site varsa alındı; 30 sektör bu eşiği geçti.
| Denetlenen alan adı | 4.167 |
|---|---|
| robots.txt taranan site | 3.395 |
| Ana sayfası okunabilen site | 3.382 |
| Skorlanabilen site | 3.382 |
| Sitelerin arkasındaki işletme | 3.928 |
Kaynaklar
- 01robots.txt / llms.txt taraması (bu çalışma)Serinin tek yeni saha ölçümü. Alan adı başına en fazla üç GET isteği yapıldı: /robots.txt, /llms.txt ve /llms-full.txt. Başka hiçbir sayfa istenmedi. Tarama penceresi 2026·08·27 16:28 → 16:44 UTC. robots.txt önce okundu; bu araştırma botunu kök dizinden engelleyen sitelerde llms.txt istekleri hiç yapılmadı.
- 02Nixeny Dijital · Mersin / State of Digital 2026Aynı evren, aynı işletme kümesi. Bu raporun kullandığı 4.167 alan adı, 3.395 erişilebilir site ve 3.382 ana sayfa önbelleği o çalışmadan gelir; ana sayfa HTML'i 2026·08·25 tarihinde alınmıştır. Yapılandırılmış veri ve içerik ölçümleri o önbellek üzerinde yapıldı, yeniden istek gönderilmedi.nixeny.com
- 03Bot listesi19 user-agent token'ı: OpenAI, Anthropic, Perplexity, Google, Apple, Meta, ByteDance, Common Crawl, Amazon, Cohere, You.com ve Diffbot botları, artı kontrol grubu olarak Googlebot ve Bingbot. Liste tarih damgalıdır ve `config/ai-readiness.json` içinde açıktır; başka bir tarihte başka botlar olacaktır.
- 04robots.txt yorumlama kurallarıHer bot için yalnızca kök dizin değerlendirilir. Eşleşme büyük/küçük harf duyarsızdır, en uzun yol kuralı kazanır, eşitlikte allow öne geçer ve tam token eşleşmesi joker (*) grubunu ezer.www.rfc-editor.org
- 05schema.org · LocalBusinessYapılandırılmış veri alanlarının tanımı. Bu çalışmada aranan alanlar: name, address, telephone, openingHours / openingHoursSpecification, geo, priceRange ve aggregateRating.schema.org
- 06llms.txt önerisiDosyanın biçimini tanımlayan taslak. Bir standart değil, bir öneridir; bu rapor benimsenmeyi ölçer, uyumu değil.llmstxt.org
Bu raporun sayıları başka bir ilin veya ülkenin ölçümüyle karşılaştırılmadı. Farklı bir bot listesiyle, farklı bir tarihte ve farklı bir paydayla üretilmiş bir “dünya ortalaması” yan yana konduğunda iki sayı aynı şeyi ölçüyormuş gibi görünür. Mersin / State of Digital 2026 ile ortak olan, evren ve ana sayfa önbelleğinin tarihidir; robots.txt taraması bu çalışmaya özgüdür ve iki gün sonra yapılmıştır.
Künye
Araştırmayı yürüten ve yayınlayan: Nixeny Dijital, Mersin. Tarama, skorlama ve rapor tasarımı Nixeny tarafından yapılmıştır. Evren ve site listesi Mersin / State of Digital 2026 çalışmasıyla ortaktır. Bu rapor için alan adı başına en fazla üç istek gönderilmiştir: robots.txt, llms.txt ve llms-full.txt.
Bir işletme kendi sitesinin bu çalışmadaki satırını öğrenmek isterse, alan adını yazması yeterli. Yöntem, bot listesi ve doğrulama kayıtları da talep üzerine paylaşılır: info@nixeny.com