Nixeny DijitalMersin AI Readiness 2026 · 27 августа 2026 г. · nixeny.com
Исследовательский отчёт · 05 / 2026

Nixeny Dijital - Mersin / AI Readiness 2026

У 3 395 корпоративных сайтов Мерсина был запрошен файл robots.txt, и 3 382 главных страниц изучены на машиночитаемость. Доля сайтов, на которых ассистент может ответить на вопрос «где эта компания, когда она открыта, какой у неё телефон» прямо с сайта, составляет 4,5 %. Один вопрос: что компании Мерсина рассказывают машине?

4,5 %
сайтов позволяют ИИ ответить на вопрос
152 / 3 382
89,0 %
сайтов не написали для ИИ-краулеров ни одного правила
n = 3 395
331
сайтов осознанно блокируют ИИ-краулеров
9,8 % · это выбор
Данные главных страниц 2026·08·25 · запрос robots.txt 2026·08·27 · Публикация 2026·08·27 · Nixeny Dijital · nixeny.com
00

Что эти цифры измеряют и чего не измеряют

Четыре замечания · каждое — ограничение
01 · Измерялись условия, а не результаты

В этом исследовании ни одной ИИ-модели не было задано ни одного вопроса. То, какую компанию ассистенты на самом деле цитируют, не измерялось. Измерялось лишь одно: выполнены ли условия, нужные ассистенту, чтобы получить ответ с этого сайта. Фраза «ИИ не находит эту компанию» из этих данных не следует.

02 · Блокировка — это выбор

Блокировать ИИ-краулеров — законное решение, и в этом отчёте оно считается решением, а не ошибкой. 3021 сайт, не написавший ни одного правила, и 331 сайт, блокирующий осознанно, ни в одной таблице не объединяются: первые никогда не обсуждали этот вопрос, вторые обсудили и решили.

03 · Только главная страница

Измерения содержимого и структурированных данных выполнены только по главной странице. Схема, список услуг или частые вопросы на внутренних страницах не видны. Это значит, что все доли по схеме и содержимому здесь — НИЖНЯЯ ГРАНИЦА: реальная доля может быть выше, но не ниже.

04 · Список с отметкой даты

Имена ботов и их политики меняются за месяцы; бот, которого сегодня нет, через год может возглавить список. Доли здесь осмысленны только вместе со стоящим рядом списком из 19 ботов и не переносятся на другую дату.

Глоссарий · каждый термин объяснён один раз

ИИ-видимость
Тема этого отчёта: сколько из условий, нужных ИИ-ассистенту, чтобы получить ответ с корпоративного сайта, выполнено. Не оценка качества, а мера читаемости.
База
В этом отчёте три основные базы: 3395 сайтов с запрошенным robots.txt, 3382 сайта с читаемой главной страницей и 4167 проверенных доменов. Внутри разделов есть и более узкие (генераторы llms.txt считаются по 352 файлам). Рядом с каждой долей указано, о какой из них речь.
robots.txt
Текстовый файл в корне сайта, сообщающий, какому боту куда можно. Он добровольный, а не обязывающий: боты сами решают его соблюдать. В этом исследовании для каждого бота оценивался только корневой путь ("/").
Обучающий бот / поисковый бот
Обучающий бот (GPTBot, ClaudeBot, Google-Extended) собирает содержимое, чтобы обучить модель. Поисковый бот (OAI-SearchBot, PerplexityBot) находит и цитирует источник, когда задан вопрос. Блокировать обоих одним правилом значит закрыть и возможность быть процитированным.
Нет правила ≠ заблокировано
Если в robots.txt для бота нет правила, поведение по умолчанию — разрешать доступ. Поэтому сайты, «не написавшие ни одного правила», и сайты, «блокирующие осознанно», нигде в этом отчёте не попадают в одну корзину.
Структурированные данные (JSON-LD)
Встроенная в страницу информация в виде, который машина читает напрямую: название, адрес, телефон, часы работы. Человеку не видна. В этом исследовании читался только JSON-LD; микроданные и RDFa вне охвата.
Схема LocalBusiness
Тип структурированных данных, который говорит: «это местная компания». Это стандартный способ представиться машине как компания; без него ассистенту приходится угадывать, что это за страница, по тексту.
Тройка «название-адрес-телефон»
Наличие в структурированных данных всех трёх: названия компании, точного адреса и телефона. Если одного из трёх нет, ассистент либо не даёт ответ, либо берёт его из другого источника — чаще всего из справочника.
llms.txt
Файл, предложенный для того, чтобы кратко изложить ИИ-ассистентам содержимое сайта. Пока это черновое предложение, а не стандарт. Поэтому его отсутствие отражается не как недостаток, а как мера распространённости.
Отвечаемость
Выполнение всех четырёх условий, нужных ассистенту, чтобы ответить на вопрос «где эта компания, когда она открыта, какой у неё телефон» прямо с сайта: поиск не заблокирован, тройка «название-адрес-телефон» полна, часы работы есть и содержимое видно без запуска JavaScript.
Зависимость от JavaScript
В статическом HTML меньше 120 слов текста, а отрисованная браузером страница показывает больше чем в 2,5 раза больше. Главные страницы этих сайтов выглядят пустыми для браузера, не выполняющего JavaScript.
Балл видимости
Взвешенная сводка 0-100 из шести компонентов: разрешение доступа (25), структурированные данные (25), глубина содержимого (20), техническая основа (15), готовность к ответу (10), llms.txt (5). Неизмеримый компонент выпадает и из числителя, и из знаменателя; при покрытии ниже 60 % балл не публикуется.
01

Четыре сайта из ста могут ответить на вопрос

База: 3 382 сайтов с читаемой главной страницей

Чтобы ИИ-ассистент мог ответить на самый обычный вопрос о компании — где она, когда открыта, какой у неё телефон — прямо с сайта самой компании, нужны четыре вещи: robots.txt не должен блокировать поиск, тройка «название-адрес-телефон» в структурированных данных должна быть полной, часы работы должны быть там же, а содержимое должно быть видно и без запуска JavaScript.

Всем четырём отвечают 152 сайтов — 4,5 %. Эти сайты представляют 170 компаний. Для остальных ассистент либо молчит, либо берёт ответ откуда-то ещё, чаще всего из справочника.

Рис. 01 · Условия на пути к отвечаемости
n = 3 382 сайтов

Каждый столбик — число сайтов, не выполняющих это одно условие. Сайт может споткнуться сразу на трёх, поэтому строки не суммируются и не читаются как разбиение; порядок задан тем, как часто условие срабатывает.

152
Выполняет все четыре условия
4,5 % · 170 компаний
3 188
Не хватает: Часов работы нет в структурированных данных
94,3 % · n = 3 382
2 925
Не хватает: Тройка «название-адрес-телефон» неполна в структурированных данных
86,5 % · n = 3 382
2 450
Не хватает: Нет структурированных данных о компании (LocalBusiness/Organization)
72,4 % · n = 3 382
155
Не хватает: Содержимое приходит только с JavaScript
4,6 % · n = 3 382
136
Не хватает: ИИ-поиск заблокирован в robots.txt
4,0 % · n = 3 382
Источник: запрос robots.txt 2026·08·27 и кэш главных страниц 2026·08·25 · Самое частое препятствие — часы работы: их нет в структурированных данных 3 188 сайтов. Самое редкое — robots.txt: ИИ-поиск закрыли всего 136 сайта.
Число сайтов, закрывших дверь перед ИИ (331), больше числа сайтов, с которых ИИ может ответить на вопрос (152).
Оба показателя по базам 3 395 / 3 382
02

89,0 % сайтов не написали для ИИ ни одного правила

База: 3 395 сайтов с запрошенным robots.txt

robots.txt — это файл, в котором сайт сообщает, какого бота и куда он пускает. 2 227 сайтов (65,6 %) имеют такой файл; но число сайтов, где внутри есть хотя бы одно правило для ИИ-краулеров, — всего 374. Для остальных 3 021 сайтов тема ещё не поднималась.

Не написать правило — не значит заблокировать: если в robots.txt для бота нет положения, поведение по умолчанию — разрешать доступ. Поэтому эти две строки нигде в отчёте не объединяются. Одни никогда не обсуждали вопрос, другие обсудили и решили.

Рис. 02 · Правила для ИИ в robots.txt
n = 3 395 сайтов

Семь прочтений одного и того же файла по одной базе. Строка «задано хотя бы одно правило» — сумма решений разрешить и запретить; две строки под ней делят эту сумму. Строка Googlebot — контрольная.

Для ИИ-ботов нет ни одного правила
89,0 %
3 021
Задано хотя бы одно правило для ИИ
11,0 %
374
Блокирует хотя бы одного ИИ-бота
9,8 %
331
Блокирует обучение ИИ
9,8 %
331
Блокирует ИИ-поиск
4,0 %
136
Блокирует Googlebot (контроль)
0,3 %
11
Задан Crawl-delay
7,0 %
239
Источник: запрос robots.txt 2026·08·27 · Для каждого бота оценивался только корневой путь ("/"). Блокировка считается здесь решением, а не ошибкой.

Состояние сайтов можно увидеть одним разбиением. Четыре корзины ниже охватывают все 3 395 сайтов и в сумме дают базу — но корзина «закрыто» не низ рейтинга, а нечто вне остальных трёх. Сайт там ответил на вопрос; сайт в корзине «невидимо» с этим вопросом не встречался.

Рис. 03 · Корзины готовности
n = 3 395 сайтов

Каждый из ста квадратов представляет примерно 34 сайтов. Корзины взаимоисключающие и в сумме дают базу.

Готово — 132 сайтов (3,9 %)Выполняет все четыре условия
Частично готово — 704 сайтов (20,7 %)Ассистент может что-то прочитать
Невидимо — 2 228 сайтов (65,6 %)Дверь открыта, читать нечего
Закрыто — 331 сайтов (9,8 %)Осознанная блокировка в robots.txt
Источник: запрос robots.txt и кэш главных страниц · Корзина «готово» — это 132 сайтов, выполняющих все четыре условия из Рисунка 01. 331 сайтов в корзине «закрыто» представляют 368 компаний.
03

ИИ-краулеров блокируют в 25 раз чаще поисковых

База: 3 395 сайтов · 19 ботов

Единственный способ понять, общая ли это закрытость или различие, специфичное для ИИ, — посмотреть, что те же сайты делают с классическими поисковыми ботами. 331 сайтов блокируют в корне хотя бы одного ИИ-краулера; Googlebot и Bingbot блокируют 13 сайтов. Разница — 25,5 раза.

То есть отвергается не сканирование, а определённое использование просканированного. Те же сайты пускают поисковые машины внутрь.

Рис. 04 · Блокировка по группам ботов
n = 3 395 сайтов

Четыре группы, одна база. Контрольная группа — классические поисковые боты: Googlebot и Bingbot. Столбец «упомянут» считает случаи, когда сайт пишет имя этой группы в robots.txt: упомянуть не значит заблокировать, бот может быть упомянут и для того, чтобы его разрешить.

Обучающие ИИ-боты
упомянут в robots.txt: 346 (10,2 %)
9,4 %
318 сайтов
Поисковые ИИ-боты
упомянут в robots.txt: 171 (5,0 %)
3,9 %
131 сайтов
Боты, загружающие по запросу пользователя
упомянут в robots.txt: 160 (4,7 %)
4,0 %
135 сайтов
Классические поисковые боты (контроль)
упомянут в robots.txt: 68 (2,0 %)
0,4 %
13 сайтов
Источник: запрос robots.txt 2026·08·27 · Против 318 сайтов, блокирующих обучающих ботов, стоят 13 сайтов, блокирующих классических поисковых.

При взгляде бот за ботом видно, что блокировка — работа со списком: доли блокировки обучающих ботов очень близки друг к другу, потому что одни и те же сайты перечисляют их одним блоком. В нескольких строках блокирующих больше, чем упомянувших, — там правило пишет групповой шаблон (*), и собственное имя бота в файле не встречается.

Рис. 05 · Доля блокировки, бот за ботом
n = 3 395 сайтов

Каждая строка — токен user-agent. Цвет показывает задачу бота: красный — обучение, тёмно-синий — поиск, светло-синий — загрузка по запросу пользователя, серый — классический поиск (контроль).

Доли упоминания и блокировки, бот за ботом
БотЗадачаУпомянутБлокируютДоля
GPTBot (OpenAI, обучение)обучение3463129,2 %
OAI-SearchBot (поиск ChatGPT)поиск62401,2 %
ChatGPT-User (по запросу пользователя)запрос пользователя1601354,0 %
ClaudeBot (Anthropic, обучение)обучение3363089,1 %
Claude-User (по запросу пользователя)запрос пользователя40401,2 %
Claude-SearchBot (поиск Claude)поиск43411,2 %
PerplexityBot (поисковый индекс)поиск1711313,9 %
Perplexity-User (по запросу пользователя)запрос пользователя32381,1 %
Google-Extended (обучение Gemini)обучение3343059,0 %
Applebot-Extended (Apple Intelligence)обучение3163059,0 %
meta-externalagent (Meta AI)обучение2142186,4 %
Bytespider (ByteDance)обучение3093139,2 %
CCBot (Common Crawl)обучение3203189,4 %
Amazonbotобучение3033089,1 %
cohere-aiобучение44451,3 %
YouBot (You.com)поиск1271313,9 %
Diffbotобучение1251364,0 %
Googlebot (классический поиск)классический поиск68110,3 %
Bingbot (классический поиск + Copilot)классический поиск40130,4 %
Источник: запрос robots.txt 2026·08·27 · Список датирован: имена ботов и их политики меняются за месяцы, и эти доли осмысленны только вместе с этим списком из 19 ботов.
04

У 352 сайтов есть llms.txt; половину написал плагин

База: 3 395 сайтов · разбивка по генераторам по 352 файлам

llms.txt — файл, предложенный для того, чтобы кратко изложить ИИ-ассистентам содержимое сайта. Это пока не стандарт, а черновое предложение — поэтому его отсутствие следует читать как меру распространённости, а не как недостаток. Он есть у 352 сайтов (10,4 %); более подробный llms-full.txt — лишь у 30.

Главная находка — не сама цифра, а то, кто её написал. 183 из этих 352 файлов (52,0 %) созданы автоматически плагином или платформой. То есть эта цифра измеряет не решение компаний об ИИ, а примечания к выпуску инструмента, которым они пользуются.

Рис. 06 · Распространение llms.txt и кто создал файлы
Верхний блок n = 3 395 сайтов · нижний блок n = 352 файлов

Две разные базы, одна над другой. Доли в нижнем блоке — распределение существующих файлов, а не суммы сайтов: если читать их по 3395, каждая строка окажется на порядок неверной.

Публикует llms.txt
10,4 %
352 / 3 395
Публикует llms-full.txt
0,9 %
30 / 3 395
Кто создал файл · база 352 llms.txt
не указано
48,0 %
169 файлов
Wix
28,4 %
100 файлов
All in One SEO
11,4 %
40 файлов
Rank Math
4,6 %
16 файлов
Shopify
4,3 %
15 файлов
Yoast SEO
2,8 %
10 файлов
другой плагин
0,6 %
2 файлов
Источник: запрос llms.txt и llms-full.txt 2026·08·27 · «Не указано» — файлы, в которых нет подписи, называющей их создателя; они могут быть написаны вручную.
05

Сайты, где машина может прочитать часы работы: 5,7 процента

База: 3 382 сайтов с читаемой главной страницей

Структурированные данные — это встроенная в страницу информация, которую видит только машина: название, адрес, телефон, часы работы. Доля сайтов, у которых на главной странице есть хоть какой-то блок JSON-LD, — 33,9 %. Но дальше вниз число падает на каждом шаге: представляются компанией 10,7 %, имеют полную тройку «название-адрес-телефон» 13,5 %, указывают часы работы 5,7 %.

Это падение и есть тема отчёта. Единственное поле, нужное ассистенту, чтобы ответить «открыто ли сейчас», есть у одного сайта из двадцати.

Рис. 07 · Поля структурированных данных, найденные на главной странице
n = 3 382 сайтов

Сужающийся ряд: сначала любой JSON-LD, затем типы компаний, затем три сведения, которые ассистенту действительно нужны, чтобы ответить на вопрос.

Любой блок JSON-LD
33,9 %
1 146
Схема Organization
19,7 %
666
Полная тройка «название-адрес-телефон»
13,5 %
457
Схема LocalBusiness
10,7 %
363
Часы работы
5,7 %
194
Сведения о цене
5,2 %
175
Координаты (geo)
4,5 %
151
Сводная оценка (aggregateRating)
1,9 %
63
Испорченный блок JSON-LD
0,7 %
23
Источник: кэш главных страниц 2026·08·25 · Читался только JSON-LD; микроданные и RDFa вне охвата. Поскольку изучалась только главная страница, доли являются НИЖНЕЙ ГРАНИЦЕЙ.
Рис. 08 · Распределение полноты схемы
n = 3 382 сайтов

Процент полноты по восьми полям. Медиана равна нулю: больше чем у половины сайтов нет ни одного засчитываемого поля, поэтому вместо среднего приводится само распределение.

0
2 238
site
1-25
191
site
26-50
537
site
51-75
278
site
76-100
138
site
Источник: кэш главных страниц 2026·08·25 · 2 238 сайтов с нулевой полнотой (66,2 %) — это сайты, у которых JSON-LD нет вовсе или внутри нет ни одного из искомых полей.
Рис. 09 · Типы схем, которые могут стать ответом
n = 3 382 сайтов

Типы, которые ассистент может процитировать напрямую. FAQPage и Question несут готовый ответ на вопрос; Offer, Service и Product сообщают, что это за услуга и сколько она стоит.

FAQPage
3,6 %
123
Question
3,6 %
120
Offer
2,0 %
69
Service
1,6 %
53
Product
0,6 %
19
HowTo
0,0 %
1
Menu
0,0 %
1
Источник: кэш главных страниц 2026·08·25 · Ось заканчивается на 5 %: даже FAQPage, самый распространённый тип, встречается на 3,6 % сайтов.
06

Главные страницы 155 сайтов выглядят для краулера пустыми

База: 3 382 сайтов · тест JavaScript на 3 364 сайтах

Если структурированных данных нет, остаётся сам текст. Медианная главная страница содержит 382 слов; четверть из них — меньше 176. У большинства сайтов есть что прочитать: 81,7 % сайтов находятся в корзине «достаточно» или «богато».

Проблема на краях. Содержимое 155 сайтов появляется только при выполнении JavaScript — то есть ИИ-краулер, не выполняющий JavaScript, увидит эту главную страницу пустой. Кроме того, на главных страницах 150 сайтов меньше 120 слов текста.

Рис. 10 · Корзины глубины содержимого
n = 3 382 сайтов

Четыре корзины по числу слов статического текста на главной странице. Корзины взаимоисключающие и в сумме дают базу.

Богато — 590 сайтов (17,5 %)1000+ слов
Достаточно — 2 172 сайтов (64,2 %)300-999 слов
Скудно — 470 сайтов (13,9 %)120-299 слов
Текста нет — 150 сайтов (4,4 %)менее 120 слов
Источник: кэш главных страниц 2026·08·25 · Медиана 382 слов, 90-й процентиль 1 236 слов. Поскольку считается только главная страница, глубина внутренних страниц не видна.
Рис. 11 · Сигналы ответа, найденные в тексте
n = 3 382 сайтов

Шесть признаков, которые ассистент ищет в тексте, когда структурированных данных нет. Телефонная ссылка (tel:) машиночитаема без всякой схемы; это единственная строка выше половины.

Телефонная ссылка (tel:)
52,4 %
1 772
Структура заголовков выстроена
39,1 %
1 322
Частые вопросы
17,1 %
578
Список услуг
17,0 %
574
Часы работы (в тексте)
16,1 %
545
Цена или меню
13,2 %
447
Источник: кэш главных страниц 2026·08·25 · Эти сигналы не заменяют структурированные данные: прочитанное в тексте ассистент не может передать с той же уверенностью, что прочитанное в схеме.
Страницы, выглядящие для краулера пустыми
155
Содержимое приходит только с JavaScript
4,6 % · n = 3 364
150
На главной странице нет текста вовсе
4,4 % · n = 3 382

Эти две строки — не одни и те же сайты и не суммируются: первая считает сайты, подгружающие текст позже, вторая — те, у которых на главной странице текста нет вовсе. Итог в обоих случаях один: бот, не выполняющий страницу как браузер, не находит там ничего для чтения.

07

Медианный сайт получает ноль по двум компонентам из шести

База: 3 382 оцениваемых сайтов

Шесть компонентов дают взвешенный балл 0-100: разрешение доступа (25), структурированные данные (25), глубина содержимого (20), техническая основа (15), готовность к ответу (10) и llms.txt (5). Медиана 53,8, квартили — между 44,5 и 63,7.

Балл — не оценка качества, а мера видимости: низкий балл не значит плохую компанию, он значит, что машине меньше что читать. Разбор по компонентам показывает, откуда берётся распределение: медианный сайт получает полный балл за разрешение доступа и ноль по двум компонентам.

Рис. 12 · Распределение балла видимости
n = 3 382 сайтов

Пять корзин, в сумме равных базе. Распределение собирается посередине: половина сайтов в полосе 40-59.

0-19
36
site
20-39
533
site
40-59
1 689
site
60-79
895
site
80-100
229
site
Источник: взвешенная сводка шести компонентов · Минимум 5,0, максимум 100,0. 13 сайтов с покрытием ниже 60 % не оценивались и не считались нулём.
Рис. 13 · Буквенные оценки
n = 3 382 сайтов

Каждый из ста квадратов представляет примерно 34 сайтов.

A+ — 81 (2,4 %)
A — 148 (4,4 %)
B — 301 (8,9 %)
C — 1 057 (31,3 %)
D — 1 226 (36,3 %)
E — 525 (15,5 %)
F — 44 (1,3 %)
Источник: тот же балл · Границы оценок фиксированы и не нормированы под распределение этого года, чтобы повтор в 2027-м был прямо сопоставим.
Рис. 14 · Медиана компонентов балла
Каждый компонент — по своему числу измеримых сайтов

Вес компонента указан рядом. У двух компонентов медиана равна нулю: это не пробел в данных, а сама находка — больше чем у половины сайтов нет ни структурированных данных, ни llms.txt.

Разрешение доступа (robots.txt)
вес 25 · n = 3 395
100,0
Структурированные данные
вес 25 · n = 3 382
0,0
Глубина содержимого
вес 20 · n = 3 382
68,8
Техническая основа
вес 15 · n = 3 395
75,0
Готовность к ответу
вес 10 · n = 3 382
25,0
llms.txt
вес 5 · n = 3 395
0,0
Источник: собственные измерения шести компонентов · Неизмеримый компонент выпадает для сайта и из числителя, и из знаменателя, он не считается нулём.
08

Решает не отрасль, а установленная платформа

Порог отрасли: 50+ проверенных сайтов · 30 отраслей

Разрыв между отраслями узок. Медианы 30 отраслей зажаты между 33,8 и 64,4, а их медиана — 52,9. Разрыв между платформами больше: 68,9 у Wix, 48,8 у собственных разработок.

Яснее всего это показывает строка со схемой LocalBusiness: 53,7 % сайтов на Wix представляются машине компанией, против 8,9 % у собственных разработок. Разницу между сайтом адвоката и сайтом автосервиса создают не адвокатура и не ремонт машин, а инструмент, на котором собраны эти два сайта.

Рис. 15 · Видимость по платформам
База медианного балла — число сайтов; база доли схем — число читаемых главных страниц

Две базы в одной строке не совпадают, и не должны: медианный балл считается по всем опрошенным сайтам, а доля LocalBusiness — по тем, чью главную страницу удалось прочитать.

Медианный балл видимости и доли схем по платформам
ПлатформаСайтовМедианный баллLocalBusinessНазв.-адр.-тел.Отвечаемость
Wix12168,953,7 %43,8 %1,7 %
Ticimaxсравнение4866,94,2 %81,3 %4,2 %
Next.js14661,439,0 %39,0 %19,2 %
WordPress55959,47,7 %8,8 %3,8 %
WooCommerce38658,85,2 %5,7 %2,3 %
IdeaSoftсравнение3756,30,0 %5,4 %0,0 %
Собственная разработка1 91248,88,9 %11,2 %4,6 %
Источник: кэш главных страниц 2026·08·25 · Строки, помеченные «сравнение», содержат менее 50 сайтов и в заголовки не выносятся.
Рис. 16 · Распределение отраслевых медиан
30 отраслей · по 50+ проверенных сайтов

Каждый штрих — медианный балл одной отрасли. Высота штриха информации не несёт; она меняется по трёхтактному циклу лишь для того, чтобы совпадающие значения оставались различимыми. Красная линия — медиана отраслевых медиан.

МЕДИАНА 52,9
%0%25%50%75%100
Источник: взвешенная сводка шести компонентов · Узость распределения и есть находка: весь диапазон в 30,6 пункта меньше разрыва, который открывает одна смена платформы.
Рис. 17 · Восемь самых высоких отраслей
n = 50+ сайтов
Магазин одеждыn 55
64,4 %
Адвокатn 72
63,7 %
Транспортная компанияn 59
60,3 %
Клининговая компанияn 58
59,1 %
Мебельный магазинn 71
57,5 %
Магазин телефонов и электроникиn 107
57,3 %
Кейтеринговая компанияn 51
57,3 %
Автосервисn 73
57,0 %
Доля рядом — часть сайтов этой отрасли, несущих схему LocalBusiness.
Рис. 18 · Восемь самых низких отраслей
n = 50+ сайтов
Магазин стройматериаловn 67
50,4 %
Строительная компанияn 83
49,5 %
Упаковочная компанияn 50
49,1 %
Учебный центрn 66
48,5 %
Международные перевозки / экспедированиеn 86
48,3 %
Таможенное оформлениеn 66
45,0 %
Ясли / детский садn 56
43,8 %
Частная школаn 87
33,8 %
Отрасли внизу рейтинга — это не рейтинг качества; это отрасли, публикующие меньше того, что машина может прочитать.
Рис. 19 · Видимость по районам
13 районов · 3 395 сайтов

Находка этого рисунка — его плоскость. Тогда как по другим измерениям серии между районами разница в разы, ИИ-видимость с географией не движется.

Yenişehir
56,6
n 961
Mezitli
54,5
n 402
Tarsus
54,5
n 364
Erdemli
54,5
n 189
Silifke
53,3
n 207
Toroslar
52,5
n 257
Aydıncık
52,5
n 14
Bozyazı
52,3
n 36
Anamur
52,0
n 128
Gülnar
52,0
n 28
Akdeniz
51,2
n 716
Mut
50,0
n 48
Çamlıyayla
46,7
n 14
Источник: кэш главных страниц 2026·08·25 · Серые строки содержат менее 100 сайтов и в сравнение не входят. 31 сайтов, район которых не удалось определить, не оценивались приблизительно, а были отложены.
09

Это исследование не задало ИИ ни одного вопроса

Измерено: условия · Не измерено: результат

Все цифры этого отчёта измеряют готовность: сколько из того, что нужно ассистенту, чтобы получить ответ с этого сайта, находится на месте. Ни одна из них не измеряет, что ассистент делает на самом деле.

В этом исследовании ни одной модели не был задан ни один вопрос. Фраза «часов работы нет в структурированных данных» верна и проверяема; фраза «ИИ не находит эту компанию» из этих данных не следует. Ассистенты получают ответы и из справочников, и из картографических сервисов, и из источников, на которые это исследование вовсе не смотрело. Этот разрыв отчёт и не собирался закрывать.

Точно так же то, что 331 сайтов блокируют ИИ-краулеров, — не изъян. Компания может не хотеть, чтобы её содержимое использовали для обучения моделей, и говорится это именно так. Этот отчёт считает такое решение, но не оценивает его.

Что можно сказать по этим данным
  • Что сайты местных компаний не настроены отвечать ИИ-ассистентам — доля сайтов, выполняющих все четыре условия, 4,5 %.
  • Что тема ИИ-краулеров ещё не стоит на повестке местных компаний: 89,0 % сайтов не написали для этих ботов ни одного правила.
  • Что блокировка — различие, специфичное для ИИ: те же сайты пускают классических поисковых ботов, разница более чем в 25 раз.
  • Что разница в основном идёт из настроек используемой платформы по умолчанию: медианный разрыв между платформами больше разрыва между отраслями.
  • Что 155 сайтов, содержимое которых приходит только с JavaScript, выглядят пустыми для краулеров, его не выполняющих.
Чего нельзя сказать по этим данным
  • «ИИ не находит эти компании» — ни одной модели ничего не задавалось; измерялись условия, а не результаты.
  • «Этот сайт поступает неправильно, блокируя ИИ» — блокировка является законным выбором и считается здесь решением.
  • «У X % сайтов нет схемы» — верная формулировка: «не обнаружена на главной странице»; внутренние страницы и форматы вне JSON-LD не рассматривались.
  • Что доли по ботам устойчивы — имена ботов и их политики меняются за месяцы.
  • Что сайты с llms.txt приняли решение об ИИ — больше половины файлов автоматически создал плагин.
Измерялось не то, что ассистент делает, а то, что ассистент мог бы найти на этом сайте.
Условия измерены, результаты — нет

Ограничения

Один срез во времени.
robots.txt и llms.txt измерены в том состоянии, в каком находились в момент запроса. Сайт мог изменить своё правило на следующий день; это исследование показывает тот момент, а не изменение.
Измерялись условия, а не результаты.
То, какой сайт ассистенты цитируют на самом деле, не измерялось. Быть разрешённым не гарантирует цитирования; быть заблокированным не значит быть невидимым.
Боты не обязаны соблюдать robots.txt.
Файл — добровольное соглашение. Некоторые боты его не соблюдают. Поэтому «заблокировал» не значит «не вошёл», а значит «попросил не входить».
Читался только JSON-LD.
Структурированные данные оценивались только по блокам JSON-LD. Микроданные и RDFa вне охвата; сайты, использующие эти форматы, выглядят здесь как «схемы нет».
Измерения содержимого ограничены главной страницей.
Глубина страниц блога, услуг и контактов не видна. Сайт с богатой внутренней структурой может выглядеть низко из-за скудной главной страницы.
Отнесение к отрасли — эвристика.
Отрасль выводится из поискового запроса, по которому нашлась компания. Для компаний с несколькими направлениями можно защищать и другое отнесение; отраслевые рейтинги зависят от этого правила.
Различия между районами опираются на малую выборку.
В трёх районах число проверенных сайтов меньше 30. Эти строки остаются в таблице, но в сравнение не входят и в заголовки не выносятся.

Правила цитирования

Эти шесть правил — не вопрос стиля. Неверно поданная цифра в этом отчёте превращает выбор в изъян, а меру готовности — в пророчество.

  1. 01Блокировка — это выбор, а не ошибка; «не написал правила» и «заблокировал» приводятся раздельно.
  2. 02Балл — мера видимости, а не оценка качества; низкий балл не значит плохую компанию.
  3. 03Поскольку измерялась только главная страница, доли по содержимому и схеме являются нижней границей.
  4. 04Список ботов датирован; на другую дату будут другие боты.
  5. 05Не говорить «ИИ не находит эту компанию»; говорить «условий, нужных для ответа с этого сайта, не хватает».
  6. 06llms.txt пока черновое предложение; его отсутствие подаётся как мера распространённости, а не как недостаток.

Методика, коротко

  1. 01Генеральная совокупностьНабор данных исследования «Мерсин / State of Digital 2026»: 4167 проверенных доменов, из них 3395 доступны. Совокупность компаний — 19 615 местных компаний, видимых на Google как активные; за этими сайтами стоят 3928 компаний.
  2. 02Запрос и правила вежливостиНе более трёх GET-запросов на домен: /robots.txt, /llms.txt, /llms-full.txt. Использовались представляющийся User-Agent, низкая параллельность и пауза между запросами. robots.txt читался первым, и на сайты, блокирующие этот исследовательский бот, запросы llms.txt не отправлялись. Результаты записаны в базу данных, поэтому повторный запуск новых запросов не создаёт.
  3. 03Как оценивался robots.txtДля каждого бота оценивался только корневой путь ("/"). Сопоставление нечувствительно к регистру, побеждает правило с самым длинным путём, при равенстве вперёд идёт allow, а точное совпадение токена перебивает групповой шаблон. «Нет правила» и «заблокировано» считались раздельно.
  4. 04Структурированные данные и содержимоеHTML главных страниц читался из кэша от 2026·08·25; для этого раздела новых запросов не делалось. Блоки JSON-LD разбирались, испорченные блоки считались отдельно. Измерения содержимого выполнялись по статическому HTML.
  5. 05Тест JavaScriptЕсли в статическом HTML было меньше 120 слов, а страница, которую видел Playwright, оказывалась более чем в 2,5 раза больше, содержимое считалось зависящим от JavaScript. Этот тест удалось выполнить на 3364 сайтах.
  6. 06Балл и порогиВзвешенная сводка 0-100 из шести компонентов; неизмеримый компонент выпадает из числителя и знаменателя, а при покрытии ниже 60 % балл не публикуется. Оценено 3382 сайта, 13 оценить не удалось. Отрасли входили в сравнение только при 50 и более проверенных сайтах; этот порог прошли 30 отраслей.
Базы
Базы, используемые этим отчётом
Проверенные домены4 167
Сайты с запрошенным robots.txt3 395
Сайты с читаемой главной страницей3 382
Оцениваемые сайты3 382
Компании за сайтами3 928
Сайты без балла
13
не считались нулём
Недоступные домены
772
из 4 167 проверенных доменов

Источники

  1. 01Запрос robots.txt / llms.txt (это исследование)Единственное новое полевое измерение серии. На домен делалось не более трёх GET-запросов: /robots.txt, /llms.txt и /llms-full.txt. Никакие другие страницы не запрашивались. Окно запросов: 2026·08·27 16:28 → 16:44 UTC. robots.txt читался первым; на сайты, блокирующие этот исследовательский бот в корне, запросы llms.txt не отправлялись.
  2. 02Nixeny Dijital · Мерсин / State of Digital 2026Та же генеральная совокупность, тот же набор компаний. 4167 доменов, 3395 доступных сайтов и 3382 кэша главных страниц, которыми пользуется этот отчёт, взяты из того исследования; HTML главных страниц получен 2026·08·25. Измерения структурированных данных и содержимого выполнены по этому кэшу, повторных запросов не отправлялось.nixeny.com
  3. 03Список ботов19 токенов user-agent: боты OpenAI, Anthropic, Perplexity, Google, Apple, Meta, ByteDance, Common Crawl, Amazon, Cohere, You.com и Diffbot, плюс Googlebot и Bingbot как контрольная группа. Список датирован и открыто приведён в `config/ai-readiness.json`; на другую дату будут другие боты.
  4. 04Правила толкования robots.txtДля каждого бота оценивается только корневой путь. Сопоставление нечувствительно к регистру, побеждает правило с самым длинным путём, при равенстве вперёд идёт allow, а точное совпадение токена перебивает групповой шаблон (*).www.rfc-editor.org
  5. 05schema.org · LocalBusinessОпределение полей структурированных данных. Искомые в этом исследовании поля: name, address, telephone, openingHours / openingHoursSpecification, geo, priceRange и aggregateRating.schema.org
  6. 06Предложение llms.txtЧерновик, определяющий формат файла. Это предложение, а не стандарт; отчёт измеряет распространённость, а не соответствие.llmstxt.org

Цифры этого отчёта не сравнивались с измерениями другой провинции или страны. «Среднемировой» показатель, полученный по другому списку ботов, на другую дату и по другой базе, при постановке рядом выглядит так, будто обе цифры измеряют одно и то же. С Мерсин / State of Digital 2026 общие генеральная совокупность и дата кэша главных страниц; запрос robots.txt принадлежит только этому исследованию и сделан двумя днями позже.

Выходные данные

Nixeny Dijital - Мерсин / AI Readiness 2026 · Версия 01 · Данные главных страниц 2026·08·25 · запрос robots.txt 2026·08·27 · Публикация 2026·08·27

Проведено и опубликовано Nixeny Dijital, Мерсин. Запрос, расчёт баллов и дизайн отчёта выполнены Nixeny. Генеральная совокупность и список сайтов общие с исследованием «Мерсин / State of Digital 2026». Для этого отчёта на домен отправлялось не более трёх запросов: robots.txt, llms.txt и llms-full.txt.

Если компания хочет узнать свою строку в этом исследовании, достаточно написать доменное имя. Методика, список ботов и журналы проверки также предоставляются по запросу: info@nixeny.com

Цитирование

Как ссылаться на это исследование

Nixeny Dijital (2026). Nixeny Dijital - Mersin / AI Readiness 2026. https://nixeny.com/ru/research/mersin-ai-readiness-2026

Презентация и PDF

Слайды и PDF предоставляются по запросу

Для этого исследования есть презентация, готовая к печати PDF-версия, абсолютные значения за каждым процентом и файлы методики. Они предоставляются прессе, научным и государственным учреждениям при условии указания источника.

Авторские права и условия использования

© 2026 Nixeny Dijital. Все права защищены.

Тексты, анализ, графики, таблицы, изображения и сводные данные, подготовленные в рамках этого исследования, созданы Nixeny Dijital. Ни весь материал, ни существенная его часть не могут быть скопированы, переопубликованы или представлены под названием другой работы без письменного разрешения.

В новостях, статьях и других публикациях допускается ограниченное цитирование исследования. В этом случае источник должен быть прямо указан как «Nixeny Dijital — Nixeny Dijital - Mersin / AI Readiness 2026», а на эту страницу должна быть поставлена действующая ссылка.

Запросы на использование и разрешения: kivanctasci@nixeny.cominfo@nixeny.com