Открытая методология
Как считается score
Score детерминирован: одна и та же страница, посчитанная дважды, даёт одно и то же число. В нём нет ничего от мнения модели — дополнительный разбор от ИИ в платных отчётах стоит рядом со score как доказательство, но не входит в него.
- 1
Собираем страницу так, как её получает crawler
Один запрос по URL с честным user-agent: редиректы проходим вручную и перепроверяем на каждом шаге, таймаут одного шага — 15 секунд, лимит основной страницы — 4 МиБ вместе со структурными ограничениями DOM. Затем за общий 60-секундный бюджет собираем robots.txt, llms.txt, Markdown и карту сайта. Ответ 200, отдающий HTML там, где ожидается текст, считается отсутствием файла: SPA-хостинги отвечают оболочкой приложения на любой путь.
- 2
Извлекаем факты, а не формулировки
HTML разбирается один раз в набор фактов: title, мета-теги, заголовки, ссылки, изображения, блоки JSON-LD, типы microdata и видимый текст без скриптов и шаблонов. На этом этапе ничего не оценивается.
- 3
Выполняем каждую из 31 проверок отдельно
Каждая проверка читает эти факты и начисляет часть своего веса. Проверки не читают друг друга, поэтому одна неудача не тянет за собой остальные. Проверка возвращает баллы, найденные доказательства и — если баллы неполные — исправление.
- 4
Складываем в 6 категорий
Веса подобраны так, чтобы дороже всего стоили те провалы, которые реально убирают вас из ответов ИИ. Блокировка поисковых ИИ в robots.txt — самая тяжёлая одиночная проверка.
- 5
Итог и оценка
Веса пяти основных категорий в сумме дают ровно 100. Готовность к агентам добавляет до 8 бонусных баллов, а отображаемый итог ограничен сотней. Оценка — диапазон по итогу, а вердикт называет самую слабую основную категорию.
- 6
Сортируем исправления
Каждая проверка, потерявшая баллы, отдаёт своё исправление. Сортировка — сначала по возвращаемым баллам, затем по эффекту, чтобы список отвечал на вопрос «что даст больше всего score за одно изменение», а не «что интереснее».
Пройдено, частично или провалено
Проверка пройдена, если набрала все свои баллы; «частично» — больше половины; «провалено» — меньше. Единственное исключение — проверка обучающих crawler'ов: она помечена как информационная, потому что их блокировка — бизнес-решение, а не ошибка.
31 проверка в 6 областях. У каждой — свой вес и объяснение с тем, что мы нашли на вашей странице.
Доступность для crawler'ов
25 баллов- Страница корректно отдаётся боту4
- robots.txt есть и разбирается3
- Поисковые ИИ могут забирать ваши страницы10
- Региональные поисковые ИИ1
- Обучающие crawler'ы1
- sitemap.xml перечисляет ваши страницы4
- llms.txt даёт ИИ подготовленную карту сайта2
Контент без JavaScript
20 баллов- Читаемый текст в серверном HTML8
- Страница — не пустая JavaScript-оболочка6
- Основной контент обёрнут в <main> или <article>3
- Доля текста относительно разметки3
Структурированные данные
25 баллов- Структурированные данные присутствуют6
- Структурированные данные — валидный JSON3
- Организация описана машиночитаемо6
- Продукты или услуги размечены4
- Контент с ответами на вопросы размечен4
- Разметка контекста сайта (WebSite / BreadcrumbList)2
Семантическая ясность
20 баллов- Описательный <title>3
- Meta description описывает страницу3
- Ровно один осмысленный <h1>4
- Заголовки образуют аккуратную структуру3
- Объявлен <html lang>2
- Объявлен канонический URL2
- Метаданные Open Graph2
- У изображений есть alt-текст1
Различимость компании
10 баллов- Контакты машиночитаемы4
- Цены можно найти3
- Понятно, чем занимается компания3
Готовность к агентам
+8 балловБонус, до +8 сверх 100. Здесь почти ни у кого пока нет баллов, поэтому категория может только помочь — она никогда не вычитается.
- Страница может отдаваться в Markdown3
- Интерфейсы для агентов можно обнаружить3
- Content signals объявляют, как можно использовать контент2
Диапазоны оценок
- A 85–100
- B 70–84
- C 55–69
- D 40–54
- F 0–39