Перейти к содержимому
AIVM

Открытая методология

Как считается score

Score детерминирован: одна и та же страница, посчитанная дважды, даёт одно и то же число. В нём нет ничего от мнения модели — дополнительный разбор от ИИ в платных отчётах стоит рядом со score как доказательство, но не входит в него.

  1. 1

    Собираем страницу так, как её получает crawler

    Один запрос по URL с честным user-agent: редиректы проходим вручную и перепроверяем на каждом шаге, таймаут одного шага — 15 секунд, лимит основной страницы — 4 МиБ вместе со структурными ограничениями DOM. Затем за общий 60-секундный бюджет собираем robots.txt, llms.txt, Markdown и карту сайта. Ответ 200, отдающий HTML там, где ожидается текст, считается отсутствием файла: SPA-хостинги отвечают оболочкой приложения на любой путь.

  2. 2

    Извлекаем факты, а не формулировки

    HTML разбирается один раз в набор фактов: title, мета-теги, заголовки, ссылки, изображения, блоки JSON-LD, типы microdata и видимый текст без скриптов и шаблонов. На этом этапе ничего не оценивается.

  3. 3

    Выполняем каждую из 31 проверок отдельно

    Каждая проверка читает эти факты и начисляет часть своего веса. Проверки не читают друг друга, поэтому одна неудача не тянет за собой остальные. Проверка возвращает баллы, найденные доказательства и — если баллы неполные — исправление.

  4. 4

    Складываем в 6 категорий

    Веса подобраны так, чтобы дороже всего стоили те провалы, которые реально убирают вас из ответов ИИ. Блокировка поисковых ИИ в robots.txt — самая тяжёлая одиночная проверка.

  5. 5

    Итог и оценка

    Веса пяти основных категорий в сумме дают ровно 100. Готовность к агентам добавляет до 8 бонусных баллов, а отображаемый итог ограничен сотней. Оценка — диапазон по итогу, а вердикт называет самую слабую основную категорию.

  6. 6

    Сортируем исправления

    Каждая проверка, потерявшая баллы, отдаёт своё исправление. Сортировка — сначала по возвращаемым баллам, затем по эффекту, чтобы список отвечал на вопрос «что даст больше всего score за одно изменение», а не «что интереснее».

Пройдено, частично или провалено

Проверка пройдена, если набрала все свои баллы; «частично» — больше половины; «провалено» — меньше. Единственное исключение — проверка обучающих crawler'ов: она помечена как информационная, потому что их блокировка — бизнес-решение, а не ошибка.

31 проверка в 6 областях. У каждой — свой вес и объяснение с тем, что мы нашли на вашей странице.

Доступность для crawler'ов

25 баллов
  • Страница корректно отдаётся боту4
  • robots.txt есть и разбирается3
  • Поисковые ИИ могут забирать ваши страницы10
  • Региональные поисковые ИИ1
  • Обучающие crawler'ы1
  • sitemap.xml перечисляет ваши страницы4
  • llms.txt даёт ИИ подготовленную карту сайта2

Контент без JavaScript

20 баллов
  • Читаемый текст в серверном HTML8
  • Страница — не пустая JavaScript-оболочка6
  • Основной контент обёрнут в <main> или <article>3
  • Доля текста относительно разметки3

Структурированные данные

25 баллов
  • Структурированные данные присутствуют6
  • Структурированные данные — валидный JSON3
  • Организация описана машиночитаемо6
  • Продукты или услуги размечены4
  • Контент с ответами на вопросы размечен4
  • Разметка контекста сайта (WebSite / BreadcrumbList)2

Семантическая ясность

20 баллов
  • Описательный <title>3
  • Meta description описывает страницу3
  • Ровно один осмысленный <h1>4
  • Заголовки образуют аккуратную структуру3
  • Объявлен <html lang>2
  • Объявлен канонический URL2
  • Метаданные Open Graph2
  • У изображений есть alt-текст1

Различимость компании

10 баллов
  • Контакты машиночитаемы4
  • Цены можно найти3
  • Понятно, чем занимается компания3

Готовность к агентам

+8 баллов

Бонус, до +8 сверх 100. Здесь почти ни у кого пока нет баллов, поэтому категория может только помочь — она никогда не вычитается.

  • Страница может отдаваться в Markdown3
  • Интерфейсы для агентов можно обнаружить3
  • Content signals объявляют, как можно использовать контент2

Диапазоны оценок

К сканеру