инструменты / GEO-оптимизация
Проверка сайта на GEO-оптимизацию
Проверим одну страницу: дойдёт ли до неё бот нейросети, и если да - чем ей есть зацепиться в ответе. Балл по шкале сто, ниже - находки с тем, что мы увидели на странице, и что стоит вписать. Вход не нужен.
Баллы считаем только по введённой странице. Но кроме неё мы заходим
в robots.txt, карту сайта и качаем до семи соседних
страниц - не ради их собственной оценки, а чтобы отличить ваш текст
от того, что повторяется в шаблоне сайта: меню, подвал, типовые фразы.
То, что нашлось на нескольких страницах разом, из баллов вычитается.
Мы не запускаем скрипты и не открываем страницу в браузере - смотрим
ровно то, что видит бот, который тоже их не выполняет.
Полоса группы показывает, сколько баллов набрано от максимума ЭТОЙ группы - «Набрано от максимума», а не долю общего веса. Группы весят по-разному: извлекаемые доказательства 35, форма ответа 25, сущность и доверие 20, разметка Schema.org 12, свежесть 8. Если какая-то проверка внутри группы к странице не применима (например, авторство и дата на товаре, а не на статье), её вес выходит и из числителя, и из знаменателя - максимум группы на такой странице ниже, чем в сумме выше, а не занижен как непройденный.
Что перекрыло проверку
Прежде чем считать баллы, мы проверяем шесть условий доступа. Не выполнено хотя бы одно - до страницы не дойдёт ни один бот, и оценивать содержимое нет смысла.
Находки по убыванию отдачи
Сверху - то, что вернёт больше всего баллов, если поправить. У каждой находки - что мы увидели на странице, зачем это нужно и что стоит вписать.
Какие страницы мы смотрели
Справочно: файлы для нейросетей и каталог ботов
Что тут проверяется
Сто баллов разложены на пять групп, и веса у них разные - группа тем весомее, чем сильнее она связана с тем, берёт ли модель текст в ответ на живых замерах.
Извлекаемые доказательства - 35 баллов
Числа, цены, сроки, таблицы, ссылки на первоисточники, цитаты с именем. Это самая тяжёлая группа: конкретный факт с числом модель может процитировать, а общие слова про «широкий ассортимент» - нет.
Форма ответа - 25 баллов
Есть ли прямой ответ сразу после заголовка, разбиты ли подзаголовки на вопросы, нарезаны ли абзацы, оформлены ли перечисления списком, есть ли на странице блок вопросов-ответов. Форма подачи облегчает модели вытащить готовый кусок текста, не пересказывая его.
Сущность и доверие - 20 баллов
Разметка организации, реквизиты, единый телефон на всех страницах, сигналы доверия (страница «о компании», сертификаты, отзывы), для статей - автор и дата. Это то, по чему сайту решают доверять в темах, где цена ошибки высока.
Разметка Schema.org - 12 баллов
Разбирается ли ld+json без ошибок, соответствуют ли типы разметки содержимому страницы, не расходится ли цена или название в разметке с тем, что написано в тексте.
Свежесть - 8 баллов
Видна ли дата обновления человеку, правдоподобна ли дата в заголовках и в карте сайта, не устарело ли содержание по годам, упомянутым в тексте.
Прежде чем считать баллы - шесть условий доступа
Баллу нет смысла считаться, если до страницы не доходит бот. Поэтому
сначала мы проверяем: читается ли robots.txt, не закрыт ли
в нём бот Алисы, отвечает ли страница кодом 200, нет ли запрета
индексации, не уводит ли каноникал на другой адрес, и есть ли в
HTML-ответе вообще видимый текст - без него боту, который не выполняет
скрипты, читать нечего. Не пройдено хотя бы одно условие - страница
покажет причину вместо балла.
Что балл не значит
Высокий балл - не гарантия и не билет на первую позицию в ответе нейросети. Мы меряем то, что можно измерить формально: есть ли в тексте числа, цена, ответ на вопрос в первом абзаце, разметка Schema.org. Какие сайты реально попадут в ответ ChatGPT, Perplexity или Алисы на конкретный запрос, достоверно не знает никто, включая нас: это решает модель в момент ответа, и один и тот же запрос в разное время может привести к разным источникам.
Балл ничего не говорит и о том, нужен ли странице такой текст вообще: сто из ста получит страница, которая формально отвечает всем правилам, но никому не интересна по сути. Проверка меряет форму подачи, а не то, стоит ли ваш товар или услуга того, чтобы про них писали.
Если страница уже стоит на первой или второй позиции в обычной выдаче - содержание лучше не трогать вовсе. В замере KDD 2024 добавление цитат и статистики на таких страницах роняло видимость на 20-30 %: то, что помогает странице пониже подняться, страницу в топе может столкнуть вниз. Мы не знаем позиций вашей страницы и такое предупреждение показать не можем - назвать её можете только вы. Правки из находок этой проверки рассчитаны на страницы ниже первой-второй позиции; на самом верху из списка безопасны только разметка и свежесть даты.
Похожие проверки
Здесь мы смотрим содержимое одной страницы: есть ли на ней то, что
нейросеть сможет процитировать. Пускает ли сайт ботов нейросетей вообще -
отдельный вопрос, им занимается проверка для
нейросетей: покажет, что разрешено и что закрыто в
robots.txt, и отдаст готовые строки для правки. А что такое
GEO-оптимизация и нужны ли сайту отдельные работы под нейросети, разобрали
в статье что такое
GEO-оптимизация.
Вопросы
Почему проверяется только одна страница, а не весь сайт
Мы правда заходим не только на неё: качаем robots.txt, карту сайта и до семи соседних страниц. Но это ради контекста - отличить ваш текст от того, что повторяется в шаблоне сайта (меню, подвал, типовые фразы). Баллы считаются только по введённому адресу.
Почему баллов нет вообще, хотя страница открывается в браузере
Значит не пройдено одно из шести условий доступа: файл
robots.txt не читается, бот Алисы закрыт, страница
отдаёт код не 200, стоит запрет индексации, каноникал уводит на
другой адрес, или в HTML-ответе почти нет видимого текста -
так бывает, когда содержимое дорисовывают скрипты уже в браузере,
а бот их не выполняет. Причину страница покажет словами.
Почему ботов в справочном разделе именно столько, сколько там есть
Каталог ботов нейросетей живёт своей жизнью и время от времени меняется: имена появляются и уточняются. Страница берёт число из каталога напрямую при каждой проверке, а не хранит его в вёрстке - иначе оно устарело бы при первом же изменении.
Почему нет баллов за llms.txt и ai-data.json
Мы их проверяем и показываем справочно, но не добавляем к баллу. По логам подавляющее большинство таких файлов на сайтах никто не запрашивает ни разу, а кривой файл вреднее отсутствующего - подробности и цифры смотрите в справочном разделе результата.
Балл посчитали дважды и получили разное число
Так и может быть. Мы не храним слепков сайта и при каждой проверке смотрим на него заново - если между проверками на сайте что-то поменялось, поменяется и число. Небольшая разница - это норма, а не ошибка замера.
Можно ли доверять цитате в находке - вдруг вы её выдумали
Нет: строка «что мы увидели на странице» в каждой находке - это дословный фрагмент вашего же текста или разметки, не пересказ. Если сомневаетесь - откройте исходный код страницы и найдите его поиском.