инструменты для сайта

инструменты / GEO-оптимизация

Проверка сайта на GEO-оптимизацию

Проверим одну страницу: дойдёт ли до неё бот нейросети, и если да - чем ей есть зацепиться в ответе. Балл по шкале сто, ниже - находки с тем, что мы увидели на странице, и что стоит вписать. Вход не нужен.

Баллы считаем только по введённой странице. Но кроме неё мы заходим в robots.txt, карту сайта и качаем до семи соседних страниц - не ради их собственной оценки, а чтобы отличить ваш текст от того, что повторяется в шаблоне сайта: меню, подвал, типовые фразы. То, что нашлось на нескольких страницах разом, из баллов вычитается. Мы не запускаем скрипты и не открываем страницу в браузере - смотрим ровно то, что видит бот, который тоже их не выполняет.

Что тут проверяется

Сто баллов разложены на пять групп, и веса у них разные - группа тем весомее, чем сильнее она связана с тем, берёт ли модель текст в ответ на живых замерах.

Извлекаемые доказательства - 35 баллов

Числа, цены, сроки, таблицы, ссылки на первоисточники, цитаты с именем. Это самая тяжёлая группа: конкретный факт с числом модель может процитировать, а общие слова про «широкий ассортимент» - нет.

Форма ответа - 25 баллов

Есть ли прямой ответ сразу после заголовка, разбиты ли подзаголовки на вопросы, нарезаны ли абзацы, оформлены ли перечисления списком, есть ли на странице блок вопросов-ответов. Форма подачи облегчает модели вытащить готовый кусок текста, не пересказывая его.

Сущность и доверие - 20 баллов

Разметка организации, реквизиты, единый телефон на всех страницах, сигналы доверия (страница «о компании», сертификаты, отзывы), для статей - автор и дата. Это то, по чему сайту решают доверять в темах, где цена ошибки высока.

Разметка Schema.org - 12 баллов

Разбирается ли ld+json без ошибок, соответствуют ли типы разметки содержимому страницы, не расходится ли цена или название в разметке с тем, что написано в тексте.

Свежесть - 8 баллов

Видна ли дата обновления человеку, правдоподобна ли дата в заголовках и в карте сайта, не устарело ли содержание по годам, упомянутым в тексте.

Прежде чем считать баллы - шесть условий доступа

Баллу нет смысла считаться, если до страницы не доходит бот. Поэтому сначала мы проверяем: читается ли robots.txt, не закрыт ли в нём бот Алисы, отвечает ли страница кодом 200, нет ли запрета индексации, не уводит ли каноникал на другой адрес, и есть ли в HTML-ответе вообще видимый текст - без него боту, который не выполняет скрипты, читать нечего. Не пройдено хотя бы одно условие - страница покажет причину вместо балла.

Что балл не значит

Высокий балл - не гарантия и не билет на первую позицию в ответе нейросети. Мы меряем то, что можно измерить формально: есть ли в тексте числа, цена, ответ на вопрос в первом абзаце, разметка Schema.org. Какие сайты реально попадут в ответ ChatGPT, Perplexity или Алисы на конкретный запрос, достоверно не знает никто, включая нас: это решает модель в момент ответа, и один и тот же запрос в разное время может привести к разным источникам.

Балл ничего не говорит и о том, нужен ли странице такой текст вообще: сто из ста получит страница, которая формально отвечает всем правилам, но никому не интересна по сути. Проверка меряет форму подачи, а не то, стоит ли ваш товар или услуга того, чтобы про них писали.

Если страница уже стоит на первой или второй позиции в обычной выдаче - содержание лучше не трогать вовсе. В замере KDD 2024 добавление цитат и статистики на таких страницах роняло видимость на 20-30 %: то, что помогает странице пониже подняться, страницу в топе может столкнуть вниз. Мы не знаем позиций вашей страницы и такое предупреждение показать не можем - назвать её можете только вы. Правки из находок этой проверки рассчитаны на страницы ниже первой-второй позиции; на самом верху из списка безопасны только разметка и свежесть даты.

Похожие проверки

Здесь мы смотрим содержимое одной страницы: есть ли на ней то, что нейросеть сможет процитировать. Пускает ли сайт ботов нейросетей вообще - отдельный вопрос, им занимается проверка для нейросетей: покажет, что разрешено и что закрыто в robots.txt, и отдаст готовые строки для правки. А что такое GEO-оптимизация и нужны ли сайту отдельные работы под нейросети, разобрали в статье что такое GEO-оптимизация.

Вопросы

Почему проверяется только одна страница, а не весь сайт

Мы правда заходим не только на неё: качаем robots.txt, карту сайта и до семи соседних страниц. Но это ради контекста - отличить ваш текст от того, что повторяется в шаблоне сайта (меню, подвал, типовые фразы). Баллы считаются только по введённому адресу.

Почему баллов нет вообще, хотя страница открывается в браузере

Значит не пройдено одно из шести условий доступа: файл robots.txt не читается, бот Алисы закрыт, страница отдаёт код не 200, стоит запрет индексации, каноникал уводит на другой адрес, или в HTML-ответе почти нет видимого текста - так бывает, когда содержимое дорисовывают скрипты уже в браузере, а бот их не выполняет. Причину страница покажет словами.

Почему ботов в справочном разделе именно столько, сколько там есть

Каталог ботов нейросетей живёт своей жизнью и время от времени меняется: имена появляются и уточняются. Страница берёт число из каталога напрямую при каждой проверке, а не хранит его в вёрстке - иначе оно устарело бы при первом же изменении.

Почему нет баллов за llms.txt и ai-data.json

Мы их проверяем и показываем справочно, но не добавляем к баллу. По логам подавляющее большинство таких файлов на сайтах никто не запрашивает ни разу, а кривой файл вреднее отсутствующего - подробности и цифры смотрите в справочном разделе результата.

Балл посчитали дважды и получили разное число

Так и может быть. Мы не храним слепков сайта и при каждой проверке смотрим на него заново - если между проверками на сайте что-то поменялось, поменяется и число. Небольшая разница - это норма, а не ошибка замера.

Можно ли доверять цитате в находке - вдруг вы её выдумали

Нет: строка «что мы увидели на странице» в каждой находке - это дословный фрагмент вашего же текста или разметки, не пересказ. Если сомневаетесь - откройте исходный код страницы и найдите его поиском.