Аудит сайта своими руками в 2026: как проверить сайт под Яндекс с ИИ-поиском
Аудит сайта в 2026 году - это проверка четырёх слоёв:
- Робот видит то же, что человек: кеш, robots.txt, коды ответов
- Машине понятна структура: заголовки, дубли, разметка JSON-LD
- Страница готова к ИИ-поиску: прямой ответ в начале, живой автор, Share of Voice
- Сайт работает как инструмент: цели аналитики, мобильная версия, скорость
Базовый прогон делается своими руками за один-два вечера бесплатными инструментами - ниже расписано, как именно.
С чего начать: смотрит ли робот на то же, что и вы?
Короткий ответ: сначала убедитесь, что поисковый робот получает ту же страницу, что и ваш браузер. Это самая частая и самая коварная дыра: вы правите сайт, а робот неделями жуёт старую копию из кеша.
Как проверить. Откройте страницу не браузером, а запросом без выполнения скриптов - так, как её видит машина. Самый простой путь: отключите в браузере JavaScript и обновите страницу. Исчезли заголовок, тексты или целые блоки - значит, они существуют только для людей, а робот их не видит или видит с задержкой рендера.
Живой пример. Разбирал сайт, где главный заголовок собирался скриптом-ротатором: семь ключевых фраз менялись каждые полторы секунды. Красиво. А в исходном коде, который получает робот, лежал огрызок «здесь и сейчас» без единого запроса. Семь направлений бизнеса для поиска не существовали.
Вторая половина проверки - кеш. Современные движки кешируют страницы слоями, и правка в коде не означает правку на выдаче. Признак болезни: текст поменяли неделю назад, а в сохранённой копии Яндекса или при запросе без кеша лежит старьё. Лечится принудительным сбросом кеша после каждой значимой правки и проверкой результата отдельным запросом, а не глазами в браузере.
Индексация: пускаете ли вы робота и туда ли?
Короткий ответ: три файла и один код ответа решают всё - robots.txt, sitemap, зеркала и честный 404.
robots.txt. Откройте вашсайт.ру/robots.txt и прочитайте глазами. Две классические мины. Первая: вместе со служебными папками движка закрыты стили и скрипты, и робот видит сайт голым. Вторая, коварнее: отдельная секция для робота Яндекса полностью заменяет общую секцию со звёздочкой, а не дополняет её. Видел сайт, где владелец добавил четыре строки для Яндекса, и три десятка правил выше перестали для него существовать.
sitemap. Карта сайта должна существовать, отдаваться по адресу из robots.txt и содержать живые адреса. Проверка: откройте из неё десяток случайных ссылок. Каждая обязана отдавать код 200, не редирект и не ошибку.
Честный 404. Введите заведомо несуществующий адрес на своём сайте. Правильный ответ - страница «не найдено» с кодом 404. Частая болезнь: сайт молча перекидывает на главную с кодом 200. Для поиска это значит, что у вас бесконечное число «валидных» страниц с одинаковым содержимым, и любая опечатка в ссылке рождает дубль главной в индексе.
Дубли. Одна страница живёт по одному адресу. Со слешем и без, с www и без, версия для печати, UTM-хвосты - всё это склеивается канонической ссылкой. Проверка: возьмите две-три ключевые страницы и посмотрите в коде тег canonical, он должен указывать сам на себя.
Структура: понятна ли машине иерархия?
Короткий ответ: один H1 на страницу, дальше H2 и H3 тегами - не жирным шрифтом, а именно тегами. У цитируемых ИИ страниц строгая иерархия заголовков встречается почти вдвое чаще, чем у нецитируемых.
Проверка за минуту: откройте исходный код страницы и поищите h1. Он должен быть один и содержать суть страницы теми словами, которыми вас ищут. Дальше h2 - названия смысловых разделов. Если заголовки свёрстаны обычными блоками с крупным шрифтом, для глаза всё то же самое, а для машины это стена текста без карты.
Отдельно про дубли содержимого. Наделали под разные запросы почти одинаковых страниц - они конкурируют между собой, и поиск выберет одну сам, не факт, что нужную вам. Разбирал сайт с четырьмя «посадочными», совпадавшими на девяносто семь процентов: для поиска это была одна страница, размазанная по четырём адресам.
Мета и тексты: что сайт говорит о себе в выдаче?
Короткий ответ: у каждой страницы свой title до семидесяти знаков и своё description до двухсот, оба с сутью и без копипаста. Это ваша витрина в выдаче: заголовок кликают, описание дочитывают.
Проверять удобно пакетно: пройдите основные страницы и выпишите title и description. Красные флаги: одинаковые на разных страницах, пустые, обрезанные на полуслове, набитые ключами через запятую. И проверьте картинки: атрибут alt должен описывать, что на изображении, поиск по картинкам и голосовые ассистенты читают только его.
Длину считайте в символах, а не в байтах. Кириллица в некоторых инструментах считается двойной, и «сто двадцать знаков» на деле оказываются шестьюдесятью.
Мобильная версия: сайт удобен или просто «не разваливается»?
Короткий ответ: откройте сайт на телефоне и посмотрите на полезную ширину текста. Отсутствие горизонтальной прокрутки - ещё не порядок: контент может занимать половину экрана, зажатый рамками и отступами, и формальные проверки этого не видят.
Что смотреть глазами на телефоне: текст занимает минимум четыре пятых ширины экрана; заголовки не переносятся по слогам; кнопки нажимаются пальцем; таблицы прокручиваются внутри себя, а не тянут всю страницу. Яндекс индексирует мобильную версию в первую очередь, так что «на компе нормально» больше не аргумент.
Скорость проверяется просто: откройте сайт с телефона через мобильный интернет, не через домашний вайфай. Больше трёх-четырёх секунд до читаемого экрана - ищите тяжёлые картинки, видеофоны и лишние скрипты. Видел первый экран весом в семь с половиной мегабайт, из которых пять забирал фоновый ролик.
Разметка: говорите ли вы с машиной на её языке?
Короткий ответ: у страниц должна быть разметка JSON-LD, и она обязана совпадать с видимым содержимым. Статье - тип Article с автором и датами, организации - Organization с реальными контактами, странице с вопросами - FAQPage.
Проверка: валидатор структурированных данных (у Яндекса свой в Вебмастере) покажет, что машина вычитывает из вашей страницы. Два правила. Первое: разметка без видимого соответствия вредит. Указан телефон, которого нет на странице, или вопросы, которых нет в тексте, - расхождение трактуется против вас. Второе: дата обновления в разметке должна быть настоящей. Переписанная трижды статья с датой первой публикации для машины не обновлялась ни разу.
Готов ли сайт к ИИ-поиску?
Короткий ответ: с 7 апреля 2026 года это проверяется цифрой - в Яндекс.Вебмастере есть раздел «Видимость сайта в Алисе AI» с метрикой Share of Voice. Зайдите и снимите значение до любых работ, это ваша точка отсчёта.
Дальше три проверки руками. Первая: откройте ключевые страницы и прочитайте первый экран. Там прямой ответ на вопрос, с которым приходит посетитель, или сначала «мы динамично развиваемся»? ИИ цитирует первую треть страницы заметно чаще остального. Вторая: подписаны ли материалы живым автором с именем, анонимные тексты машина занижает. Третья: упоминается ли ваш сайт за пределами самого себя - карты, справочники, профильные площадки. Сайт, о котором молчит весь интернет, для ИИ подозрителен.
Работает ли сайт как инструмент: цели и захват
Короткий ответ: аудит без проверки аналитики - половина аудита. Откройте счётчик и посмотрите, настроены ли цели: отправка формы, клик по телефону, обращение в чат. Видел красивые сайты, где владелец не мог ответить на вопрос «сколько заявок принёс сайт за месяц»: цели не были настроены вообще, конверсия не измерялась никак.
И пройдите путь клиента сами, руками, с телефона: найти услугу, понять цену, оставить заявку. Каждый лишний шаг и каждая неработающая кнопка - это посетители, за которых вы уже заплатили контентом или рекламой.
Что из этого делать самому, а с чем идти к специалисту?
Честный расклад. Своими руками за вечер-два закрываются: robots и sitemap глазами, проверка 404, title и description, заголовки в исходном коде, мобильная проверка с телефона, снятие Share of Voice, прогон пути клиента. Это большая часть пользы аудита, и она бесплатная.
Специалист нужен там, где начинается хирургия: многослойный кеш движка, склейка дублей без потери позиций, разметка на нестандартных страницах, разбор логов и причин, почему робот ходит не туда. Разница простая: проверить и увидеть проблему вы можете сами, а лечить некоторые из них без опыта - как удалять аппендицит по видеоурокам.
Это мой опыт, а не истина в последней инстанции. В комментариях, советах и одобрении не нуждаюсь - что надо, сам найду и сам проверю. Не согласны - ваше право: идите проверьте на своём сайте, потом поговорим.
Источники
- Справка Яндекс.Вебмастера: https://yandex.ru/support/webmaster/ru/
- Директивы robots.txt, справка Яндекса: https://yandex.ru/support/webmaster/ru/controlling-robot/robots-txt
- Файл sitemap, справка Яндекса: https://yandex.ru/support/webmaster/ru/controlling-robot/sitemap
- Валидатор структурированных данных Яндекса (нужна авторизация в Вебмастере): https://webmaster.yandex.ru/tools/microtest/
- Схема Article на schema.org: https://schema.org/Article