Почему ошибки в мета-разметке незаметны — и как их находить
Ctrl+U. Несколько сотен строк HTML. Где-то там canonical — надо найти его до того, как страница уйдёт в индекс.
Это не какой-то особый ритуал перестраховщика. Это был обычный процесс проверки перед публикацией. И он почти никогда не работал как надо.
Почему ручная проверка разметки не работает
Проблема не во внимательности. Когда листаешь исходник глазами, ты ищешь конкретную строчку в потоке кода, в котором нет структуры — есть просто порядок следования тегов. Canonical может стоять в начале <head>, а может — в конце. og:image может не быть вообще, и ты не поймёшь этого, пока не дойдёшь до конца файла.
Даже если ты находишь canonical — ты видишь, что он есть. Но не видишь, правильный ли адрес в нём прописан. Это нужно держать в голове отдельно, переключаться, сверять. Один файл — ещё терпимо. Десять страниц перед релизом — уже нет.
Так и выходило: иногда находил, чаще нет. Страница уходила в индекс с тем, что было.
Что именно остаётся незамеченным
Ошибки в разметке не выглядят как ошибки. Сайт работает. Страница открывается. 500-х нет, ничего красного в консоли нет. С точки зрения браузера и пользователя — всё в порядке.
Но с точки зрения поисковика — нет:
- Title обрезан. Поисковик показывает в выдаче обрубленную строку, или подставляет свою.
- Canonical ведёт не туда. Страница сигнализирует поисковику, что «главная версия» — вот та, другая. Вес и ссылки уходят туда.
- og:image нет. При расшаривании в соцсетях — пустой квадрат или случайная картинка со страницы.
- В description — заглушка из шаблона. Та самая «Описание страницы», которую никто не заменил.
Каждая из этих проблем по отдельности — не катастрофа. Все вместе, на каждой второй странице, каждый день — это просто чуть худшее ранжирование. Тихое, незаметное, без всплесков и алертов.
Чем отличается проверка через агента
Когда вместо ручного просмотра исходника пишешь «проверь разметку» и адрес — агент возвращает не сырой HTML, а конкретный список проблем. Не «посмотри сам», а: title обрезан, canonical ведёт не туда, og:image нет, в description заглушка. И сразу — что поставить.
Разница в том, что агент не листает глазами — он разбирает структуру документа и сверяет каждый элемент с тем, каким он должен быть. Это то же самое, что считать в столбик вместо счёта в уме. Результат должен быть одинаковым, но вероятность ошибки — разная.
Ты не становишься внимательнее. Просто задача перестаёт требовать внимания там, где её может закрыть инструмент.
Где это не закрывает проблему
Агент проверяет то, что есть в разметке. Он не знает, правильный ли canonical с точки зрения твоей контентной стратегии — он только видит, что тег есть и куда ведёт. Он не оценит, хорош ли title по смыслу — только сообщит, что он обрезан или отсутствует. Решения по-прежнему принимает человек.
Это инструмент для того, чтобы не пропускать очевидное. Не замена редактуре и не аудит стратегии.
Что с этим делать
Если у тебя сейчас нет привычки проверять разметку перед публикацией — не потому что лень, а потому что процесс неудобный — это нормально. Ctrl+U и пятьсот строк HTML не располагают к систематической проверке.
Если есть доступ к агенту, который умеет разбирать страницу по URL — добавь проверку разметки в чеклист перед публикацией. Это занимает минуту и закрывает класс ошибок, которые иначе живут на сайте месяцами: тихо, без алертов, просто чуть хуже.