MT Статьи

Я провёл аудит собственного сайта

Опубликовано — 7 мин чтения

Говорить о неизмеренном сайте бессмысленно. Эту фразу нужно было применить и к собственному сайту.

То, что легко при взгляде на чужой сайт, становится трудным при взгляде на свой: отделить измерение от пожелания.

Этот текст — сам аудит. Двенадцать фаз, десять измерений, две отдельные оценки. Рамка, которая измеряет не то, насколько сайт хорош, а какая половина работы закончена.

Две оценки, потому что два разных вопроса

Классический поиск и ответы ИИ вознаграждают разное. Если одни и те же десять измерений умножить на две разные весовые схемы, получаются два числа:

SEOGEO
Оценка50/10036/100
ПолосаСлабоКритично

Разрыв в четырнадцать пунктов — самый ценный результат отчёта. Причина в весах: на стороне SEO тяжелее всего доступность и качество страницы — именно там сайт сильнее всего. На стороне GEO тяжелее всего внешние сигналы бренда, и там сайт получает 5/100.

Одной фразой: всё, что в моей власти, сделано правильно, и ничего вне моей власти пока не существует.

Режим доказательств

Самое жёсткое правило рамки — не в измерении, а в письме: предложение без доказательства в отчёт не попадает. Рядом с каждой находкой стоит действительно загруженный URL, вывод команды или измерение инструмента. «Вероятно», «обычно», «может быть» запрещены.

Второе правило требует для каждой рекомендации уровень доказательности:

УровеньЗначение
AОфициальная документация владельца платформы или прямое измерение
BСогласованная корреляция в нескольких независимых исследованиях
CОдно исследование, малая выборка или логический вывод
DОтраслевой фольклор, неподтверждённое

Практическое следствие: рекомендация уровня D не может получить высокий приоритет. Это автоматически опускает вниз столь распространённый в SEO совет «сделай и это, хуже не будет».

Пример: файл llms.txt. Он есть на сайте, генерируется корректно, его содержимое не пишется вручную. Но отчёт присвоил ему уровень C и оставил низкий приоритет — потому что Google прямо заявил, что не использует этот файл ни для Поиска, ни для функций ИИ, а масштабные анализы логов показали, что поисковые боты ИИ почти никогда его не запрашивают. Ценность есть, но не там, где её заявляют: в доступности для агентов, а не в поисковой видимости.

При аудите собственного сайта именно эта метка полезнее всего. Она привязывает желание преувеличить свою работу к числу.

Ноль в пяти индексах

Bing, DuckDuckGo, Brave, Yandex и Google — запрос site: дал ноль во всех пяти. DuckDuckGo написал это прямо: «результатов не найдено». Bing полностью проигнорировал оператор и вернул нерелевантное.

Это выглядит как поломка. Это не поломка. История репозитория показывает, что все двадцать один коммит легли в один день, а в Wayback Machine нет ни одного снимка домена. Сайту меньше суток.

Отсутствие однодневного сайта во всех индексах — ожидаемое поведение. Настоящий вопрос не в самом нуле, а в том, какая часть нуля рассосётся сама.

Настоящая проблема: семь Муратов Туналы

В первой десятке по брендовому запросу этому сайту принадлежит ноль результатов. Кто делит верхнюю десятку:

КтоИзмеренный вес
Автор и тренер по личностному развитию18 лет — 158 снимков Wayback (2007→2026), изданные книги, шесть мест из десяти
Семейный консультант, СтамбулТот же город — самое рискованное пересечение
Мужской парикмахер, Бурса
Музыкант и аранжировщикВосемь альбомных страниц в Википедии
Специалист по системам и сетям с почти той же фамилией
Два аккаунта в соцсетях

Самое поучительное сравнение — в Common Crawl, открытом архиве обходов, питающем обучающие корпуса больших языковых моделей:

ОбходЭтот сайтСайт тёзки
Июль 2026022 записи
Июнь 2026036 записей
Май 2026026 записей

То есть: если модель знает имя «Murat Tunalı» из обучающих данных, знает она не меня. В корпусе есть только он.

Как поисковик слил трёх человек

Живой тест задал трём машинам восемь запросов. Доля цитирования вышла нулевой — этого и ждали. Неожиданным оказалось содержание ответа Bing.

Я явно вписал домен в запрос. Вернулось вот что:

Murat Tunalı, родившийся в Измире в 1982 году, — мужской парикмахер и педагог-писатель. Соединяя классическое цирюльное искусство с современным подходом к уходу, Туналы работает в Бурсе как премиальный мужской парикмахер. Кроме того, он специалист по семейному консультированию и оказывает консультационные услуги в Стамбуле.

В одном абзаце слиты как минимум три разных человека: парикмахер в Бурсе, автор родом из Измира, семейный консультант в Стамбуле. Четвёртого — системного инженера, то есть меня — в ответе нет вовсе.

Perplexity повёл себя честнее. На уточнённый запрос он сказал, что «не смог найти профиль, чётко соответствующий этому описанию», и предложил близкие по имени замены.

Разница между ними важна. Быть невидимым — проблема. Быть уверенно представленным неправильно — проблема больше — потому что читающий не знает, что это неверно.

Что прошло проверку

Аудит, сообщающий только о красном, бесполезен; он должен измерять и то, что работает, иначе не понять, какая часть работы сделана.

Что прошло здесь:

  • Семнадцать ботовых user-agent'ов проверены по отдельности — Googlebot, bingbot, GPTBot, OAI-SearchBot, ClaudeBot, PerplexityBot и прочие. Все вернули 200, все получили ровно те же 87 890 байт. Ни клоакинга, ни стены WAF, ни дискриминации ботов.
  • Нет зависимости от JavaScript. Сырой HTML 337 слов, после рендеринга 315. Разница минус шесть процентов. Проблемы, названной «убийцей номер один» для GEO — контент существует только после выполнения JS — здесь нет.
  • hreflang взаимен в 64 направлениях из 64. Все взаимные связи между восемью языками целы. Именно это чаще всего ломается на многоязычных сайтах.
  • Структурированные данные: ноль ошибок, ноль предупреждений у официального валидатора.
  • Ноль рекламного тона. Проведено сканирование по четырнадцати превосходным степеням: «лучший», «лидер», «первопроходец», «превосходный», «в отрасли»… ни одной. Текст активно делает обратное: «Оплаты нет. И предложений потом не присылаю». Избыточно рекламный тон измеримо снижает шансы быть процитированным; этот сайт позиционирован наоборот.

Этот список — не самая успокаивающая часть отчёта, а самая полезная. Он доказывает, что причина нулевой видимости не техническая.

Найти то, чего не искал

Самые интересные результаты аудита не значатся в его списке проверок.

Этот нашёл две тихие поломки в коде генератора. Первая: отметка свежести в карте сайта читала собственный вывод, то есть дата никогда бы не сдвинулась. Вторая: список переводимых полей структурированных данных был продублирован в двух местах; добавь новое поле лишь в одно — и турецкий текст тихо копируется в семь языков.

У обеих общее свойство: ни один тест не падал. Сто тестов были зелёными, и обе сидели внутри.

Моя собственная ошибка

Отчёт сформулировал одну находку слишком широко: он утверждал, что область основного содержимого не размечена. Я измерял через querySelectorAll('main'), а это не видит ориентир, размеченный ролью ARIA. В исходнике role="main" уже был.

Отчёт исправлен, оценка измерения выросла с 78 до 85, оценка SEO — с 49 до 50. Исправление стоит в отчёте открыто: что было измерено неверно и почему.

Ценность аудита не в найденных ошибках, а в том, фиксирует ли он собственную. Тихо исправленная находка заслуживает меньше доверия, чем ненайденная.

Что не удалось измерить

В отчёте есть отдельная таблица с двенадцатью пунктами: Google не удалось опросить напрямую, потому что он выдал страницу проверки на бота, а решать CAPTCHA запрещено. ChatGPT и Gemini не тестировались вовсе, поскольку требуют входа. Платного инструмента по обратным ссылкам нет, поэтому число ссылающихся доменов основано на выборке. Полевых данных о производительности нет, потому что сайт новый.

Ничто из этого в оценку не вошло. В аудите самая лёгкая ложь — присвоить неизмеренному приблизительное число.

Фаза 8 отработала пятью запросами вместо восьми. Причина записана в отчёте: первые пять дали единодушный ноль по трём машинам, и дальнейшие запросы вряд ли изменили бы это единодушие. Это ограничение охвата, и оно не подавалось как восемь из восьми.

Что из этого вышло

В плане действий аудита нет ни одного P0 — и это находка. P0 определён как «блокирует индексацию или доступ ИИ». На этом сайте ничто ничего не блокирует: robots.txt полностью открыт, семнадцать ботов проходят чисто, зависимости от JS нет, стены WAF нет. Причина нулевой видимости — не препятствие, а возраст.

Придуманный P0 сделал бы подозрительным и остальной отчёт.

Остаётся нечто интересно простое: техническая база больше не препятствие, поэтому весь дальнейший выигрыш придёт из объёма контента и упоминаний извне. Раздел, который вы читаете, — место, где живёт этот текст, — прямое следствие того решения.

Сравнение с конкурентами подтвердило это чтение ещё раз. Из четырёх сайтов, измеренных по одним критериям, один держал шестнадцать записей в обучающем корпусе при 238 словах и полном отсутствии структурированных данных. Этот сайт, чьи структурированные данные лучшие из четырёх, стоял на нуле. Совершенство на странице само по себе не создаёт присутствия в корпусе; его создают возраст и упоминания.

Самым полезным результатом аудита стал не список, а порядок: какой пробел закроется со временем сам, а какой нет. Ноль в пяти индексах закроется. Ноль внешних упоминаний — нет. Тень семи тёзок — нет; ею можно только управлять, добавив сигнал, который вас отличает.

Измерить было легко. Дальше — изменить измеренное.