Перейти к содержимому

Почему AI цитирует не вас

Вы задаёте ассистенту вопрос, на который отвечает ваш продукт. Он называет несколько источников. Вас среди них нет.

В обычном поиске десять мест и ещё прокрутка вниз, так что даже на слабой позиции вас там можно найти. В ответ ассистента помещается три-четыре источника, и кто в эти три-четыре не попал, того нет совсем.

Вот такой ответ по запросу, на который отвечает мой собственный бот:

AI Overview в Google по запросу how to transcribe telegram voice message. В ответе названы встроенная функция Telegram и сторонние боты. В панели источников справа — блог SpeakApp и тред на Reddit из r/SideProject под заголовком I made a telegram bot that transcribes voice notes.

Два источника, и один из них — форумный тред: ассистент поставил чей-то пост на Reddit рядом с продуктовым блогом, а моего сайта нет ни там, ни там. Снято 13 августа 2026-го.

Проблему назвала работа GEO: Generative Engine Optimization (Aggarwal et al., 2023). Авторы переписывали существующие страницы, новых не добавляли и на GEO-bench заявили до 40% прироста видимости источника внутри ответа. Работа тут одна: разложить факты, которые у вас уже есть, так, чтобы модель могла их поднять.

Что модель прочитает раньше, чем решит вас цитировать

Заголовок раздела «Что модель прочитает раньше, чем решит вас цитировать»

Заголовок задаёт вопрос, следующие два предложения на него отвечают. Это всё правило. Я нарушаю его каждый раз, когда начинаю страницу с контекста.

Модель читает вступление и решает, есть ли тут что уносить в ответ, а человек, пришедший из поиска, читает предысторию как отсутствие ответа — и модель читает её ровно так же.

Ассистент цитирует пассаж, а не документ, поэтому каждый абзац должен называть свой предмет, стоять без соседа сверху, держаться коротким и не начинаться с местоимения.

Проверка занимает десять секунд. Вставьте один абзац в пустую заметку и прочитайте: если непонятно, о чём он, то и модели непонятно.

Внутри абзаца должно лежать что-то твёрдое: число, дата, имя собственное, версия. «Многие команды» не процитирует никто, а измеренное значение с датой замера уйдёт и в ответ, и в скриншот.

Цифры пока нет — измерьте или выбросите предложение. «Большинство», «часто» и «значительно» в ответ не переносятся.

Одна проверяемая вещь, которая есть только у вас

Заголовок раздела «Одна проверяемая вещь, которая есть только у вас»

Свой бенчмарк, своя таблица цен, свой лог провалов — то, что читатель может пойти и проверить и чего нет больше ни у кого в выдаче.

Здесь и расходятся источник и пересказ: страница, которая только пересказывает область, соревнуется со всеми остальными пересказами, а выигрывает обычно пересказ постарше.

Как резать документ, чтобы он делился на куски

Заголовок раздела «Как резать документ, чтобы он делился на куски»

Уровни заголовков без пропусков. Нумерованный список там, где есть процесс. Таблица, когда сравниваются три варианта и больше. Вопрос — хороший заголовок: человек так же формулирует и свой запрос.

Класть одним блоком в head: Organization или Person как сущность, Article с автором и датой публикации, и туда же sameAs со списком ваших профилей и карточек.

Про sameAs задокументировано одно применение: он помогает Google разрешать сущности для Knowledge Graph. Написано это в справочнике по Organization. Что поле даёт для цитирования у LLM, не измерял никто — ни вендор, ни исследование, ни я. Десять минут и обоснованная ставка, а не механизм.

Каталоги, ветки обсуждений, чужие сравнения. Работа на самой странице начинает окупаться, только когда модель уже знает о вашем существовании. Сначала вас узнают, потом цитируют.

  • Добавлять объём вместо проверяемого утверждения. Я сделал страницу длиннее, а прилагательные лучше, и не сдвинулось ничего. Ответ цитировал страницу, где стояло число, и она была короче моей.
  • Считать, что опубликованные страницы вытянут продукт. На моих проектах страницы вышли, а регистрации продолжали приходить откуда-то ещё. Точную долю я назову на странице кейса, с датой замера, но здесь такого числа у меня нет.
  • Держать вывод в конце. Форма эссе прячет ответ под разгоном, так что извлечь остаётся одно вступление, а оно ещё ничего не сказало.
  • Писать FAQ ради схемы. Вопросы, которых никто не задавал, и ответы, повторяющие абзац выше, а разметка так и не сделала пустой ответ достойным цитаты.
  • Рассыпать микроразметку по вёрстке. Правка шаблона молча её сломала, и ничто меня не предупредило, а JSON-LD одним блоком в head с тех пор пережил все редизайны.
  • Продавать sameAs как то, что склеивает упоминания в узнаваемую моделью сущность. Предложение стояло здесь и в маршруте без доказательств под ним. Задокументировано у поля одно применение — Knowledge Graph у Google. Читает ли его языковая модель, я не знаю, и предложение не знало тоже.
  • Начинать абзацы с «Это» и «Однако». Оба слова указывают назад, на предложение, которое с цитатой не поедет.

Запустите geo-citability из раздела Tools. Он оценивает пассажи и показывает те, что рассыпаются вне контекста, а на своём тексте такую проверку сделать труднее всего.

Потом мерьте присутствие, а не позицию:

  • Задайте целевой вопрос в нескольких ассистентах, по несколько прогонов в каждом, потому что ответы недетерминированы и один прогон — это анекдот.
  • На каждый прогон записывайте две вещи: назвали ли вас вообще и дали ли ссылку как на источник, потому что назвать и сослаться — разные уровни, и двигаются они отдельно.
  • Следите за трендом по прогонам и неделям, потому что по одному снимку не понять, в какую сторону всё едет.
  • Смотрите в аналитике переходы с хостов ассистентов. Такой переход доказывает, что вас процитировали и прочитали. Про ранжирование он не говорит ничего.
  • Проверьте JSON-LD валидатором структурированных данных, прежде чем ему доверять.

Если в логах не появляется вообще ни один агент, проблема в доступе, а не в тексте, и начинать тогда надо с AI-crawler и llms.txt.

Предложить правку · Страница не помогла