15-минутный промпт вскрывает каждый тезис, который ломается при нарезке страницы ретриверами
Страница, которая сидит в топе Google, но никогда не всплывает в AI Overviews или чат-ботах, обычно имеет проблемы с чанкингом, а не с самим контентом.
AI-поиск редко читает страницу целиком — он извлекает пассажи из 5-50 разных страниц, поэтому контент дробится на блоки примерно по 300 токенов, и модель забирает только те куски (чанки), которые отвечают на запрос.
Тезис в одном чанке, доказательство — в следующем: ретривер берет одно без другого, а за половину факта цитату не дают.
При этом позиции в поиске выглядят отлично.
Аудит ничего не стоит.
Возьми страницу, которая ранжируется и отвечает на конкретный запрос (только не главную), скопируй чистый текст — без навигации, футера и сайдбара — и закинь его в Claude, ChatGPT, Grok или Gemini с таким промптом:
You are simulating how a retrieval system processes a web page for AI search.
Take the content below and split it into chunks the way a retriever would: roughly 250-400 tokens each, breaking at natural heading and paragraph boundaries.
Then evaluate EVERY chunk in complete isolation, as if it were the only text you had ever seen. For each one, output:
1. CHUNK NUMBER and the heading it sits under
2. STANDS ALONE: Yes / Partially / No
3. WHAT IT CLAIMS: the main assertion, in one sentence. Write "nothing assertable" if there isn't one.
4. IS THE CLAIM SUPPORTED INSIDE THIS CHUNK: Yes / No - is the evidence, number, example or reasoning present in this same chunk, or does it live elsewhere?
5. ORPHANED PRONOUNS: list every "it / they / this / the company / we" where the entity it refers to is NOT named inside this chunk
6. ENTITY PRESENT: is the main subject explicitly named in this chunk, or only implied?
7. CITABLE AS-IS: could a model quote or paraphrase this chunk in an answer without needing any other part of the page? Yes / No
After the chunk-by-chunk breakdown, give me:
- The 3 WEAKEST chunks and the specific reason each one fails
- Every case where a CLAIM and its SUPPORTING EVIDENCE ended up in different chunks
- A rewrite of the single worst chunk so that it stands completely alone
Be harsh. Do not give credit for anything a human reader would infer from the rest of the page. If the chunk does not contain it, it does not exist.
Поле CITABLE AS-IS определяет, какие чанки нужно доработать.
На клиентских страницах в нише AI SEO почти 95% чанков возвращались с необходимостью правок.
Ремонт здесь структурный, а не редакторский — контент тот же, объем текста почти не меняется, но поведение ретривера становится другим:
— Подтяни доказательную базу в тот же блок, где находится тезис.
— Заново прописывай сущность в начале каждого раздела, вместо того чтобы полагаться на местоимения "он/она/оно" — проверка чаще всего отлавливает именно оторванные местоимения.
— Разбивай длинные разделы подзаголовком до тезиса, а не после него.
— Вытащи оторванную статистику из заключения и поставь ее рядом с тем, что она доказывает.
Я прогнал это на своей странице услуг линкбилдинга, которая отлично сидит в топе Google, но проседает в ChatGPT и Claude, и промпт точно вскрыл причину, отмечает Чарльз Флоат.
Дашборды за $500 в месяц исправно рапортуют об упущенных цитатах.
Но ни один из них не указывает, какой именно чанк в этом виноват.
Инсайты комьюнити
— На локальных сайтах этот сбой происходит еще на входе: часы работы, зона обслуживания и профиль бизнеса зашиты в картинку или PDF, поэтому чанка для извлечения просто не существует — ретривер не отклонял тезис, он его даже не видел.
— Аналогичный аудит изоляции чанков, проведенный для одного клиента, поднял видимость с 35% до средних 85%, и этот уровень держался 3 недели подряд; классическая органика при этом росла параллельно.
#RAG #ContentOptimization #AIContent
@MikeBlazerX
⚠️ Закрытый канал: @MikeBlazerPRO