Внутренняя перелинковка отраслевого медиа: граф, приоритеты и контроль анкоров

Практическая система внутренней перелинковки: модель графа, оценка релевантности, поиск сирот, контроль анкоров, SQL-аудит и редакционный регламент.

Оглавление10 разделов

Внутренняя перелинковка статей — это управление маршрутом чтения и графом обнаружения, а не расстановка фиксированного числа ссылок. Система должна отвечать на четыре вопроса: какой URL является основным по интенту, откуда читатель логично к нему придёт, каким анкором описать следующий шаг и как убедиться, что после обновлений граф не распался.

Рабочая единица

Планируйте не «ссылку на ключ», а ребро графа: source_url → destination_url с причиной, местом, анкором, типом маршрута и датой проверки.

Модель данных для аудита

Минимальный реестр страниц хранит canonical URL, статус индексации, тип, кластер интента, дату содержательного обновления и владельца. Реестр ссылок хранит источник, назначение, анкор, DOM-зону и HTTP-статус назначения. Без разделения контентных, навигационных и CTA-ссылок отчёт будет считать один и тот же шаблон сотнями «редакционных рекомендаций».

Минимальная схема графа
CREATE TABLE content_pages (
  page_id         bigint PRIMARY KEY,
  canonical_url   text UNIQUE NOT NULL,
  page_type       text NOT NULL,
  intent_cluster  text NOT NULL,
  indexable       boolean NOT NULL,
  content_updated_at timestamptz NOT NULL
);

CREATE TABLE internal_links (
  source_page_id      bigint REFERENCES content_pages(page_id),
  destination_page_id bigint REFERENCES content_pages(page_id),
  anchor_text         text NOT NULL,
  link_zone           text NOT NULL,
  discovered_at       timestamptz NOT NULL,
  http_status         integer,
  PRIMARY KEY (source_page_id, destination_page_id, anchor_text, link_zone)
);

Схема не требует конкретного crawler: данные можно получать из статической сборки, DOM-обхода или CMS. Важно сохранять canonical после разрешения redirect, иначе один материал появится в графе под несколькими адресами.

Четыре типа редакционных маршрутов

Определение → применение

Базовый материал объясняет термин и ведёт к практической инструкции. Статья о SubID может направить к сверке postback, но не обязана ссылаться на каждый материал аналитического кластера.

Диагностика → исправление

Материал о симптоме ведёт к процедуре локализации причины. Например, разбор потери событий связывается с контрольными суммами и жизненным циклом статуса, потому что это разные этапы одного расследования.

Методика → решение

Статья о критериях выбора ведёт к сравнению или карточке продукта только после того, как читатель понял методику. Коммерческий переход не маскируется под обязательный шаг инструкции.

Обзор → углубление

Хаб распределяет читателей по отличимым вопросам. Его задача — не повторять ответы дочерних статей, а объяснить границы и порядок изучения.

Поиск реальных страниц-сирот

Страница без входящего контентного ребра может присутствовать в sitemap и общем списке статей, но оставаться вне редакционного маршрута. Аудит должен исключить текущую страницу, неиндексируемые URL, шаблонную навигацию и ссылки с ошибочным назначением.

SQL: индексируемые страницы без входящих контентных ссылок
SELECT p.page_id, p.canonical_url, p.intent_cluster
FROM content_pages AS p
LEFT JOIN internal_links AS l
  ON l.destination_page_id = p.page_id
 AND l.link_zone = 'article_body'
 AND l.http_status BETWEEN 200 AND 299
LEFT JOIN content_pages AS source
  ON source.page_id = l.source_page_id
 AND source.indexable = true
WHERE p.indexable = true
GROUP BY p.page_id, p.canonical_url, p.intent_cluster
HAVING count(source.page_id) = 0
ORDER BY p.intent_cluster, p.canonical_url;

Нулевое число входящих ссылок — сигнал для ревью, а не команда поставить случайную ссылку. Возможно, страница дублирует существующий интент, устарела или должна быть объединена. Сначала решается судьба URL, затем создаётся ребро.

Оценка кандидатов без псевдоточности

Чтобы не выбирать источник «на глаз», используйте редакционный score. Это не попытка воспроизвести алгоритм поиска, а очередь задач. Каждый компонент оценивается по внутренней шкале от 0 до 1 и хранится отдельно, чтобы редактор видел причину результата.

priority = intent_fit × reader_next_step × destination_need × source_confidence. Intent fit показывает смысловую близость; next step — вероятность, что ссылка продолжает задачу; destination need — отсутствие других качественных входов; source confidence — актуальность и подтверждённость исходного материала. Нулевой компонент обнуляет кандидат: сильная страница не оправдывает нерелевантную ссылку.

Анкор как обещание назначения

Анкор должен позволять предсказать, что откроется после клика. «Подробнее» допустимо только когда ближайший контекст однозначен; повторение полного H1 выглядит механически. Для одной страницы естественны разные формулировки, если они точно отражают разные контексты перехода.

SQL: концентрация одинаковых анкоров
WITH normalized AS (
  SELECT destination_page_id,
         lower(regexp_replace(trim(anchor_text), '\s+', ' ', 'g')) AS anchor,
         count(*) AS uses
  FROM internal_links
  WHERE link_zone = 'article_body'
  GROUP BY destination_page_id, anchor
), totals AS (
  SELECT destination_page_id, sum(uses) AS all_uses
  FROM normalized
  GROUP BY destination_page_id
)
SELECT n.destination_page_id, n.anchor, n.uses,
       round(n.uses::numeric / NULLIF(t.all_uses, 0), 3) AS share
FROM normalized AS n
JOIN totals AS t USING (destination_page_id)
ORDER BY share DESC, uses DESC;

Запрос не устанавливает «безопасный процент». Он показывает назначения, где один анкор доминирует, после чего редактор вручную проверяет естественность. Брендовый термин или название инструмента могут закономерно повторяться; коммерческий ключ в каждом абзаце — нет.

Глубина и направленность графа

Не нужно заставлять каждую статью ссылаться на хаб и обратно симметрично. Ребро направлено: из базовой статьи читателю полезна практика, а из узкой диагностики — определение только при необходимости. Отдельно контролируйте shortest path от видимых входных страниц до важных материалов, но не оптимизируйте абстрактную глубину ценой лишних переходов.

Ссылки после объединения и редиректа

После консолидации дублей внутренние ссылки переписывают сразу на конечный canonical, даже если redirect работает. Цепочки скрывают реальную структуру, замедляют проверку и оставляют старые анкоры. В журнале миграции хранят old_url, new_url, причину, дату и число исправленных ребёр.

Автоматические и ручные проверки

  • Crawler проверяет HTTP-статус, canonical, redirect chain и доступность href
  • SQL ищет сироты, самоссылки, циклы redirect и доминирующие анкоры
  • Редактор подтверждает intent fit и следующий шаг
  • SEO-ревью проверяет каннибализацию до создания нового URL
  • После сборки тест открывает все изменённые назначения
  • Мониторинг повторяет crawl после удаления или объединения страниц
Не создавайте ссылочные блоки ради числа

Автоматический блок «похожие материалы» полезен только при объяснимом подборе. Совпадение категории или пары ключей не доказывает, что материал является следующим шагом.

Регламент изменения статьи

  1. При создании назначить кластер и роль страницы.
  2. Выбрать два–четыре возможных следующих вопроса, не обязательное число ссылок.
  3. Проверить, существует ли основной URL для каждого вопроса.
  4. Добавить контекстные ребра и записать причину.
  5. Найти две существующие страницы, откуда новый материал действительно продолжает маршрут.
  6. После публикации проверить href, canonical и HTTP 200.
  7. Через плановый crawl пересмотреть сироты и концентрацию анкоров.
Источники и границы применимости

Google Search Central: crawlable links and anchor text · Google Search Central: sitelinks and site structure

Вывод

Экспертная перелинковка строится из данных о страницах и редакционных причин. Модель графа показывает сироты и сломанные назначения, score помогает упорядочить работу, а ручная проверка защищает от механических анкоров. Ссылка добавляется потому, что продолжает задачу читателя, а не потому, что у статьи осталось место в шаблоне.

Станьте партнёром и начните работать

Перейдите в партнёрскую программу, изучите актуальные условия и выберите подходящий формат сотрудничества.

СТАТЬ ПАРТНЁРОМ

Связанные материалы

Все статьи
SEO

Programmatic SEO без мусорных страниц: как определить порог полезности до публикации

Большой разбор programmatic SEO: самостоятельная ценность страницы, шаблоны, данные, индексирование, контроль дублей и редакционный порог перед массовой публикацией.

SEO

Content pruning без массового удаления: обновить, объединить или закрыть URL

Практический content pruning для медиа: как оценить слабые URL, выбрать обновление, объединение, редирект или удаление и проверить последствия без SEO-паники.

SEO

Регламент обновления evergreen-статей: факты, версии, даты и Schema

Как обновлять evergreen-статьи по фактическим триггерам: реестр утверждений, diff, сохранение datePublished, честный dateModified, объединение URL и QA.