Предыстория проекта
О сайте и бизнесе
Проект представляет собой специализированный новостной и аналитический портал, посвященный морским грузовым перевозкам. Сайт работает на WordPress и ежедневно публикует 13-16 материалов. Основная монетизация происходит через платную подписку на закрытые аналитические материалы. Важно отметить, что это не просто агрегатор новостей – большая часть контента создается редакцией самостоятельно, и только около 10% составляют официальные пресс-релизы.
Первоначальное обращение
Клиент обратился с четкими проблемами:
- Падение ИКС с 2020 года
- Наложение санкций Яндекса за неуникальный контент
- Общее снижение посещаемости
При первичном анализе я обнаружил, что сайт содержит около 45 800 страниц (по данным индекса Google), хотя фактическое количество страниц было еще больше.
Исходная ситуация
На момент начала работы над проектом наблюдалась следующая ситуация:
- Значительное падение органического трафика
- Техподдержка Яндекса отвечала стандартными отписками о "несоответствии критериям качества"
- Множество технических проблем, связанных с WordPress
Выявленные проблемы
Технический аудит
При проведении технического аудита я выявил несколько критических проблем:
Дублирование контента:
- 368 страниц (1%) содержали одинаковые title
- 4356 страниц (9%) имели одинаковые description
- Множественные дубли из-за некорректной обработки URL с языковыми версиями
Проблемы с языковой структурой:
- Хаотичное использование префиксов /ru/ и /en/
- Отсутствие четкой структуры для многоязычного контента
- Некорректные редиректы между языковыми версиями
Индексация служебных страниц:
- Индексация страниц результатов поиска
- Индексация тегов и служебных разделов
- Открытые для индексации технические разделы
Контентный анализ
В ходе анализа контента были обнаружены следующие проблемы:
Малоинформативные страницы:
- Более 50% страниц в индексе были определены Яндексом как малополезные
- Большое количество страниц с минимальным объемом контента
- Устаревшие новости без обновлений
Проблемы с уникальностью:
- Дублирование пресс-релизов без переработки
- Автоматические переводы без редактуры
- Отсутствие добавленной ценности в новостных материалах
Структурные проблемы
Неоптимальная структура URL:
- Отсутствие единообразия в формировании URL
- Проблемы с дублями из-за слешей на конце URL
- Некорректная обработка GET-параметров
Реализованные решения
Технические исправления
Первым этапом работы стало исправление технических проблем:
- Очистка индекса:
- Закрытие от индексации малоценных страниц через meta robots noindex
- Настройка корректных редиректов для языковых версий
- Удаление дублей через canonical
- Оптимизация метатегов:
- Исправление дублирующихся title и description
- Внедрение уникальных метаописаний для ключевых страниц
- Настройка корректных hreflang тегов
Работа с контентом
Особое внимание было уделено анализу и улучшению контента. При начальном анализе было выявлено, что только 18.16% страниц находились в индексе от общего количества загруженных (при норме более 85%). При этом интересная закономерность: страницы за последние 2-3 года индексировались значительно лучше старых (93.89% страниц за 2022 год против 44.26% за 2019 год).
Была разработана стратегия по улучшению качества контента:
- Работа с пресс-релизами:
- Внедрение обязательной редакторской обработки
- Добавление экспертных комментариев
- Расширение контекста новостей
- Управление архивным контентом:
- Разработка системы для автоматического закрытия от индексации старых материалов
- Внедрение механизма проверки актуальности контента
- Настройка правил для определения малоценных страниц
Коммуникация с Яндексом
Особое внимание было уделено правильному взаимодействию с Яндексом:
- Системная работа с техподдержкой:
- Регулярные обращения с детальным описанием внесенных изменений
- Предоставление конкретных примеров улучшений
- Последовательное устранение всех замечаний
- Мониторинг изменений:
- Отслеживание динамики индексации
- Контроль качественных показателей
- Анализ поведенческих факторов
Результаты

После трех месяцев активной работы были достигнуты следующие результаты:
- Снятие фильтра:
- 19 января 2024 года фильтр был снят
- Началось восстановление органического трафика
- Улучшились показатели индексации
- Технические улучшения:
- Количество малоценных страниц сократилось до минимума
- Улучшились показатели индексации новых материалов
- Повысилось качество технических показателей сайта
Выводы и рекомендации
Ключевые факторы успеха:
- Системный подход:
- Последовательное устранение всех технических проблем
- Регулярная коммуникация с техподдержкой
- Постоянный мониторинг изменений
- Работа с контентом:
- Улучшение качества публикуемых материалов
- Внедрение системы контроля качества
- Работа над уникальностью контента
Рекомендации для похожих проектов:
- Профилактика проблем:
- Регулярный мониторинг технического состояния сайта
- Контроль качества публикуемого контента
- Своевременное реагирование на предупреждения вебмастера
- Работа с фильтрами:
- Не паниковать при наложении фильтра
- Действовать системно и последовательно
- Документировать все вносимые изменения
Что можно было сделать лучше:
- Превентивные меры:
- Внедрить систему контроля качества контента на этапе публикации
- Разработать более четкие критерии для публикации пресс-релизов
- Автоматизировать процесс выявления малоценных страниц
- Технические улучшения:
- Внедрить более эффективную систему управления многоязычным контентом
- Улучшить механизмы определения устаревшего контента
- Оптимизировать процесс обновления метатегов
Практические рекомендации по реализации
Хочу поделиться конкретным техническим решением, которое мы внедрили для автоматизации работы с устаревшим контентом. Вот пример PHP-скрипта, который можно добавить в header.php WordPress для автоматического закрытия от индексации материалов старше 2 лет:
<?php
// Получаем текущую дату
$currentDate = new DateTime();
// Получаем дату из URL
if (preg_match('/(\d{4})\/(\d{2})\/(\d{2})/', $_SERVER['REQUEST_URI'], $matches)) {
$urlDate = new DateTime($matches[1] . '-' . $matches[2] . '-' . $matches[3]);
// Вычисляем разницу между текущей датой и датой из URL
$interval = $currentDate->diff($urlDate);
// Проверяем, старше ли дата 2 лет
if ($interval->y >= 2) {
// Добавляем meta тег noindex
echo '<meta name="robots" content="noindex">';
// Добавляем заголовок X-Robots-Tag: noindex
header('X-Robots-Tag: noindex');
}
}
?>
Также хочу отметить важные метрики, на которые стоит обращать внимание при работе с новостными сайтами:
- Процент индексации - должен быть выше 85% для качественного сайта
- Возраст контента - материалы последних 2-3 лет должны иметь индексацию близкую к 90-95%
- Уникальность - не меньше 85% собственного контента, не более 15% пресс-релизов и перепечаток
Отдельный совет по работе с Яндекс.Вебмастером
При работе с фильтрами критически важно регулярно проверять отчёты:
- Дублирующиеся метатеги
- Малоценные страницы
- Технические ошибки
Рекомендую настроить еженедельный мониторинг этих показателей и оперативно реагировать на их изменения. В данном кейсе именно системная работа с этими метриками помогла в итоге добиться снятия фильтра.
Заключение
Работая над подобными проектами важно помнить, что технические решения должны идти рука об руку с качественным контентом. Даже самая совершенная техническая оптимизация не поможет, если базовое качество материалов оставляет желать лучшего. Поэтому рекомендую всегда начинать с аудита контента и только потом переходить к техническим улучшениям.
Этот кейс показывает, что даже в сложных ситуациях с санкциями поисковых систем возможно найти выход. Главное – действовать системно, последовательно и не опускать руки при первых неудачах. Особенно важно отметить, что для новостных сайтов критически важно найти баланс между оперативностью публикаций и их качеством, а также правильно выстроить технические процессы работы с контентом.