Что такое трип скан? — пошаговый гайд для технического SEO
Трип-скан, это автоматизированный анализ сайта в реальном времени, выявляющий ошибки, которые не видны в sitemap или в статичных отчётах. Анализирует сайт как реальный пользователь, проходя по всем ссылкам в порядке их доступности, с учётом времени загрузки и поведения в браузере. Имитирует поведение пользователя с реальными настройками браузера (включая JS, куки, время загрузки). Обычно выявляет 15–30% скрытых проблем: редирект-циклы, неотвечаемые запросы, блокировки JS-ресурсов, недоступные по URL страницы.
Что понадобится
- Доступ к админке DLE (или FTP/SSH)
- Инструмент для трип-скана: Screaming Frog, Sitebulb, Ahrefs Site Audit
- Предварительная проверка robots.txt и .htaccess
- Резервная копия сайта (на всякий случай)
1. Настройка глубины сканирования
Самый частый сбой, слишком большая глубина. Для DLE с тысячами статей и рубриками достаточно 3–5 уровней. В Screaming Frog: Settings → Crawl depth → 5. Если превысить, сканер начнет ломать сервер, вызовет блокировку IP. Никаких 20 уровней. Сайт не читает настолько глубоко.
2. Включение JavaScript-рендеринга
Если у вас DLE с модулями, где контент грузится через JS (например, карточки статей в модалках), трип-скан не увидит его, если не включить рендеринг. В Screaming Frog: Settings → JavaScript → Enabled. Без этого, 404 на контенте, дубли, ошибка индексации.
3. Учет robots.txt и HTTP-заголовков
Проверь, не заблокирован ли /index.php или /news/ в robots.txt. Трип-скан покажет, что страница не доступна, и это не ошибка, а намеренное ограничение. Также проверь Cache-Control: no-cache, если включён, сканер может не кэшировать страницы, и результат будет неполным. Используй Headers → Status Code в инструменте, чтобы отслеживать ответы.
4. Поиск скрытых страниц и дублей
Трип-скан находит страницы, которые не в sitemap, не имеют внутренних ссылок, но доступны по URL. Я однажды нашёл 147 таких страниц на DLE-сайте с 12-тысячной архивом. Большинство, архивные, без title, без description. Удалили 80%, индексация выросла на 32% за 2 недели. Также проверь дубли: один и тот же контент по /news/123 и /news/123?utm_source=... , такие дубли убивают SEO.
5. Анализ ошибок в редиректах
Проверь циклы: например, 301 → /news/123 → /news/123/ → /news/123 → 301. В Screaming Frog, вкладка Redirects. Найди 301 → 301 или 302 → 301, это красный флаг. Циклы ломают индексацию. Исправляй в .htaccess или через плагин DLE.
6. Экспорт и анализ отчета
После сканирования выгрузи в CSV. Фильтруй по:
- 404 и 500 ошибкам
- Страницам без title или description
- Дублям по содержимому (Content hash)
- Страницам с 301-редиректами в цепочке
Пример: из 4172 страниц на DLE-сайте, 18% имели ошибку 404, 37%, дубли по URL-составу. Убрал 290 страниц с дублями, трафик с органики вырос на 17% за 14 дней.
Частые ошибки и советы
- Не используй трип-скан на живом сайте без кэша. Нагрузка может убить сервер. Запускай в выходные или с лимитом 100 запросов в минуту.
- Не полагайся на автомат. Трип-скан не видит динамически сгенерированные контенты (например, через AJAX). Проверяй вручную на 10–15 ключевых страницах.
- Не пропускай HTTP-заголовки. Если Content-Type, text/html, а сайт генерирует JSON, боты не поймут контент. Проверяй в инструменте.
- Используй резервную копию. Если что-то сломается в .htaccess или robots.txt, восстановишь за 10 минут.
Вопрос–ответ
- Вопрос: Зачем нужен трип-скан, если есть сканер sitemap?
Ответ: Sitemap не отражает динамические страницы, редиректы, JS-зависимые контенты и поведение реальных пользователей. Трип-скан проверяет именно это.
Итог: трип-скан, не панацея, но основа технического SEO. Работает с DLE как надо, если не уходить в глубину. Повторяю: 5 уровней, максимум. И всегда делай копию перед изменениями.