Рабочая инструкция · 2026 год

Как спарсить hh.ru в 2026 году

Расскажем как НЕ надо парсить hh.ru и как получить данные без банов и без нарушений. Так, чтобы сбор был стабильным и не вызывал санкций со стороны площадки.

Знакомая ситуация

Парсер скачали - данных не получили

Вы хотите получить вакансии и данные работодателей с hh.ru и скачиваете первый попавшийся парсер (например, Datacol, который годами закрывал именно такие задачи). Запускаете сбор - и почти мгновенно hh.ru вас банит. Данные не собираются, а иногда сайт даже перестаёт открываться в браузере. Дальше пытаетесь подобрать рабочие прокси и прочие "танцы с бубнами", но обычно их хватает ненадолго.

Ниже мы расскажем почему так происходит и как правильно получить вакансии и данные работодателей с hh.ru: без бана и прочих санкций со стороны сайта.

Проверено в 2026 году

Что говорят условия площадки

Соглашение об оказании услуг и другие правовые документы опубликованы в разделе hh.ru/article/legal. Площадка отдельно оговаривает, что база вакансий и резюме — охраняемая база данных, а доступ к резюме соискателей платный и предоставляется работодателям по договору.

В robots.txt это подтверждается технически: страницы /resume и /vacancy/* закрыты для всех ботов, включая перечисленных поимённо AI-краулеров (GPTBot, ClaudeBot, ChatGPT-User, Google-Extended, PerplexityBot и другие).

Источник: hh.ru/robots.txt.

Резюме — это персональные данные. Их массовый сбор в обход платного доступа мы не берём в работу ни в каком виде. Вакансии — публичные данные, и по ним есть законный путь: открытый API.

Редкий случай: у hh.ru есть публичный, документированный и бесплатный API для вакансий — api.hh.ru, документация для разработчиков на dev.hh.ru. Поиск вакансий доступен без авторизации, достаточно указать свой User-Agent.

Поиск вакансий по ключевому слову и региону
curl "https://api.hh.ru/vacancies?text=python&area=1&per_page=100" \
  -H "User-Agent: MyApp/1.0 (contact@example.com)"
Полная карточка одной вакансии
curl "https://api.hh.ru/vacancies/<id>" \
  -H "User-Agent: MyApp/1.0 (contact@example.com)"

API отдаёт название, компанию, зарплатную вилку, регион, опыт, тип занятости и описание. Ограничения: постраничная выдача даёт ограниченное число результатов на один поисковый запрос, поэтому широкие выборки приходится дробить на узкие фильтры. Доступ к базе резюме через открытый API не предоставляется.

Если задача — аналитика по вакансиям, рынку зарплат или мониторинг конкурентов, в 90% случаев достаточно официального API. Поможем собрать выгрузку на консультации — это законный и стабильный путь.

Вариант 2

Сторонние сервисы сбора данных

Готовые скреперы для hh.ru, которые кто-то уже написал и продаёт как услугу.

На Apify и подобных площадках есть готовые скреперы hh.ru, которые запускаются HTTP-запросом и возвращают JSON.

Схема запуска стороннего актора
POST https://api.apify.com/v2/acts/<автор>~hh-scraper/run-sync-get-dataset-items?token=<APIFY_TOKEN>
Content-Type: application/json

{ "query": "аналитик", "maxItems": 100 }

Мы не тестировали такие акторы, не проверяли цены и не гарантируем их работу. Для вакансий hh.ru платить стороннему сервису обычно просто незачем — открытый API отдаёт те же данные бесплатно.

Вариант 3

Классический парсинг «в лоб»

Программа с сервера обходит страницы hh.ru и вытягивает вакансии и данные работодателей из вёрстки или внутренних запросов сайта.

Риски

Что ломается

HTML-страницы hh.ru меняются, поисковая выдача ограничена по глубине, а частые запросы упираются в защиту от автоматического трафика.

Правовая сторона

Серая зона

База вакансий и резюме охраняется как база данных, а резюме дополнительно защищены как персональные данные. Сбор в обход официального доступа — прямой риск.

Так работает наш десктопный парсер Datacol: под hh.ru у него есть отдельная готовая кампания - вы задаёте ссылки на выдачу, программа обходит карточки и сохраняет должность, компанию, зарплату и требования в таблицу. Ниже - реальные экраны программы.

Интерфейс программы-парсера: кампания и входные ссылки для hh.ru
Классический парсер: кампания и список входных ссылок
Интерфейс программы-парсера: таблица результатов сбора
Результат классического сбора: таблица с собранными полями

Вариант 4 · рекомендуемый

Сбор через Chrome-расширение

Данные собираются прямо в вашем браузере, на страницах hh.ru, которые вы и так открываете как обычный пользователь.

Честно

Никакой лишней нагрузки

Расширение читает страницы, которые вы уже открыли в браузере, — дополнительной нагрузки на hh.ru нет.

Стабильно

Не ловит блокировки

Нет прокси и массовых запросов, значит нет блокировок и капчи.

Аккуратно

Под вашу задачу

Помогает добрать то, чего нет в открытом API, — в разумных объёмах и без работы с чужими персональными данными.

Расширение настраивается точечно: какие поля забирать, с каких страниц и в каком формате выгружать. Как это выглядит на практике — в блоке ниже.

Рекомендуем

Демо-скрепер для hh.ru — бесплатно

Соберём рабочее Chrome-расширение под 3–5 базовых полей с hh.ru и пришлём его вам в течение 24 часов. Расширение работает в вашем браузере от вашего имени: без нагрузки на сайт и без искажения его метрик.

Заявку обрабатывает команда Datacol вручную — это не автоматическая генерация.