Часто задаваемые вопросы

Здесь мы собрали ответы на самые популярные вопросы по работе с парсерами, форматам баз данных и биллингу

Проверенный контур

Legal Compliance (надежность и комплаенс)

Мы - аккредитованная ИТ-компания (N 53813 от 07.05.2024, Минцифры РФ). Платформа работает в строгом соответствии с 152-ФЗ и законодательством РФ. У нас подтвержденная финансовая стабильность: отсутствуют задолженности по налогам, блокировки счетов и открытые судебные делопроизводства.

Подробнее о комплаенсе

Всего тем по работе с сервисом: 15 - вопросов: 68

Базы доменов и WHOIS

4 вопроса в разделе

Базы зарегистрированных доменов (.RU, .COM и др.) обновляются ежедневно в автоматическом режиме. Свежие списки новых регистраций и дроп-доменов (удаленных из реестра) загружаются после 08:00 по московскому времени.
Вы получаете полный перечень доменных имен в выбранной зоне, который включает в себя: имя домена, дату регистрации ресурса и дату истечения срока действия (если открыто), а также нейм-серверы (NS), к которым он делегирован. Полнота параметров зависит от правил конкретной зоны.
В соответствии с правилами GDPR и политикой ICANN, регистраторы скрывают персональные данные владельцев доменов (Privacy Protection). Поэтому email и телефоны физических лиц в выгрузках недоступны. Контакты могут быть доступны только для юридических лиц и только если они открыты в WHOIS.
Списки доменов незаменимы для доменного инвестирования (киберсквоттинга и перехвата красивых дропов), SEO-аналитики бизнеса (анализ сеток сателлитов/PBN), B2B-продаж (мониторинг новых компаний), и анализа инфраструктуры конкурентов.

Этика данных и прозрачность

4 вопроса в разделе

Да, мы строго соблюдаем требования Федерального закона от 27.07.2006 N 152-ФЗ. Все собираемые данные об индивидуальных предпринимателях проходят процесс автоматизированной деперсонализации. Мы исключаем любую информацию, относящуюся к частной жизни (личные номера телефонов, домашние адреса), оставляя только публичные корпоративные контакты, используемые ИП для ведения коммерческой деятельности.
Наши алгоритмы настроены исключительно на индексацию публичных веб-страниц, доступных без регистрации, ввода пароля или обхода систем защиты. Мы используем государственные реестры (ЕГРЮЛ/ЕГРИП), картографические сервисы (где компании сами размещают информацию о себе) и официальные сайты организаций. Скрытые и защищенные базы данных не индексируются.
Мы категорически не собираем биометрические данные, сведения о здоровье, расовой или национальной принадлежности, политических взглядах, философских убеждениях, интимной жизни. Также мы не извлекаем личные email-адреса граждан и частные номера мобильных телефонов, скрытые настройками приватности на классифайдах и маркетплейсах.
Собранные вами базы данных и файлы загрузок хранятся в зашифрованном виде в вашем личном кабинете и автоматически удаляются через 30 дней после генерации. По вашему запросу на email поддержки мы можем произвести полное удаление вашего аккаунта, истории поиска и платежей в течение 48 часов без возможности восстановления.

Ценообразование, оплата и закрывающие документы

4 вопроса в разделе

У нас нет абонентской платы. Вы платите исключительно за успешный результат (Pay-as-you-go). Средства списываются с баланса вашего личного кабинета только после того, как робот успешно собрал данные. Если задача завершилась с ошибкой — мы не спишем ни копейки.
Да, мы предоставляем все условия для B2B-клиентов. Пополнить баланс можно с помощью корпоративной карты (переход на шлюз оплату), либо запросить автоматический счет на безналичную оплату от юридического лица прямо в личном кабинете. Зачисление по счету происходит в течение 1 банковского дня.
Абсолютно. Электронные закрывающие документы (чеки, акты выполненных работ) автоматически формируются в разделе «Счета и документы» личного кабинета для каждого пополнения. Оригиналы УПД мы можем отправить через систему электронного документооборота (ЭДО Контур.Диадок) по вашему запросу.
Мы предоставляем 100% гарантию на качество технического сбора. Если формат итогового файла не соответствует заявленному — просто обратитесь в поддержку, мы компенсируем затраченные средства обратно на баланс и адаптируем скрипты сбора под изменившуюся верстку сайта-донора.

Введение и общие вопросы

4 вопроса в разделе

XMLDATAFEED — это облачная платформа автоматизированного сбора (парсинга) и структурирования открытых данных. Наш сервис помогает селлерам, владельцам интернет-магазинов, маркетологам и аналитикам быстро собирать данные с маркетплейсов, агрегаторов и справочников для мониторинга цен, анализа ниш и наполнения каталогов без навыков программирования.
Абсолютно законно. Вся предоставляемая нашим сервисом информация о контрагентах собирается из официальных источников и является открытой и общедоступной в соответствии с законами РФ (в частности, п. 2 ст. 7 №149-ФЗ, п. 1 ст. 6 №129-ФЗ, и п. 1 ст. 6 №152-ФЗ "О персональных данных"). Данные юр. лиц и ИП, зарегистрированные в госреестрах, подлежат обязательному раскрытию и не являются охраняемой тайной. Наш алгоритм работает бережно, не взламывает чужие сервисы и собирает только публичную информацию. Сервис выступает как поисковый инструмент, не создающий и не изменяющий информацию, а лишь отражающий её в том виде, в котором она содержится в первоисточнике.
Нет. Сервис не предназначен для обработки персональных данных физических лиц, не связанных с предпринимательской деятельностью. Мы ориентированы на работу с бизнесом (юридическими лицами и ИП) и анализируем только ту информацию, которая относится к предпринимательской деятельности и размещена в открытых источниках.
Категорически нет. Наш сервис специализирован для работы с e-commerce (интернет-магазинами), маркетплейсами и открытыми коммерческими справочниками. Мы строго соблюдаем законодательство РФ, поэтому в нашей системе внедрена автоматическая блокировка на сбор данных с любых государственных, федеральных и муниципальных информационных ресурсов. Список запрещенных доменов публикуется в разделе "Законность сбора данных".

Парсинг маркетплейсов (Ozon, WB, Я.Маркет)

3 вопроса в разделе

Данные собираются в режиме реального времени на момент запуска вашей задачи. Вы получаете ровно те же цифры, которые видит обычный покупатель, зашедший на карточку товара прямо сейчас, включая актуальные скидки и остатки по складам (FBO/FBS).
Да, наши аналитические парсеры для Ozon и Wildberries (WB: Мониторинг ставок, Ozon: Анализ рекламы) позволяют в режиме реального времени выгружать актуальные ставки, которые продавцы платят за показы в поиске. Это поможет вам оптимизировать свой рекламный бюджет.
Да. Мы извлекаем только публичные юридические данные (название ИП/ООО, ИНН, ОГРН, публичный рейтинг и отзывы) со страниц продавцов на маркетплейсах. Скрытые личные телефоны владельцев магазинов не собираются, так как они не находятся в открыдоме.

Базы компаний B2B (2ГИС, Яндекс Карты)

4 вопроса в разделе

Мы актуализируем все коммерческие справочники и базы (рестораны, клиники, IT, производство и т.д.) ежемесячно. Перед каждой продажей мы также проводим дополнительную верификацию случайной выборки для подтверждения актуальности телефонов и email-адресов.
Да. В ходе сбора все собранные email-адреса пропускаются через встроенный SMTP-валидатор. Вы получаете чистую базу без спам-ловушек и несуществующих ящиков, сразу готовую для B2B рассылок (Cold Email).
Базы собираются из открытых справочников (2ГИС, Яндекс.Карты, сайты компаний). Таким образом, в базу попадают те контакты (включая мобильные или WhatsApp), которые компании сами указали в качестве контактных. В базах нет украденных личных номеров директоров.
Да, в разделе "Базы компаний B2B" вы можете выбрать любую страну (Россия, СНГ), нужные города и конкретные микро-категории бизнеса (вплоть до "ночной клуб" или "шиномонтаж"). Система автоматически сформирует выгрузку под ваш запрос.

Партнёрская программа (Аффилиат)

4 вопроса в разделе

Любой зарегистрированный пользователь автоматически становится нашим партнёром. Перейдите в раздел «Партнёрская программа» в Личном кабинете, скопируйте вашу уникальную ссылку и размещайте её на своих ресурсах — в блогах, социальных сетях, на форумах или отправляйте напрямую клиентам.
Вы получаете процент от КАЖДОГО платежа пользователя, который перешел по вашей ссылке и зарегистрировался (пожизненное закрепление). Базовая комиссия зависит от типа заказа (от 20% до 35%). Мы платим с покупок готовых баз, оплаты серверов парсинга и инструментов обработки документов.
Мы осуществляем прямые выплаты от 3000 рублей по вашим реквизитам. Заявки обрабатываются официально. Вы можете выступать как физическое лицо (через самозанятость - НПД), так и как юридическое лицо (ИП, ООО). В кабинете доступны образцы договоров для законного оформления выплат.
Да! В вашем личном кабинете на странице Партнёрской программы доступен раздел «Промо-материалы». Там вы найдете готовые баннеры, логотипы, иконки и адаптированные тексты постов для Telegram-каналов и рассылок, которые повысят вашу конверсию.

Работа с документами и файлами

2 вопроса в разделе

К сожалению, из-за юридических и технических ограничений мы не обрабатываем файлы PDF с паролем или сложным DRM шифрованием.
Все загруженные файлы удаляются сразу после завершения обработки и скачивания вами результата. Мы не храним исходные документы на наших серверах для вашей безопасности.

Форматы получаемых файлов

5 вопросов в разделе

Готовая классическая таблица (.xlsx). Она сразу разбита по столбцам и полностью готова к работе. Идеально подходит для просмотра данных менеджерами на компьютере, фильтрации, сортировки или отправки клиентам. Скачивайте в Excel, если вам нужна наглядность и удобство без дополнительных настроек.
CSV (Comma-Separated Values) — это легкий, «плоский» текстовый формат таблицы. В первую очередь он предназначен для массового импорта. Если вы загружаете базу контактов в вашу CRM (Bitrix24, amoCRM), либо переносите товары в админку интернет-магазина (1C-Битрикс, InSales, WordPress) — выбирайте исключительно формат CSV.
JSON (JavaScript Object Notation) — формат для передачи структурированных данных. Если вы разработчик и вам требуется автоматизированная передача собранных данных в ваши базы (MySQL, PostgreSQL), интеграция через API или отправка данных в мобильное приложение — выбирайте JSON.
Оба формата популярны при сборе контента с сайтов (парсинг блогов, статей). Формат TXT отдаст вам абсолютно «голый» текст, очищенный от дизайна — идеальная заготовка для SEO, перевода или обучения ИИ. Формат PDF, напротив, сохраняет форматирование, структуру и абзацы, он отлично подходит для пересылки как завершенного документа или отчета.
YML (Yandex Market Language) — это российский стандарт, созданный на базе XML. Он используется Яндексом, ВКонтакте, Ozon и Авито для массовой загрузки ваших прайс-листов (товарных фидов). Если вы собираетесь размещать товары на маркетплейсах РФ, всегда выбирайте YML. Обычный XML-формат от Google применяется чаще для зарубежных площадок (Google Merchant).

Соцсети, вакансии и недвижимость

4 вопроса в разделе

Да. Мы предоставляем инструменты для сбора постов, комментариев и анализа реакций из любых открытых (публичных) каналов и групп. Сбор закрытых чатов или личных переписок строго невозможен.
Вы вставляете ссылку на результаты поиска с нужными фильтрами (например, "квартиры в Москве до 10 млн" или "Toyota RAV4 2020 год"). Робот собирает все объявления: цены, описание, характеристики. Важно: мы не собираем скрытые номера телефонов продавцов в обход систем защиты классифайдов.
Они отлично подходят для формирования свежей B2B-базы. Вы сможете собрать телефоны, адреса, ссылки на сайты и соцсети компаний, а также их рейтинги по нужной рубрике (например, "стоматологии в Казани").
Да, инструменты для сохранения видеоконтента для оффлайн просмотра (mp4) на компьютер с YouTube и RuTube предоставляются абсолютно бесплатно без суточных лимитов.

Техническая работа платформы

4 вопроса в разделе

Вы можете скачать результаты своей выгрузки в любом удобном формате: CSV (оптимально для загрузки в базы данных и CRM), Excel / XLSX (для визуального чтения и ручного анализа), JSON (для разработчиков и интеграций) и XML / YML (для товарных фидов Яндекс.Маркета).
Для регулярного сбора данных и автоматизации бизнес-процессов мы предоставляем API Data Processing. Вы можете использовать HTTP-запросы для программного запуска задач парсинга, управления лимитами и автоматического получения результатов в свои корпоративные системы.

Официальная документация API

Ознакомьтесь с подробным описанием всех эндпоинтов, форматами ответов и примерами интеграции для разработчиков.

Перейти к документации
Маркетплейсы часто включают агрессивную защиту (Cloudflare, Qrator). Мы используем встроенные прокси и алгоритмы обхода, но если робот столкнулся с блоком, задача переходит в статус «Ошибка». Средства за такую задачу возвращаются на ваш баланс. Наши инженеры получают сигнал и обычно адаптируют парсер в течение 24 часов.
Нет. Мы используем собственную обширную сеть резидентных прокси. Ротация IP-адресов, обход капч и анти-бот защит уже включена в стоимость каждого парсера. Вам достаточно просто вставить ссылку и запустить задачу.

Финансы и оплата

4 вопроса в разделе

Нет, ваш баланс постоянно закреплен за вашей учетной записью. Даже если вы не пользовались сервисом несколько месяцев, внесенные средства останутся на счету до следующего сбора.
Да! Мы работаем официально (ООО) по ЭДО и с бумажными закрывающими документами. Мы выставляем счета (без НДС). Для выставления счета обратитесь в Службу заботы с вашими реквизитами. Минимальная сумма для безналичной оплаты от юрлица: 5 000 руб.
У готовых парсеров есть фиксированная ставка за 1 строку выполненной операции. Перед запуском система покажет примерную лимитную стоимость (максимум, который может быть списан). Списание происходит только по факту успешно выгруженных строк.
Нет. При запуске платного полного сбора мы лишь временно замораживаем (блокируем) необходимую сумму на вашем внутреннем балансе. Если задача будет выполнена успешно — деньги спишутся. Если задача завершится с ошибкой или система соберет меньше строк, чем заявлено, остаток или полная сумма моментально вернется на ваш баланс. Вы платите исключительно за успешный конечный результат.

Словарь терминов и аббревиатур

7 вопросов в разделе

Парсинг — это процесс автоматизированного сбора открытых данных с веб-страниц сайтов и их последующее структурирование в удобные форматы (Excel, CSV, таблицы). Парсер — это сама программа (робот) или скрипт, выполняющий эту монотонную задачу вместо ручного копирования информации человеком.
B2B (Business to Business) — это сегмент рынка, в котором одни компании продают товары или оказывают услуги другим компаниям, а не конечным потребителям (физическим лицам). Наши базы данных собираются именно по B2B-сектору: юрлицам и индивидуальным предпринимателям.
API (Application Programming Interface) — это программный интерфейс, набор способов и правил, по которым одни компьютерные программы общаются с другими. С помощью нашего API вы можете подключить парсер напрямую к своей ERP, CRM или 1С для автоматического получения данных без необходимости нажимать кнопки в интерфейсе сайта.
SaaS (Software as a Service) — бизнес-модель, при которой программное обеспечение предоставляется как интернет-сервис. Вы не скачиваете и не устанавливаете парсер на свой компьютер (и не тратите ресурсы своего процессора и интернета), а работаете с ним прямо через браузер, используя наши облачные вычислительные мощности.
XLSX — классический формат таблиц Excel, идеален для ручного просмотра. CSV — легкий текстовый формат таблицы со значениями, разделенными запятыми (или точками с запятой), стандарт для импорта в CRM и базы данных. JSON — формат обмена данными между скриптами (популярен в веб-разработке и API). XML/YML — стандартизированный файл с тегами для товарных фидов Яндекс Маркета или Google Merchant.
ИНН (Идентификационный номер налогоплательщика) — уникальный код, присваиваемый юрлицу или физлицу в ФНС. ОГРН (Основной государственный регистрационный номер) — номер записи о создании юрлица в государственном реестре. КПП (Код причины постановки на учет) — код, который присваивается юрлицу вместе с ИНН, указывающий на причину его налогового учета. Это основные реквизиты, используемые в наших базах для идентификации компаний.
SLA (Service Level Agreement) — соглашение об уровне обслуживания. Это документ или раздел договора, регламентирующий, насколько быстро техническая поддержка должна отвечать на запросы клиента, и какой уровень доступности (Uptime, например 99.9%) мы гарантируем для наших серверов.

Безопасность и 152-ФЗ

7 вопросов в разделе

Все наши серверные мощности, базы данных и системы хранения физически расположены в сертифицированных и защищенных дата-центрах на территории Российской Федерации (г. Москва). Наша инфраструктура и регламенты работы с информацией полностью соответствуют всем требованиям Федерального закона № 152-ФЗ «О персональных данных».
Любые данные, которые вы загружаете в систему — ссылки для парсинга, списки ИНН, брендов, товарных артикулов или ключевых фраз — являются строго конфиденциальными. Они никогда не передаются третьим лицам, не используются в публичных демонстрациях и доступны только вам через ваш зашифрованный Личный кабинет.
Да, безусловно. Мы сотрудничаем со многими крупными компаниями и ведомствами. Мы можем подписать типовое Соглашение о неразглашении конфиденциальной информации (NDA) как по нашей форме, так и по форме заказчика. Свяжитесь для этого с нашей Службой заботы.
Вся передача данных на платформу XMLDATAFEED, авторизация пользователей по логину и паролю и скачивание готовых результатов сборов (в форматах Excel, CSV, JSON) защищены сквозным шифрованием по протоколу HTTPS (SSL/TLS торгового уровня).