[Десктопный софт] A-Parser 1.1 - продвинутый парсер поисковых систем, Suggest, PR, DMOZ, Whois, etc

A-Parser Support

Новичок
Регистрация
1 Дек 2016
Сообщения
260
Реакции
0
Баллы
16
A-Parser 1.1 - продвинутый парсер поисковых систем, Suggest, PR, DMOZ, Whois, etc

A-Parser - многопоточный парсер поисковых систем, сервисов оценки сайтов, ключевых слов, контента(текст, ссылки, произвольные данные) и других различных сервисов(youtube, картинки, переводчик...), всего A-Parser содержит более 60 парсеров



A-Parser полностью решает рутинные задачи по получению, обработки и систематизации данных, необходимых для работы в следующих областях:
  • SEO-оптимизация сайтов и Web-аналитика
    • Сбор баз ссылок для XRumer, A-Poster, AllSubmitter, ZennoPoster...
    • Оценка сайтов и доменов по множеству параметров
    • Мониторинг позиции любых сайтов в поисковых системах
    • Сбор контента(текст, картинки, ролики) для генерации сайтов(дорвеев)
    • Отслеживание обратных ссылок
    • Сбор произвольной информации с любых сайтов(например телефоны/e-mails, сообщения с форумов, объявления...)
    • Сбор и оценка ключевых слов
    • Сбор списка обратных ссылок
    • И многое другое
  • Web-безопасность
    • Сбор и фильтрация баз ссылок по признакам
    • Определение CMS сайтов
    • Формирование произвольных GET, POST запросов с одновременной фильтрацией ответа
  • Сетевое администрирование
    • Работа с DNS службой - резолвинг доменов в IP адреса
    • Работа с Whois - дата регистрации и окончания регистрации доменов, name-cервера

A-Parser обладает следующими преимуществами:
  • Колоссальная производительность
    • Многопоточность - парсер способен распараллеливать сетевые операции до 5000-10000 потоков в зависимости от конфигурации компьютера и решаемой задачи
    • Продуманная внутренняя архитектура, в которую заложена производительность и расширяемость
    • Множественные оптимизации сложных операций
    • Парсер не требователен к ресурсам, может работать как на компьютере, так и на VDS или сервере, на операционных системах Windows, Linux или FreeBSD
  • Промышленные масштабы
    • Парсер разрабатывался с учетом работы с неограниченным размером данных
    • Способен обрабатывать сотни миллионов и миллиардов запросов
    • Размеры файлов запросов и результатов ничем не ограничены и могут достигать терабайтных значений
  • Автономность
    • A-Parser рассчитан на бесперебойную и беспрерывную работу без участия пользователя
    • Очередь заданий позволяет нагрузить парсер работой на недели и месяцы вперед
    • Одновременное выполнение нескольких разных задач для скорейшего получения результатов
  • Поддержка более 60 парсеров
    • Парсеры поисковых систем: Google, Yandex, AOL, Bing, Baidu, DuckDuckGo, QIP, Yahoo, YouTube
    • Парсеры подсказок поисковых систем: Google, Yandex, Bing, Yahoo
    • Парсеры и анализ ключевых слов: кейворды и частотность по Yandex.WordStat, в т.ч. по датам и регионам; частотность по Yandex.Direct; Google Trends
    • Регистрация аккаунтов: Yandex
    • Парсеры параметров сайтов и доменов: позиции в поисковых системах Google, Yandex, QIP; PageRank, TrustRank, Compromised, SafeBrowsing, LangDetect, LangDetect через Bing, тИЦ, Whois, DNS, CMS, Ahrefs, Alexa, Category, DMOZ, Linkpad, MajesticSEO, OpenSiteExplorer,
      rank-semrush.png
      SEMrush
    • Парсеры различных сервисов:
      se-bing-translator.png
      Bing Translator,
      se-google-maps.png
      Google Images,
      se-bing-images.png
      Bing Images,
      se-google-maps.png
      Google Maps,
      se-yandex-direct.png
      Yandex.Direct,
      util-antigate.png
      AntiGate
    • Парсеры контента:
      html-textextractor.png
      TextExtractor,
      html-linkextractor.png
      LinkExtractor,
      check-backlink.png
      BackLink, HTTP парсер для создания произвольных парсеров
  • Создание собственных парсеров
    • Использование регулярных выражений
    • Поддержка многостраничного парсинга
    • Проверка контента и наличия следующей страницы
  • Мощные инструменты для формирования запросов и результатов
    • Конструктор запросов и результатов - позволяет видоизменять данные(поиск и замена, выделение домена из ссылки, преобразования по регулярным выражениям...)
    • Подстановки для запросов: из файла; перебор слов, символов и цифр
    • Фильтрация результатов - по вхождению подстроки, равенству, больше\меньше
    • Уникализация результатов - по строке, по домену, по главному домену(A-Parser знает все домены верхнего уровня, в т.ч. такие как co.uk, msk.ru)
    • Мощный шаблонизатор результатов на основе Template Toolkit - позволяет выводить результаты в любом удобном виде(текстом, csv, html, xml, произвольный формат)
  • Гибкость настроек
    • В парсере используется система пресетов - для каждого парсера можно создать множество предустановленных настроек для различных ситуаций
    • Настроить можно все - никаких рамок и ограничений
    • Экспорт и импорт настроек позволяет легко обмениваться опытом с другими пользователями
  • Сетевые возможности
    • Поддержка HTTP/1.1 и HTTPS
    • Поддержка HTTP и SOCKS5 прокси, в т.ч. с авторизацией
    • Полностью асинхронная работа с сетью, в т.ч. с DNS
  • API
    • Возможность интегрировать и управлять парсером из своих программ и скриптов
    • Полная автоматизация бизнес-процессов
    • Клиенты для PHP, Perl и Python
  • Постоянные улучшения и исправления
    • Разработка парсера началась в 2011 году, а первый релиз вышел зимой 2012 года
    • С тех пор было выпущено более 70 новых версий, включающих множество улучшений и исправлений
    • A-Parser не останавливается в развитии, идет активная разработка, будет реализовано множество новых функций, в т.ч. по запросам от пользователей
  • Техническая поддержка
    • Мы прилагаем все усилия по поддержке пользователей и ответам на все возникающие вопросы
    • Создана подробная документация по A-Parser'у, открыт форум для пользователей
    • Специалист технической поддержки готов ответить любым удобным способом: ICQ, Skype, Jabber, GoogleTalk, e-mail и через форму онлайн связи на сайте
    • Разработчик A-Parser'а готов ответить на любые сложные и технические вопросы, также открыт к обсуждению улучшений и дополнений для парсера

Более подробно ознакомится с возможностями парсера можно в полноценной документации

A-Parser предоставляется в трех версиях, сравнительная таблица и стоимость лицензий:



Мы принимаем к оплате в автоматическом режиме все популярные платежные системы, такие как Bitcoin, WebMoney, PayPal, Visa, MasterCard, Paxum, Яндекс.Деньги, QIWI, PerfectMoney, банковские переводы, терминалы оплаты и многое другое.
Для приобретения лицензии необходимо зарегистрироваться на сайте https://a-parser.com и перейти на страницу оплаты.
Если у вас возникли вопросы - обращайтесь по любым контактам в техническую поддержку
 
В этом видео вы узнаете как собрать тысячи и миллионы профилей в социальной сети ВКонтакте:




В уроке рассмотрены:
  • Создание парсера профилей соцсети ВКонтакте: имя, город, телефон, семейной положение, время последнего захода и ссылку на аватар(фотографию)
  • Использование регулярных выражений для фильтрации данных результата
  • Использование конструктора результатов для модификации результатов
  • Использование Cookies в запросах

Подписывайтесь на наш канал, ставьте лайки и оставляйте в комментариях пожелания для следующих уроков!
 
1.1.743 - исправлен парсер Яндекса, множество исправлений в JavaScript парсерах

1.1.743 - исправлен парсер Яндекса, множество исправлений в JavaScript парсерах

6TCRx.png


В версии 1.1.743 выпущено множество исправлений для JavaScript парсеров, а также добавлены новые примеры: определение языка страницы через Яндекс переводчик и сбор текстовки по ключевому слову одним заданием(на выбор через Google или Яндекс)

Улучшения
  • В JavaScript парсерах добавлена возможность создавать новые запросы(this.query.add)
  • В парсере
    se-yahoo.png
    SE::Yahoo теперь определяется бан прокси по IP
  • Добавлен параметр, позволяющий A-Parser'у работать с файлами запросов и результатов вне рабочего каталога
Исправления в связи с изменениями в выдаче
  • se-yandex.png
    SE::Yandex - парсил только первую страницу выдачи
  • se-google-trends.png
    SE::Google::Trends - использовал все попытки если по ключевому слову не было данных
Исправления
  • Исправлена работа опции Max threads per proxy(максимальное число потоков на одну прокси)
  • В парсере
    html-linkextractor.png
    HTML::LinkExtractor исправлен парсинг ссылок с фрагментом(#)
Исправления в JavaScript парсерах
  • Настройки checkbox воспринимались некорректно
  • Исправлена ошибка в работе this.cookies.setAll
  • В интерфейсе не отображались измененные параметры конфига
  • Исправлены утечки памяти
  • Исправлено игнорирование параметра success
  • Исправлено поведение при использовании Override настроек
  • Исправлена ошибка при получении результатов из другого парсера
 
1.1.764 - шаблонизатор в полях конфига, выбор языка в SE::Bing

6TCRx.png


Улучшения

  • В парсер
    se-bing.png
    SE::Bing добавлена возможность выбора языка результатов поиска
  • Во всех полях конфигурации каждого парсера теперь есть возможность использовать шаблонизатор, тем самым позволяя использовать запрос или его часть как значение конфига, а также добавлять произвольную логику(пример - использование переменного DNS сервера)
  • В JavaScript парсерах добавлена возможность установки одиночного cookie(this.cookies.set)
  • В парсере
    se-yandex-wordstat.png
    SE::Yandex::WordStat SE::Yandex::WordStat уменьшено потребление каптчи

Исправления в связи с изменениями в выдачи
  • se-google.png
    SE::Google - исправлена работа с антигейтом
  • В парсере
    se-google.png
    SE::Google исправлен парсинг объявлений, а также пропуск первого результата поиска в редких случаях
  • В парсере
    se-yandex.png
    SE::Yandex исправлен сбор сниппетов
  • se-aol.png
    SE::AOL,
    se-bing-images.png
    SE::Bing::Images

Исправления

  • Исправлена утечка памяти при использовании логов в задании
  • В парсере
    se-ask.png
    SE::Ask не определялся бан прокси
  • Исправлена работа опции allow_outside_files
  • Исправлена работа с utf8 в исходниках tools.js и JavaScript парсерах
  • В редких случаях при неудачном парсинге 2ой или последующих страниц запрос мог считаться успешным
 
1.1.790 - экспорт множества заданий и JavaScript парсеров

1.1.790 - экспорт множества заданий и JavaScript парсеров

mvl55.png



A-Parser 1.1.790 появился новый экспорт, который позволяет экспортировать сразу несколько заданий, настройки парсеров, JavaScript парсеры, а также tools.js:


5kn8d.png



Улучшения

  • Новый экспорт заданий
  • В JavaScript парсерах добавлена возможность указать иконку парсера
  • В JavaScript парсерах добавлен функционал для работы с CAPTCHA
  • Добавлено автоматическое версионирование JavaScript парсеров
  • В хедерах ответа теперь указан заголовок Proxy с которым был сделан запрос
  • В JavaScript парсерах добавлен параметр attempt для this.request, позволяющий вручную управлять механизмом попыток
  • В JavaScript парсерах добавлен функционал управления прокси
  • В парсере
    check-backlink.png
    Check::BackLink улучшена обработка nofollow

Исправления в связи с изменениями в выдачи

  • se-duckduckgo.png
    SE::DuckDuckGo,
    se-ask.png
    SE::Ask,
    se-aol.png
    SE::AOL,
    rank-majesticseo.png
    Rank::MajesticSEO
  • se-bing.png
    SE::Bing не парсил при указании региона
  • Парсер
    se-yandex-wordstat.png
    SE::Yandex::WordStat мог пропускать запросы при использовании антикаптчи

Исправления

  • В парсере
    se-qip.png
    SE::QIP для некоторых запросов не корректно определялась кодировка сниппетов
  • A-Parser зависал при использовании JavaScript парсеров совместно с конструктором результатов
  • В парсере
    se-bing.png
    SE::Bing в серп могли попадать рекламные блоки
  • В парсере
    net-whois.png
    Net::Whois собиралась дата для некоторых доменов
  • В JavaScript парсерах исправлен вывод ошибок в коде
  • В JavaScript парсерах исправлен подсчет HTTP запросов для статистики
 
1.1.811 - 6 новых парсеров, улучшения в JavaScript парсерах

1.1.811 - 6 новых парсеров, улучшения в JavaScript парсерах

4m5m5.png


В A-Parser 1.1.811 добавлено 6 новых встроенных парсеров - Амазон, Яндекс.Маркет, Рамблер, IxQuick, добавление ссылки в индекс Bing, расширенный парсер Moz(OpenSiteExplorer). Добавляйте идеи для новых парсеров на нашем форуме и мы их обязательно реализуем.

Помимо встроенных парсеров вы можете создавать свои собственные парсеры на языке JavaScript - используя всю мощь многопоточности A-Parser'а, а также производительность движка V8 и преимущества ES6.

Для владельцев CapMonster и XEvil - напоминаем что A-Parser можно подключить к этим программам из коробки, тем самым колоссально повысив скорость парсинга во многих парсерах

Улучшения
  • Новый парсер
    shop-amazon.png
    Shop::Amazon - парсит выдачу https://www.amazon.com по ключевому слову, собирает название, ссылку, картинку, прайс, прайс до скидки, рейтинг, число комментариев, продавца и дополнительную информацию
  • Новый парсер
    shop-yandex-market.png
    Shop::Yandex::Market - парсер Яндекс.Маркета, по указанному ключевому слову(или по прямой ссылке на категорию) собирает следующие данные: название товара, ссылку, ссылку на картинку, рейтинг, число комментариев, цену от и до, число предложений от магазинов и список дополнительных характеристик
  • Новый парсер
    se-rambler.png
    SE::Rambler - сегодня рамблер использует одновременно выдачу Google и Яндекса, в зависимости от геолокации пользователя(прокси), есть поддержка антигейта
  • Новый парсер
    se-ixquick.png
    SE::IxQuick - https://www.ixquick.com - еще один поисковик, основанный на выдаче Google
  • Добавление ссылок в индекс Бинга -
    se-bing-addurl.png
    SE::Bing::AddURL - добавляет ваши ссылки в промышленных масштабах, требуется антигейт
  • Новый парсер
    rank-opensiteexplorer-extended.png
    Rank::OpenSiteExplorer::Extended - расширенная версия парсера
    rank-opensiteexplorer.png
    Rank::OpenSiteExplorer, собирает с https://moz.com 39 параметров по домену, сабдомену и странице
  • JavaScript парсеры: новые методы this.util.urlFromHTML(url, [base]) и this.util.updateResultsData(results, data)
  • В парсере
    se-yandex.png
    SE::Yandex добавлен сбор времени последнего кэширования страницы

Исправления в связи с изменениями в выдаче
  • se-yandex.png
    SE::Yandex - исправлен парсинг выдачи, сбор ссылки на кэш страницы, а также парсинг рекламных объявлений
  • se-google.png
    SE::Google - исправлен парсинг рекламных объявлений, а также проблема с парсингом в редких случаях при использовании антигейта
  • В парсере
    net-whois.png
    Net::Whois исправлен парсинг дат, а также улучшен парсинг whois сервера GoDaddy
  • se-google-trends.png
    SE::Google::Trends - полностью обновлен парсер и список собираемых значений
  • rank-linkpad.png
    Rank::LinkPad,
    rank-majesticseo.png
    Rank::MajesticSEO,
    se-seznam.png
    SE::Seznam

Исправления
  • Проблема с прокруткой в Планировщике
  • Проблема с кодировкой в tools.parseJSON
  • Ошибка импорта JavaScript парсеров
 
1.1.853 - новые парсеры и каталог пресетов

zldhe.png


У нас появился каталог парсеров и пресетов, на данный момент он находится в процессе наполнения. Каталог полностью интегрирован с A-Parser, позволяет в один клик установить необходимый пресет и сразу его использовать. Загрузка в каталог доступна для всех пользователей A-Parser, попробуйте, это просто и удобно :)

Улучшения
  • Новый парсер
    html-emailextractor.png
    HTML::EmailExtractor - собирает адреса электронной почты с указанных страниц, поддерживает обход сайтов в глубину(парсинг соседних страниц или всего сайта)
  • Новый парсер
    rank-social-signal.png
    Rank::Social::Signal - проверяет количество социальных сигналов для указанной ссылки, возвращает число лайков, репостов и комментариев для Facebook, число лайков в Google+ и Pinterest, количество репостов Вконтакте и LinkedIn
  • Добавлена возможность устанавливать приоритет заданиям, подробное обсуждение
  • Оптимизирована работа при большом числе активных заданий
  • Оптимизирована версия A-Parser для ОС Linux x64
  • Для парсера
    se-qip.png
    SE::QIP добавлена опция Not found is error, призванная устранять ошибки поисковика, когда он случайным образом отдает пустые результаты
  • В парсере
    se-google-trends.png
    SE::Google::Trends добавлен сбор данных по категориям "В тренде" и "Лидеры"
Исправления в связи с изменениями в выдаче
  • se-duckduckgo.png
    SE::DuckDuckGo,
    se-ixquick.png
    SE::IxQuick,
    se-bing-addurl.png
    SE::Bing::AddURL
Исправления
  • В парсере
    se-google.png
    SE::Google исправлена работа с каптчей при использовании языка интерфейса гугла отличного от английского
  • В парсере
    rank-similarweb.png
    Rank::SimilarWeb исправлена обработка доменов которые не существуют в статистике SimilarWeb
  • Исправлен парсинг выдачи в
    se-bing.png
    SE::Bing если выбран язык отличный от английского
  • Исправлена загрузка пресетов которые содержат удаленные(устаревшие) парсеры
 
1.1.873 - парсинг Google со скоростью 10000+ запросов в минуту

1.1.873 - парсинг Google со скоростью 10000+ запросов в минуту

В версии A-Parser 1.1.873 добавлен новый парсер
se-google-fast.png
SE::Google::Fast позволяющий парсить Google со скоростью 10к+ запросов в минуту без использования антикаптчи

r5ege.png


Улучшения
  • Новый парсер
    se-google-fast.png
    SE::Google::Fast - быстрый парсер выдачи гугла, способен развить скорость более 10000 запросов в минуту без использования антикаптчи
  • Новый парсер
    se-google-byimage.png
    SE::Google::ByImage - парсер картинок из Google по ссылке на картинку
  • В парсере
    rank-similarweb.png
    Rank::SimilarWeb добавлена поддержка антикаптчи
  • В парсере
    rank-linkpad.png
    Rank::Linkpad добавлены новые параметры для сбора - ранк домена, процент nofollow и безанкорных ссылок, число доноров по IP и подсетям, а также стоимость размещения ссылок
  • JavaScript парсеры: добавлен параметр browser для this.request, позволяющий автоматически эмулировать заголовки браузера
  • В инструменты tools добавлена возможность кодировать и декодировать base64
  • Теперь в tools.data содержится большое количество предустановленной информации - языки, регионы, домены для поисковых систем Google и Яндекс
Исправления в связи с изменениями в выдаче
  • rank-similarweb.png
    Rank::SimilarWeb,
    se-google-images.png
    SE::Google::Images,
    rank-majesticseo.png
    Rank::MajesticSEO
Исправления
  • Исправлена уязвимость позволяющая читать файлы на сервере при известном пароле
  • Исправлена ошибка в тестировщике заданий - могли обрабатываться не все запросы
  • При использовании tools.query.add задание могло зависнуть в очереди, ошибка появилась в предыдущем релизе
  • Исправлена работа tools.js на ОС Linux
  • Исправлена утечка памяти при использовании JavaScript парсеров
  • Исправлена работа опции Динамический лимит потоков
 
Новый каталог парсеров и пресетов

Представляем наш новый каталог парсеров и пресетов - это бесплатные дополнения и примеры для всех пользователей A-Parser Pro и A-Parser Enterprise. Каталог полностью интегрирован с парсером, установка из каталога происходит в один клик



Подавляющее большинство примеров были перенесены из старого каталога, часть из них была обновлена. Небольшое кол-во примеров переехали в наш FAQ, т.к. их формат не совсем вписывался в новый каталог. Более того, теперь в каталоге доступны все наши обучающие видео и статьи. Также добавлены примеры JavaScript-парсеров. Каталог разбит на категории, что облегчает поиск нужного примера

На данный момент в каталоге 100 парсеров и пресетов, 9 видео и 2 обзорных статьи, вот некоторые из них:
Любой пользователь может добавить в каталог свой пресет, за что ему будет большая благодарность :) Присылайте свои идеи для новых парсеров, самые интересные и востребованные мы обязательно реализуем!
 
Спасибо, нужно будет попробовать.
 
Сборник рецептов #17: картинки из Flickr, язык ключевых слов, список лайков в ВК

17-й сборник рецептов. В нем мы будем парсить картинки из популярного фотохостинга Flickr; научимся писать JavaScript парсеры и определять язык ключевых слов; разберемся, как получать список пользователей, которые лайкнули пост во Вконтакте. Поехали!

Парсер изображений с Flickr
Flickr - это один из наиболее популярных фотохостингов. Согласно Википедии еще в 2011 году кол-во фото на нем превысило отметку в 6 млрд и продолжает активно расти. Именно поэтому поиск фото на данном хостинге - это актуальная задача, и она легко решается с помощью A-Parser. Подробности по ссылке выше.
pskBZ.png


JS::Yandex::LangDetect::Key - определение языка ключевого слова через Яндекс Переводчик
Как известно, в юбилейном 100-м релизе А-Парсера появился давно ожидаемый функционал: JavaScript парсеры. Благодаря этому возможности парсера значительно выросли, а также теперь можно выполнять задачи еще быстрее и эффективнее.
Бывает, что нужно получить ключевые слова только на каком-то определенном языке, и возникает задача определения этого самого языка для каждого ключа. С этим неплохо справляются различные переводчики. К примеру Яндек.Переводчик. В этом примере будет показано создание JS-парсера для решения данной задачи, подробности, как обычно, по ссылке выше.
ukpgB.png


Получение списка пользователей, которые лайкнули пост в VK
Вконтакте - это одна из самых популярных социальных сетей на територии СНГ. Поэтому парсинг различных данных из нее - это очень востребованные задачи. В нашем каталоге можно найти несколько таких пресетов, а в данном примере будет показан парсинг списка пользователей, которые лайкнули определенный пост. Это может быть полезно, например, при проведении различных акций, когда требуется получить такой список пользователей. Детали по ссылке выше.
uNqFi.png


Кроме этого:
  • JS::TitleFromSE - парсинг тайтлов по ключу одним заданием
  • JS::Yandex::LangDetect - определение языка страницы через Яндекс Переводчик
  • JS::TextFromSE - парсинг текстовки по ключу одним заданием
Еще больше различных рецептов в нашем обновленном Каталоге!

Подписывайтесь на наш канал на Youtube - там регулярно выкладываются видео с примерами использования A-Parser, а также следите за новостями в Twitter.

 
Сборник рецептов #17: картинки из Flickr, язык ключевых слов, список лайков в ВК

17-й сборник рецептов. В нем мы будем парсить картинки из популярного фотохостинга Flickr; научимся писать JavaScript парсеры и определять язык ключевых слов; разберемся, как получать список пользователей, которые лайкнули пост во Вконтакте. Поехали!

Парсер изображений с Flickr
Flickr - это один из наиболее популярных фотохостингов. Согласно Википедии еще в 2011 году кол-во фото на нем превысило отметку в 6 млрд и продолжает активно расти. Именно поэтому поиск фото на данном хостинге - это актуальная задача, и она легко решается с помощью A-Parser. Подробности по ссылке выше.
pskBZ.png


JS::Yandex::LangDetect::Key - определение языка ключевого слова через Яндекс Переводчик
Как известно, в юбилейном 100-м релизе А-Парсера появился давно ожидаемый функционал: JavaScript парсеры. Благодаря этому возможности парсера значительно выросли, а также теперь можно выполнять задачи еще быстрее и эффективнее.
Бывает, что нужно получить ключевые слова только на каком-то определенном языке, и возникает задача определения этого самого языка для каждого ключа. С этим неплохо справляются различные переводчики. К примеру Яндек.Переводчик. В этом примере будет показано создание JS-парсера для решения данной задачи, подробности, как обычно, по ссылке выше.
ukpgB.png


Получение списка пользователей, которые лайкнули пост в VK
Вконтакте - это одна из самых популярных социальных сетей на територии СНГ. Поэтому парсинг различных данных из нее - это очень востребованные задачи. В нашем каталоге можно найти несколько таких пресетов, а в данном примере будет показан парсинг списка пользователей, которые лайкнули определенный пост. Это может быть полезно, например, при проведении различных акций, когда требуется получить такой список пользователей. Детали по ссылке выше.
uNqFi.png


Кроме этого:
  • JS::TitleFromSE - парсинг тайтлов по ключу одним заданием
  • JS::Yandex::LangDetect - определение языка страницы через Яндекс Переводчик
  • JS::TextFromSE - парсинг текстовки по ключу одним заданием
Еще больше различных рецептов в нашем обновленном Каталоге!

Подписывайтесь на наш канал на Youtube - там регулярно выкладываются видео с примерами использования A-Parser, а также следите за новостями в Twitter.

 
1.1.888 - парсер РосКомНадзора и переводчики Google и Яндекса

xrwsw.png


Улучшения
  • Новый парсер
    check-roskomnadzor.png
    Check::RosKomNadzor - проверяет наличие домена или ссылки в реестре запрещенных сайтов, для работы необходим антигейт
  • Новый парсер
    se-google-translate.png
    SE::Google::Translate - переводчик текста через сервис Google Translate
  • Новый парсер
    se-yandex-translate.png
    SE::Yandex::Translate - переводчик текста через Яндекс.Переводчик
Исправления в связи с изменениями в выдачи
  • Парсер
    se-disconnectme.png
    SE::DisconnectMe удален в связи с постоянным редиректом на DuckDuckGo, используйте
    se-duckduckgo.png
    SE::DuckDuckGo
  • se-google-images.png
    SE::Google::Images,
    se-google.png
    SE::Google,
    se-yandex-images.png
    SE::Yandex::Images
Исправления
  • В парсере
    net-whois.png
    Net::Whois исправлена работа с доменной зоной .fr
  • se-google.png
    SE::Google - не собирались Related keywords на языках интерфейса отличного от английского
  • Исправлен обход защиты CloudFlare на ОС Linux
  • Исправлено падение при запуске задания с удаленным конфигом потоков
  • Не корректно работало переопределение tools.js в задании, ошибка появилась в предыдущей версии
  • В парсере
    se-google-byimage.png
    SE::Google::ByImage не выводился Raw data
  • В парсер
    rank-similarweb.png
    Rank::SimilarWeb не корректно определялся totalvisits
  • Не работало изменение названия пресета при импорте
 
Больше, лучше, быстрее - расширение команды поддержки

Всем привет, мы расширили команду поддержки пользователей!

200h200-2_bez_ramki.png

Встречайте наших героев:
Также мы увеличили количество каналов для ваших вопросов:
  • Тикет система, онлайн чат и форум поддержки
  • Все популярные мессенджеры: Skype, Telegram, ICQ, Jabber
И самое главное: мы обновили документацию и продолжаем наполнять наш каталог парсеров и пресетов - уже более 140 готовых примеров! Предлагайте свои идеи и мы обязательно их реализуем!
 
1.1.899 - автоматическое распознавание Яндекс каптчи и новый парсер мобильной выдачи Google

В A-Parser 1.1.899 добавлено автоматическое распознавание новой Яндекс каптчи, без использования антигейта:

93eop.png


Как следствие скорость парсинга Яндекса сильно выросла:

nhupu.png


Улучшения:
  • Добавлен парсер
    se-google-mobile.png
    SE::Google::Mobile - парсер мобильной и современной десктоп выдачи(режим переключается в настройках)
  • В парсере
    se-google-translate.png
    SE::Google::Translate названия языков теперь указаны на английском
  • В парсер
    shop-amazon.png
    Shop::Amazon добавлена возможность указать домен амазона
  • Добавлена возможность пропускать сохранение в файл указав в шаблоне пустое название файла
  • Улучшен просмотр HTML кода в дебаг режиме - отключена возможность перезагрузки интерфейса парсера
Исправления в связи с изменениями в выдаче:
  • se-google-fast.png
    SE::Google::Fast,
    shop-amazon.png
    Shop::Amazon
  • se-yandex.png
    SE::Yandex - исправлена обработка каптчи
  • se-yandex.png
    SE::Yandex - исправлен сбор рекламных блоков
  • В парсере
    se-rambler.png
    SE::Rambler исправлена загрузка каптчи
 
Видео урок по созданию парсера на языке JavaScript

Задача: Оценить страницу сайта на предмет тематики, рассчитать плотность ключевых слов на странице сайта и упорядочить результат по убыванию плотности ключевых слов.

https://www.youtube.com/watch?v=1sQcmqEwH8I

Готовый парсер можно взять в нашем каталоге пресетов: Подсчет плотности ключевых слов

Оставляйте комментарии и подписывайтесь на наш канал на YouTube!
 
1.1.918 - улучшена работа с override и отдельные append/preppend text для каждого файла

cb4qp.png


Улучшения
  • Изменена работа с override: устранена возможность их дублирования, а также улучшен выбор и добавление настроек в пресет в один клик
    7ZvI1.png
  • Добавлена возможность для каждого файла результатов задавать индивидуальные Начальный/Конечный текст

Исправления в связи с изменениями в выдачи

  • se-dogpile.png
    SE::Dogpile,
    rank-majesticseo.png
    Rank::MajesticSEO,
    se-google-images.png
    SE::Google::Images,
    se-yandex.png
    SE::Yandex

Исправления
  • Исправлены падения при работе JS парсеров на Windows 10
  • Исправлен баг с "белым экраном", который появился в предыдущей версии
  • Парсер Rank::SimilarWeb удален в связи с требованием правообладателей
  • Исправлен баг, при котором не срабатывал шаблон в Общем формате результата при пустом имени файла результата, появился в версии 1.1.896
  • Исправлена работа с каптчей в
    se-google.png
    SE::Google, при работе через IPv6 прокси
 
Видео урок: Парсинг пользователей ВК, которые лайкнули определенный пост

В этом уроке будет рассмотрен пример получения с помощью А-Парсер списка пользователей социальной сети Вконтакте, которые лайкнули выбранный пост. Такую информацию можно использовать для дальнейшего маркетинга, например, для рассылки сообщений только заинтересованным пользователям или проведения различных акций.



Урок включает в себя:
  • Парсинг социальной сети Вконтакте после авторизации
  • Отправка POST-запросов парсером и разбор результата
  • Использование Cookies в парсинге

Готовый парсер можно взять в нашем каталоге пресетов: Получение списка пользователей, которые лайкнули пост в VK

Оставляйте комментарии и подписывайтесь на наш канал на YouTube!
 
1.1.937 - 2 новых парсера, поддержка reCAPTCHA, возможность перевода интерфейса парсера

cb4qp.png


Улучшения:
  • Добавлено 2 новых парсера:
    • GooglePlay::Apps - парсинг информации о приложениях из Google Play
    • SE::Yandex::Speller - проверка страниц на ошибки в тексте через Яндекс.Спеллер
  • Добавлен функционал перевода интерфейса парсера на другие языки
  • В тестовом режиме добавлена поддержка reCAPTCHA в SE::Google::Mobile, пока поддерживается только сервис anti-captcha.com
  • Улучшен парсинг Google на паблик прокси
  • Уменьшена частота появления каптч, убран лимит страниц и добавлена поддержка антигейта в Shop::Yandex::Market
  • Добавлен выбор базы данных в Rank::SEMrush::Keyword
  • В SE::Yandex:: Direct::Frequency улучшена обработка ошибок
  • Обновлен список языков в SE::Bing::Translator
Исправления в связи с изменениями в выдачи
  • В связи с прекращением поддержки со стороны Google, удален SE::Google::Fast
  • SE:: Dogpile, Rank::MajesticSEO, SE:: DuckDuckGo, Shop::Amazon
Исправления
  • Исправлен сбор картинок в HTML::EmailExtractor
  • Исправлена работа Shop::Yandex::Market в некоторых случаях
  • Исправлена работа с каптчей в SE::Yandex:: Direct::Frequency в редких случаях
  • Исправлен парсинг данных о доменах .biz в Net::Whois
  • Исправлена работа с экзотическими кодировками в Net::HTTP
  • Исправлена работа с прокси в SE::Yandex
  • Исправлена работа с кодировками в JS-парсерах
 
Назад
Сверху