Спарсить ссылки с текстом

Тема в разделе "Парсинг конкретных сайтов по запросу (ПЛАТНО)", создана пользователем monarh, 23 янв 2013.

  1. monarh

    monarh New Member Пользователи

    Регистрация:
    26 дек 2012
    Сообщения:
    3
    Подскажите пожалуйста как парсить статьи с сайта, у которого не цифровое значение в конце ссылки.
    Пример подобного сайта:

    narmed.ru/articles/meditati/

    и тут перечень статей…

    вот к примеру прямые ссылки:

    narmed.ru/articles/meditati/chto_takoe_svoboda
    narmed.ru/articles/meditati/filosofiya_snovidenij

    и т.д.

    Как это выкачать?

    У меня идет процесс осваивания Content Downloader ...... :)
     
  2. kagorec

    kagorec Администратор Команда форума Администратор

    Регистрация:
    3 янв 2011
    Сообщения:
    4.442
    Адрес:
    Latvia
    Хорошо тогда в картинках.
    Если вы смотрели и читали в системе помощи как собирать ссылки то могли видеть несколько вариантов.
    В вашем случае наверно сканером лучше, кнопка с синей стрелкой

    [​IMG]

    А что бы собирало только нужное, в фильтре ссылок укажите нужный адрес именно ту часть которая всегда есть. вот зарисовка может понятнее так

    [​IMG]

    п.с. сканеру указана пауза 534мс чтоб сайт не забанил вас.
     
    Последнее редактирование: 23 янв 2013
  3. monarh

    monarh New Member Пользователи

    Регистрация:
    26 дек 2012
    Сообщения:
    3
    Огромное вам kagorec, спасибо за такой развернутый ответ с примером!

    Буду теперь пробовать...
     

Поделиться этой страницей