Парсинг пользователей с форума

  • Автор темы Автор темы Hannes
  • Дата начала Дата начала

Hannes

Client
Регистрация
03.02.2016
Сообщения
560
Реакции
286
Баллы
63
Добрый день!
Есть 2 вопроса по парсингу пользователей. Есть страница с списком пользователей, на странице 100 штук.

В коде выглядит так 1 пользователь:

HTML:
Развернуть Свернуть Копировать
<td class="http://nnnnnnnn.ru/forum/members/961485-LoginUser-/">LoginUser</a>
<div class="http://nnnnnnnn.ru/forum/search.php?do=finduser&amp;u=961485" rel="http://nnnnnnnnnn.ru/forum/images/buttons/uBB/find.gif" alt="find.gif" title="Найти все сообщения от LoginUser" border="0"/></a></td>
<td class="alt2">27.11.2015</td>
<td class="alt1">95</td>
<td class="alt2">03.01.2016</td>

Нужно спарсить все данные всех пользователей и перенести их в таблицу.

Видел на форуме, что советуют сначала парсить весь массив данных, потом разбивать их и добавлять в таблицу. Или есть способ удобнее?

Второй вопрос по регулярки:
Например, есть участок в url который рандомно меняется. Что бы выцепить нужный элемент, нужно зацепить и значение, которое меняется. Что нужно подставить на место этого значения?

HTML:
Развернуть Свернуть Копировать
<td class="http://nnnnnnnn.ru/forum/RANDOM/12345/6789">
Какую регулярку можно подставить в RANDOM, что бы создать регулярное выражение?
 
Последнее редактирование:
Можно парсить по столбцам, а потом заносить в цикле их в таблицу. Можно парсить в цикле по строкам в переменные и собирать из них строку, которую добавляем в таблицу.

Столбцы - это набор данных спарсенных при помощи одного регулярного выражения. Строки - это парсинг в переменные несколькими регулярками.

По поводу random не понял, что тебе нужно. Если значение самого random получить, то:

3722228e30266d570e62b09bdd1ccd6e.png
 
  • Оценить
Реакции: Hannes
Спасибо, Zennomoves, за отклик!
Например, нужно спарсить ссылки товара из определенного раздела. Допустим, они имеют вид http://nnnnnnnn.ru/категория/случайное значение/подкотегория/товар
Случайное значение - набор из цифр и букв, зачастую разной длины. Нужно спарсить все ссылки такого типа.
Есть ли какая-то регулярка, которая позволит софту "пропускать" это случайное значение и парсить все подобные ссылки?
Надеюсь, так понятнее.
 
Спасибо, Zennomoves, за отклик!
Например, нужно спарсить ссылки товара из определенного раздела. Допустим, они имеют вид http://nnnnnnnn.ru/категория/случайное значение/подкотегория/товар
Случайное значение - набор из цифр и букв, зачастую разной длины. Нужно спарсить все ссылки такого типа.
Есть ли какая-то регулярка, которая позволит софту "пропускать" это случайное значение и парсить все подобные ссылки?
Надеюсь, так понятнее.

Для твоего случая (обрати внимание на подчёркнутое - я к тому, что там промежуточные значения участия не принимают):

3303a6998434a238a39c961bcbafb888.png
 
  • Оценить
Реакции: Hannes
Похоже, я просто стремлюсь себе усложнить жизнь. :)
Спасибо!)
 
Помогли и объяснили в личке по парсингу.
Вопрос более не актуален.
Всем спасибо! :)
 

Кто просматривает тему: (Всего: 0, Пользователи: 0, Гости: 0)