Очистка от html кода

  • Автор темы Автор темы yura005
  • Дата начала Дата начала

yura005

Client
Регистрация
19.02.2016
Сообщения
60
Реакции
0
Баллы
6
Добрый день!

Создал регулярное выражение:
(?<=<div\ class="related__item">).*(?=</a></div>)
Но оно берет и html теги
Подскажите можно ли как-то убрать все html теги (оставить только русские, английские буквы и цифры)

Спасибо
 
Добрый день!

Создал регулярное выражение:
(?<=<div\ class="related__item">).*(?=</a></div>)
Но оно берет и html теги
Подскажите можно ли как-то убрать все html теги (оставить только русские, английские буквы и цифры)

Спасибо
у меня есть вот такая коллекция регулярок для этого:

Код:
Развернуть Свернуть Копировать
<.*?>

или

<[^>]*>

или

<[^>]+>

находит все html-теги, включая урлы и метатеги..

или

<(?!p|/p|br|img).*?>

находит все теги, кроме <p></p><br><img ...>
 
  • Оценить
Реакции: termit и Hannes
А как к моему выражению это прикрутить?
 
замени лишнее на что то а потом спарсь как надо
 
Не понял, как узнать что лишнее?
 
Нет думаю это не правильно, а можно ли как-то вывести только русский буквы
 
[^А-Яа-я] ну это спарсит только русские буквы
 

Кто просматривает тему: (Всего: 0, Пользователи: 0, Гости: 0)