поиск по множеству слов

  • Автор темы Автор темы APXOHT
  • Дата начала Дата начала

APXOHT

Client
Регистрация
27.12.2013
Сообщения
896
Реакции
195
Баллы
43
Подскажите пож-та.
Есть куча статей (парсинг копипастный). Хочу делать к ним теги - метки.
Есть список ключевых слов которые станут метками-тегами. В списке ~ 10 000 слов.
Как наименее ресурсозатратно сделать поиск совпадений слов из файла с теми словами что будут в статьях? Если искать рандомом то хватит 3-5 совпадений... Но сам рандом наверное добавит нагрузку...
Винт SSD
:bw:
 
загони в базу mysql и делай поиск совпадений.
если использовать индексы в mysql будет минимум раз в 100 быстрее, чем через поиск по всей таблице или чтение всего файла.

при твоих обьемах никакой нагрузки ниче не создаст. можешь и по файлу искать совпадения.
 
  • Оценить
Реакции: APXOHT

Кто просматривает тему: (Всего: 0, Пользователи: 0, Гости: 0)