Re: Log files
- From
- Roman Vasin ()
- To
- All
- Date
- 2000-03-03T21:11:28Z
- Area
- RU.ALGORITHMS
From: "Roman Vasin" <vasin@kaluga.ru>
> RV> Кстати, решение с помощью деревьев решает проблему скорости, но, как
я
> RV> понял не решает проблему с памятью, т.е. если лог на ~10Гб, то и
> RV> деревьев, создастся на тот же порядок, это неподходит.
> Не совсем. Дерево создастся на такой объем, сколько там
> адресов. ie если в логе фигурирует ровно пять адресов,
> будет создано дерево из одной 4k странички. :-)
Понятно, обычно на один IP адрес повторяется 10-40 раз, т.е. с 10Гб,
получается минимум 100Мб на линейный список, на дерево наверное немного
побольше. Ведь при выполнении анализа, формируется не один отчет (по ip), а
штук 20.
> Кроме того, никто не мешает держать в памяти только
> текущую страничку. Потом можно будет написать небольшой
> кэш, который будет жрать _ровно_ столько памяти, сколько
> надо. Или на используемое место тоже есть ограничение?
Подробнее пожалуйста... Ограничений на память особых нет. Врочем анализатор
должен работать также и как cgi приложение т.е. на стороне сервера. Но это
уже не много не к месту,обычно стратегия такая - сколько памяти нужно,
столько и поставят.
В любом случае, вопрос здесь стоит в выборе более оптимального алгоритма
поиска, который был бы несколько эффективнее чем составление простого
списка.
Кстати, как обычно обрабатываются SQL запросы? Там кажется тоже используются
Б-деревья?.
--
Роман Васин, Калуга, vasin@kaluga.ru
Home: http://www.geocities.com/CapeCanaveral/2971/
--- ifmail v.2.15dev4
* Origin: Demos online service (2:5020/400)