Пожалуйста, используйте этот идентификатор, чтобы цитировать или ссылаться на этот ресурс: http://elar.urfu.ru/handle/10995/1414
Полная запись метаданных
Поле DCЗначениеЯзык
dc.contributor.authorАгеев, М. С.ru
dc.contributor.authorВершинников, И. В.ru
dc.contributor.authorДобров, Б. В.ru
dc.date.accessioned2008-11-21T04:53:31Z-
dc.date.available2008-11-21T04:53:31Z-
dc.date.issued2005-
dc.identifier.citationАгеев М.С. Извлечение значимой информации из web-страниц для задач информационного поиска / М. С. Агеев, И. В. Вершинников, Б. В. Добров // Интернет-математика 2005. Автоматическая обработка веб-данных. - М., 2005. - С. 283-301.ru
dc.identifier.urihttp://elar.urfu.ru/handle/10995/1414-
dc.description.abstractВ статье описываются разработанные нами методы разделения web-страниц на содержательную и навигационную части. Данные методы основаны на выделении одинаковых частей страниц с одного сайта. Основной целью данной работы является повышение качества информационного поиска за счет удаления навигационной части из web-страниц. Мы покажем, что разработанный алгоритм позволяет эффективно разделять страницы на содержательную и навигационную части. С другой стороны, проведенный нами эксперимент по анализу эффективности информационного поиска в web на основе коллекции РОМИП-WEB-narod.ru с использованием разработанного алгоритма не привел к улучшению средней оценки точности поиска. В статье описан детальный анализ результатов информационного поиска с использованием описанного алгоритма.ru
dc.description.abstractWe describe a new algorithm for automatic partition of web page onto navigational and main parts. The algorithm is based on extraction of common parts in web-pages from one web-site. Our basic supposition is that we can improve quality of information retrieval system by purging navigational part of web-pages. We show that our method successfully extract navigational and main parts from web-pages. On the other hand, cutting of navigational part do not improve quality of web information retrieval.ru
dc.format.extent842144 bytesen
dc.format.mimetypeapplication/pdfen
dc.language.isoruen
dc.publisherб. и.ru
dc.relation.ispartofИнтернет-математика 2005: автоматическая обработка веб-данных. — М., 2005ru
dc.titleИзвлечение значимой информации из web-страниц для задач информационного поискаru
dc.title.alternativeAutomatic Extraction of Significant Part of Web Pages for Informational Retrievalen
dc.typeArticleen
dc.typeinfo:eu-repo/semantics/articleen
dc.typeinfo:eu-repo/semantics/publishedVersionen
Располагается в коллекциях:Информационный поиск

Файлы этого ресурса:
Файл Описание РазмерФормат 
IMAT_2005_15.pdf822,41 kBAdobe PDFПросмотреть/Открыть


Все ресурсы в архиве электронных ресурсов защищены авторским правом, все права сохранены.