Автоматизированная библиотечная система ИРБИС в ГПНТБ России
Данная работа ориентирована на те библиотеки, в которых уже существует или планируется к внедрению электронный каталог и развита информационная структура обслуживания читателей. При внедрении информационных технологий в настоящее время Россия ориентируется на Запад.
В качестве дополнительного сервиса во многих библиотеках Запада предлагается полнотекстовый поиск по специализированным базам данных. Как правило, это статьи из научных журналов, аннотации и авторефераты научных работ [38-40,92].Современная библиотека включает в себя информацию на традиционных печатных носителях, электронную информацию в широком смысле слова - это аудио видео информация, Интернет-ссылки и так далее. Сегодня необходимо развивать новые технологии извлечения и анализа текстов, использовать электронные ресурсы, которые накапливаются в библиотеке как следствие процессов обработки при обслуживании читателей, например, сканирование при электронной доставке документов, а также создание электронных фондов ретроспективных документов.
В данной работе разработана методика создания полнотекстовых баз данных на основе текстов электронных фондов библиотеки с возможностью смыслового поиска на базе системы автоматизации библиотек ИРБИС [14].
Система автоматизации библиотек ИРБИС представляет собой типовое интегрированное решение в области автоматизации библиотечных
технологий и предназначена для распространения и использования в условиях библиотек любого типа и профиля. Первая версия системы разработана в ГПНТБ России в 1995 г. За прошедшие годы она претерпела существенные изменения, пройдя путь от скромной системы с ограниченными возможностями, функционирующей в среде MS DOS, до подлинно интегрированной системы, работающей в Windows и отвечающей всем требованиям, которые предъявляются к современным библиотечным системам.
Можно считать, что ИРБИС является обобщением, типизацией многолетнего опыта ГПНТБ в области автоматизации.
С другой стороны, ИРБИС является той моделью, на основе которой в силу открытости системы реализуются новые идеи и концепции.Система ориентирована на работу в локальных вычислительных сетях любого типа без ограничения количества пользователей при условии, что клиентской платформой является MS DOS или Windows и обеспечивается доступ к файл-серверу.
В системе имеются средства поддержки телекоммуникационных технологий, ориентированных на конечного пользователя (читателя), а именно: Web-ИРБИС - решение, обеспечивающее доступ к базам данных ИРБИС через WWW-сервер, и сервер баз данных для протокола Z39.50.
Система полностью совместима с международными форматами UNIMARC и USMARC на основе средств двухсторонней конверсии данных. Система также поддерживает Российский коммуникативный формат RUSMARC.
В системе реализованы все типовые библиотечные технологии, включая технологии комплектования, систематизации, каталогизации, читательского поиска, книговыдачи и администрирования, на основе взаимосвязанного функционирования пяти типов автоматизированных
рабочих мест (АРМ): “Комплектатор”, “Каталогизатор”, “Читатель”,
“Книговыдача”, “Администратор”.
Система позволяет создавать и поддерживать любое количество баз данных, составляющих электронный каталог (ЭК) или представляющих собой проблемно-ориентированные библиографические базы данных (БД).
Система предлагает технологию автоматического формирования словарей, на основе которых реализуется быстрый поиск по любым элементам описания и их сочетаниям.
Средства каталогизации позволяют обрабатывать и описывать любые виды изданий, включая нетрадиционные, такие как аудио- и видеоматериалы, компьютерные файлы и программы, картографические материалы, ноты и т.д.
Система поддерживает традиционные “бумажные” технологии, предоставляя возможности для получения широкого спектра выходных форм: начиная с листов заказа и книги суммарного учета и кончая указателями и всеми видами каталожных карточек.
Система включает технологии, ориентированные на использование штрих-кодов на экземплярах изданий и читательских билетах.
Система предлагает большой набор сервисных средств, обеспечивающих удобство и наглядность пользовательских интерфейсов, упрощающих процесс ввода, исключающих ошибки и дублирование информации.
Система обладает широкими возможностей для адаптации ее к условиям работы конкретной библиотеки, т.е. при передаче и установке системы может производиться ее настройка в соответствии со специфическими требованиями пользователя - начиная со структуры библиографического описания и кончая пользовательскими режимами работы.
Система является в достаточной мере открытой, что позволяет пользователю самостоятельно вносить изменения в широких пределах: от изменения входных и выходных форм до разработки оригинальных приложений.
В настоящее время ИРБИС является одной из наиболее динамично развивающихся и пользующихся спросом библиотечных систем в России. Наряду с поддержкой традиционных технологий система ИРБИС использует современные информационные средства для развития инфраструктуры библиотечного обслуживания. Данная работа позволит библиотекам - пользователям ИРБИС предоставить читателям возможность смыслового, интеллектуального анализа найденных текстов в полнотекстовых базах данных библиотеки.
До выполнения настоящей работы система автоматизации библиотек ИРБИС (ИРБИС32) использовала структуру хранения данных пакета прикладных программ CDS∖ISIS, которая специально ориентирована на хранение и поиск больших объемов текстовой информации. Особенности ИРБИС32 в сравнении с реляционными СУБД это - переменная длина полей, малая связность записей и текстовый формат данных. Наряду с очевидными достоинствами для своего времени, ИРБИС32 не удовлетворяет современным требованиям и имеет существенные ограничения. Такими ограничениями являются - физические размеры файлов баз данных, максимальная длина поискового термина, размер ссылки на поисковый термин и ограничение на число записей. В основном, это следствие международных стандартов хранения и обмена библиографической информации UNIMARC.
Наряду с очевидными достоинствами для своего времени, в настоящий момент стандарт ИРБИС32 требует дальнейшего развития с целью снять ограничения, оставшиеся от наследия операционных систем прошлого (DOS). Такими ограничениями являются - физическиеразмеры файлов баз данных, максимальная длина поискового термина, размер ссылки на поисковый термин и ограничение на число записей.
В 2001 году начата работа по созданию следующего - четвертого поколения системы - ИРБИС 64 [125].
Можно выделить две основные предпосылки, определившие необходимость этой работы:
• Снятие количественных ограничений в физической структуре БД, касающихся объема БД, длины записи, длины термина и др. Здесь следует заметить, что существующие ограничения, кроме длины термина, носят для большинства пользователей системы ИРБИС пока чисто теоретический характер.
• Перевод системы на клиент-серверную архитектуру. Здесь также следует отметить, что к такому переходу нас побудили не реальные недостатки и трудности, связанные с нынешней файл-серверной архитектурой системы, а следование общим положениям о преимуществах клиент- серверной технологии.
Ограничения ИРБИС32 на физический размер файлов словаря не позволяют создать достаточно большие базы данных. Далее будет показано, каким образом размер накопленной информации влияет на качество смыслового поиска, здесь же достаточно сказать, что этот факт связан со стандартной статистической ошибкой наблюдения случайных событий (корень квадратный из числа наблюдаемых событий). Еще одним существенным ограничением ИРБИС32 является размер ссылки на запись в файле словаря - 2 байта. Ссылка на запись - это единица хранения информации, которая может быть найдена по заданному термину. Такая ссылка включает в себя номер записи в базе данных, номер поля, из которого извлечен данный термин номер, повторения данного поля и номер термина среди других терминов в данном поле. Дополнительная информация, такая как номер предложения, номер абзаца и фрагмента слова
оказывается утерянной. Это увеличивает время, требуемое для сопоставления различных текстов при применении алгоритмов смыслового анализа.
В рамках развития системы ИРБИС был разработан новый стандарт хранения данных и полнофункциональная библиотека доступа - ИРБИС64 [125].
Параметры ИРБИС32 и ИРБИС64 для сравнения:
1. Ограничение на число документов: 16млн....... 8тлн. записей.
2. Ограничение на размер БД: 500 Mb------- 2 млрд.ОЬ.
3. Ограничение на размер записи: 32Kb........ 2Gb.
4. Ограничение на размер поискового термина: 30------- 255 символов.
Снятие ограничений ИРБИС32 позволяет создать в среде ИРБИС полнотекстовые базы данных, организовать смысловой поиск и анализ найденных документов.
4.2.
Еще по теме Автоматизированная библиотечная система ИРБИС в ГПНТБ России:
- 14.3. Права граждан и иных субъектов в области библиотечного дела. Право граждан на библиотечное обслуживание.
- Глава 4. Перспективы развития ИРБИС в плане применения системы смыслового анализа текстов для создания полнотекстовых баз данных в современной библиотеке
- Последовательность операций при создании и ведении базы данных ИРБИС при использовании системы смыслового анализа текстов
- Формирование требований и создание концепций автоматизированной системы учета
- Ввод в действие и последующее сопровождение автоматизированной системы учета
- Характеристика автоматизированных систем бухгалтерского учета
- Разработка и утверждение технического задания на создание (ведение) автоматизированной системы учета
- ЭТАПЫ РАЗРАБОТКИ АВТОМАТИЗИРОВАННЫХ СИСТЕМ УПРАВЛЕНИЯ ПРОИЗВОДСТВОМ
- Микрюкова В.И.. АВТОМАТИЗИРОВАННЫЕ ИНФОРМАЦИОННО-УПРАВЛЯЮЩИЕ СИСТЕМЫ. Учебное пособие. Киров - 2009, 2009
- Описание работы системы автоматизированного смыслового анализа текстов