
Развитие искусственного интеллекта (ИИ) стало важным аспектом программы конференции LIBCOM-2024¹ Этой теме была посвящена открытая лекционно-дискуссионная панель «Искусственный интеллект в науке, культуре, образовании: проблемы, решения, привилегии».
Обсуждения коснулись особенностей применения ИИ в библиотечном деле и в образовании. Рассматривались аспекты адаптации нейросетей в библиотеках под задачи научных исследований, а также вклад ИИ в формирование новой национальной системы научно-технической информации.
Организаторы конференции: Государственная публичная научно-техническая библиотека России (ГПНТБ России) и Международная ассоциация пользователей и разработчиков электронных библиотек и новых информационных технологий (Ассоциация ЭБНИТ).
ИИ В БИБЛИОТЕЧНОМ ДЕЛЕ: ВЫЗОВЫ И ПРАГМАТИКА
Рассуждая о возможностях применения ИИ в библиотечном деле, генеральный директор Российской государственной библиотеки (РГБ, «Ленинки») Вадим ДУДА начал с миссии библиотеки и её команды:
— Наша миссия — собирать, сохранять и предоставлять в доступ документы, имеющие отношение к приоритетам России. В числе долгосрочных задач «Ленинки» — повышение уровня и качества жизни коллектива. Полагаем, что команда — наше главное достояние. Для того чтобы обеспечить достойный уровень, важны доходы, и многое зависит от технологий и способов работы. Средняя заработная плата в РГБ в этом году составит 107–108 тыс. рублей, цифра удвоилась за пять лет, для чего есть определённые основания. Шесть лет назад в «Ленинке» работали 1725 человек, в этом году — 1625. Насколько уменьшился коллектив? Не на 100 человек: к нам присоединились коллектив Российской книжной палаты (РКП) и несколько проектных офисов. С учётом этого коллектив самой библиотеки сократился примерно на 400 человек, но всё происходит достаточно спокойным образом: мы совершенствуем технологии и способы работы. ИИ — один из способов радикально повысить технологичность библиотеки. Кроме того, если мы хотим оставаться источником актуальной современной информации, а не только хранилищем, близким к музею или архиву, то фонд надо пополнять современными документами, в том числе электронными. Это означает, что их количество должно возрасти. В этом мы видим возможности для ИИ.
По словам эксперта, присоединение РКП в 2022 г. обеспечило позиции РГБ как единственной настоящей национальной библиотеки, ведущей систему обязательного экземпляра (ОЭ), государственной статистики, выполняющей функции национального агентства каталогизации и распространения данных:
— Если мы хотим передать эти функции условному ИИ, это очень опасно. Надо быть осторожными и предусмотрительными: если это будет Google или другая зарубежная система, возможны осложнения. Используя какие-то модные инструменты, всегда надо думать о миссии.
Спикер обозначил основные вызовы, которые стоят перед национальной библиотекой:
— Это прежде всего радикальное изменение моделей производства и распространения актуальных знаний. Основная модель комплектования «Ленинки» — ОЭ. Но мы знаем, что в ОЭ не попадают копии веб-сайтов, страниц социальных сетей, а некоторые из них имеют несколько миллионов подписчиков. Очень высока стоимость процессов обработки данных и создания навигационных систем. В каждой библиотеке работают профессионалы, занимающиеся каталогизацией, систематизацией, созданием справочно-библиографического аппарата. В РГБ это более сложная структура. Мы поддерживаем карточный каталог и множество других вспомогательных информационных систем. В то же время стейкхолдеры: учредители и меценаты — имеют весьма прагматичные цели. Очень сложно объяснить, что нас надо поддерживать, потому что у РГБ история и традиции. Должны быть актуальные и понятные задачи прямо сейчас.
Как отметил эксперт, в основе решения задач, обусловленных этими вызовами, должен быть подход, связанный с алгоритмами и ИИ. Необходимо обрабатывать как можно больше документов, поступающих в фонд, что невозможно обеспечить лишь увеличением числа рабочих мест. В «Ленинку» каждый год поступает примерно 300 тыс. документов, примерно 150 сотрудников заняты их обработкой. Если ставить задачу обрабатывать 1,5 млн документов, то надо привлечь 1,5 тыс. человек, а это нереально.
— Перед нами стоят прагматические задачи в плане применения ИИ. Это прежде всего радикальное расширение репертуара поступлений в области цифровых документов: электронные СМИ, научные публикации, социальные сети. Много вызовов, связанных с отбором, фильтрацией, сохранением и дальнейшим использованием. Эти задачи сложно решить без применения наукоёмких инструментов. Следующая цель — автоматическая обработка и создание стабильного, нативного справочно-библиографического аппарата и машиночитаемого каталога текущих поступлений. Когда нам говорят, что «Яндекс» — некий универсальный каталог современных знаний, мы понимаем его отличие от библиотечных фондов и справочно-библиографического аппарата. Если задать специалисту-библиографу вопрос, ответ будет стабильным во времени. Этого не происходит в цифровой среде, потому что некоторые документы становятся недоступными и сами запросы серьёзно влияют на алгоритмы обработки: они создают поисковую среду и определённую систематизацию. Стабильный и нативный библиографический аппарат — это не поисковый алгоритм «Яндекса», а скорее гибрид автоматической обработки запросов и систем предметизации и систематизации, принятых в библиотечном мире. То же самое касается обработки ретроспективного массива. Если говорить о текущих поступлениях, то есть федеральный закон и мы должны получать ОЭ в электронном виде, в формате pdf. Ретроспективный фонд — это 50 млн документов, очень большая работа. Уверен, что будущее за созданием новых интерфейсов для раскрытия и интеграции документов фонда во внешние проекты, так называемые машиночитаемые каталоги. Обработка документов из библиотечных фондов должна быть двухуровневой. Сначала должна быть создана матрица ключевых слов, понятий, собственных имён, географических названий и определённых смыслов, и лишь затем формируются каталоги и справочно-библиографический аппарат, — считает В. Дуда.

Из всего этого эксперт делает вывод: если не начинать внедрять ИИ в библиотечные процессы сейчас, есть риск опоздать. Он утверждает, что ИИ становится обычным инструментом для работы, каким оказалось электричество, заменив свечи. ИИ не станет конкурентным преимуществом, как перестала быть таковым пишущая машинка. Но как полагает эксперт, можно «снять сливки» на начальном этапе: тот, кто первым пойдёт в эту сторону, имеет шанс стать монополистом или войти в олигополию. Главный поисковик в мире — Google, и вряд ли кто-то сможет назвать № 2. То же можно сказать о «Яндексе» в России. Монополия — основа цифрового бизнеса. Если мы хотим получить уверенные позиции, надо очень быстро двигаться.
В завершение гендиректор РГБ сказал:
— Что касается нормативной базы, то мы много лет пытались перенести принципы работы, существующие в физическом мире, в цифровое пространство. Именно поэтому не получилось создать надёжную среду для открытого доступа, для работы с электронными книгами. Нормативная база для работы с ИИ будет более сложной. Можно ли использовать изображение Ю. Никулина для рекламных роликов? Наверное, да. Но даже если будет запрет, системы генеративного ИИ создадут такое количество контента, что все суды окажутся парализованными. Думаю, что есть два пути решения таких проблем. Первый — этика. Должен быть подготовлен серьёзный этический кодекс работы с ИИ, очень прагматичный. Второй — субъектное, а не объектное регулирование, и вполне возможно, что появится определение цифровой свободы субъекта. Самое важное — много победителей не будет. Необходимо объединяться, для того чтобы создать конкурентоспособную среду и стать лидерами. Будущее в наших руках.
