Сканер для книг

Сканирование книг и сшитых документов

Специалисты компании Редокс качественно и в сжатые сроки выполняют сканирование книг, буклетов, журналов, подшивок газет и других переплетенных или сшитых документов.

Эта операция является начальным этапом таких процессов как:

  • создание электронных книг
  • создание электронных библиотек
  • создание электронных каталогов

Работы по сканированию сшитых документов имеют свои особенности, в связи с которыми рекомендуется поручить их выполнение сотрудникам компании, специализирующейся на предоставлении подобных услуг.

Если сканирование обычных документов даже очень большого размера или нестандартного формата можно осуществлять на обычных планшетных сканерах, то для переплетенных или сшитых листов это оборудование не подходит по двум причинам:

  1. Электронные изображения получаются дефектными, с затемнениями и искажениями в местах сгиба страниц, перекосами, что влечет за собой потерю информации
  2. Существуют книги, которые невозможно раскрыть под углом более чем 90 0 из-за особенностей переплета или сшивки, ветхости или большой ценности

Наша компания работает с книгами на протяжении уже 10 лет и мы знаем как сделать так, чтобы наши клиенты получили отличный результат по разумной цене.

Техника сканирования

Для сканирования книг мы применяем специализированную технику — высокоскоростные книжные сканеры, позволяющие сканировать переплетенные или сшитые листы без повреждений и, соответственно, искажения или утраты информации. Такое оборудование имеет достаточно высокую стоимость и требует наличия некоторых навыков в обращении с ним. По этой причине нецелесообразно проводить самостоятельное сканирование таких документов — цена будет неоправданно высокой по сравнению со стоимостью услуг профессионалов, а результат работы неудовлетворительным.

Для того чтобы получить качественные электронные копии бумажных книг и документов, пригодные для использования и наполнения электронных библиотек, вам достаточно предоставить нашим специалистам исходные материалы — любые переплетенные книги либо сшитые документы с листами формата не больше чем А3 или разворотом формата не более А2.

После проведения сканирования вы получите файл с изображением оригинала, сохраненный в любом из графических форматов tif, gif, jpg или PDF.

Многостраничный PDF на данный является самым распространенным форматом для создания электронной документации, электронных книг и инструкций, поэтому по желанию заказчика наши специалисты преобразуют результат в электронный документ PDF. Изображения в данном формате можно просматривать с помощью распространенного приложения Acrobat Reader.

Для обработки большого объема исходных материалов мы применяем поточное сканирование, при котором весь процесс представляет собой единый конвейер, работающий с высокой производительностью и практически безостановочно.

Этап 1. Копирование книги

Со временем многие процессы упрощаются. Если с пяток лет назад этот этап был крайне продолжительным (приходилось пользоваться сканером), то с улучшением камер мобильных телефонов затрачиваемое время существенно сократилось. Конечно, камера камере рознь, но, если подобрать приемлемые условия съемки, должен подойти любой более-менее современный телефон.

Разумеется, использование сканера все же более предпочтительно. Особенно если дело касается технической литературы, содержащей множество формул и чертежей.

Предвосхищая события, отмечу, что снимки впоследствии будут обработаны специальной программой. Но все же стоит добросовестно отнестись к самой съемке, дабы не ставить качество конечного продукта в зависимость лишь от постобработки.

Пример не самого хорошего снимка: освещение страдает, страницы до конца не выпрямлены. Все ради эксперимента

Поэтому постарайтесь максимально широко раскрывать страницы, чтобы изгибы у корешка книги были минимальны. Было бы здорово, если бы вам кто-то в этом помогал. Один человек держит телефон, а второй переворачивает и выпрямляет страницы. Ко всему прочему, студенты любят делать на библиотечных книгах пометки, и неплохо было бы их стереть.

Делаем серию снимков и перекидываем их на компьютер в отдельную папку. Пришла пора поработать неживому мозгу.

Этап 2. Обработка

Я сталкивался с двумя серьезными программами для обработки отсканированных (сфотографированных) книг: ScanTailor и ScanKromsator. Возможно, за годы моего инактива появились еще какие-то достойные альтернативы, но я сомневаюсь — уж очень мала и бедна пользовательская ниша. Самые прожженные книгоделы предпочитают ScanKromsator. В нем предельно много настроек и возможностей, но разобраться и понять все предложенные навороты, видимо, не в состоянии и сам автор программы (шутка). Поэтому я рекомендую вам ScanTailor. Мне довелось следить за развитием этой утилиты с первых дней ее существования. Разработчик еще несколько лет назад прекратил поддержку проекта, но все-таки дал миру хороший инструмент для обработки сканов.

Начало работы

Работа в ScanTailor последовательна и проста. Все промежуточные действия отображены в левой части рабочей области, вы с легкостью вольетесь в процесс.

Выберите папку с исходниками, выходная папка будет создана автоматически. Для всех страниц установите максимально возможное DPI — 600 × 600. Мощности современных компьютеров позволяют достаточно быстро обрабатывать такие изображения.

Не жалейте DPI для своей книги

Шаг 1. Исправление ориентации

Самый простой и быстрый шаг. Скорее всего, вы изначально фотографировали страницы с верной ориентацией, потому и хлопот возникнуть не должно. Отмечу лишь, что изначально ScanTailor будет предлагать вам запустить пакетную обработку текущего действия (небольшой значок Play напротив шага) — обязательно им пользуйтесь, дабы не щелкать по каждому изображению отдельно.

На мой взгляд, ScanTailor может гордиться своим продуманным интерфейсом

Шаг 2. Разрезка страниц

Практически беспроблемный шаг. Я крайне редко встречал ошибки программы на этом этапе. Обязательно обратите внимание на обложку книги — именно здесь зачастую возникают нюансы.

Большей наглядности и придумать трудно

Шаг 3. Компенсация наклона

В подавляющем большинстве случаев алгоритм срабатывает корректно. Не ждите подвоха, переходите к следующему шагу.

К вашим услугам ручная настройка до долей градуса

Шаг 4. Полезная область

Наверное, это самый ответственный момент. Только содержание книги имеет определяющее значение, оформление — дело вторичное. Именно с этого шага начинает работать связка «компьютер — человек». В программе порой случаются небольшие сбои, поэтому после автоматической обработки пробегитесь глазами по миниатюрам страниц в правой части экрана. Обычно ошибки сразу бросаются в глаза.

«Бракованная» полезная область будет видна при просмотре миниатюр страниц

Шаг 5. Поля

Размер полей — дело вкуса. Более важным моментом является возможность выравнивания размеров страниц. Не забудьте поставить эту галочку, чтобы не получить на выходе «пляшущие» страницы.

Обложку обычно приходится дорабатывать в графическом редакторе

Шаг 6. Выход

Последний бой — он трудный самый. Плюс самый ресурсоемкий для вашего компьютера и самый требовательный к вашему вниманию.

Необработанные страницы помечаются вопросительным знаком

Финишный отрезок знаменуется рядом важнейший действий. Прежде всего вы определяете выходной режим книги: черно-белый, цветной или смешанный. Затем страницы очищаются от мусора, искривленные строки выравниваются. Не буду вдаваться в подробности, но укажу вам на не самые заметные закладки, расположенные несколько нелогично и непривычно — между превью страницы и лентой миниатюр. Каждая закладка отвечает за важную функцию ручной настройки получаемых изображений. Если вы найдете желание и время вникнуть в принцип их работы, ваши книги будут более высокого качества.

Страница до и после корректировки искажения строк

Итог

Стремясь к идеалу, на эту работу вы можете потратить не один час. Все зависит от вашей заинтересованности в конечном результате и качестве исходных снимков. Да, я еще раз возвращаюсь к этой теме. Чуть большие старания на этапе подготовки могут сэкономить огромное количество времени, которое уходит на приведение страниц в приличный вид.

Прошу не брать за образец приведенные скриншоты — на все про все у меня ушло не более пары минут. Я не сомневаюсь, что забыл указать вам на некоторые нюансы работы со ScanTailor — слишком давно я ничего не обрабатывал с его помощью.

В итоге вы получите набор разрозненных страниц в формате .tif. Пора сшиваться!

Книжные сканеры

  • Сканеры с автоподатчиком
    • Формат А4
      • Скорость до 30 стр./мин.
        • Panasonic
        • Fujitsu
        • Microtek
        • Canon
        • Epson
        • Kodak alaris
        • Avision
        • Brother
        • Mustek
      • Скорость 31-60 стр./мин.
        • Canon
        • Fujitsu
        • Panasonic
        • Avision
        • Microtek
        • Epson
        • Kodak alaris
        • Mustek
        • Brother
        • HP
      • Скорость 61-90 стр./мин.
        • Panasonic
        • Kodak alaris
        • Fujitsu
        • Brother
        • Mustek
        • Avision
      • Скорость свыше 90 стр./мин.
        • Mustek
    • Формат А3
      • Скорость до 60 стр/мин
        • Fujitsu
        • Avision
        • Canon
        • Epson
        • Kodak alaris
      • Скорость 61-90 стр./мин.
        • Canon
        • Panasonic
        • Fujitsu
        • Epson
        • Kodak alaris
        • Avision
        • Plustek
      • Скорость свыше 90 стр/мин
        • Kodak alaris
        • Fujitsu
        • Panasonic
        • Canon
        • Avision
  • Широкоформатные сканеры
    • 25″ (635мм)
      • Colortrac
      • Canon
      • Contex
    • 36″ (914мм)
      • Colortrac
      • Graphtec
      • Canon
      • WideTEK
      • Contex
    • 40″ (1016мм)
      • Canon
      • Xerox
    • 42″ (1067мм)
      • Colortrac
      • Contex
      • HP
    • 44″ (1118мм)
      • Rowe
      • Colortrac
      • WideTEK
      • Contex
      • HP
    • Более 54″
      • Contex
      • Colortrac
  • Сетевые сканеры и адаптеры
    • Автономные сетевые сканеры
      • Canon
      • Fujitsu
      • Avision
      • Kodak alaris
      • Brother
      • HP
    • Неавтономные сетевые сканеры
      • Epson
      • Avision
      • Canon
      • Brother
      • Panasonic
      • Kodak alaris
    • Скансерверы (сетевые адаптеры для сканеров)
      • Silex
      • Canon
  • Планшетные сканеры
    • Формат А6
      • Fujitsu
    • Формат А5
      • Plustek
    • Формат A4
      • Avision
      • Plustek
      • Epson
      • Mustek
      • Canon
      • Microtek
      • HP
    • Формат A3
      • Plustek
      • Microtek
      • Epson
      • Avision
      • Mustek
      • WideTEK
    • Формат A2
      • Contex
      • WideTEK
    • Формат А0
      • Microtek
  • Плоттеры
    • Струйные плоттеры Формат А2
      • Canon
      • Epson
    • Струйные плоттеры Формат А1+
      • HP
      • Canon
      • Epson
    • Струйные плоттеры Формат А0+
      • HP
      • Canon
      • Epson
    • Лазерные и LED плоттеры формата А0+
      • OCE
      • Seiko
      • Kyocera Mita
    • Сольвентные плоттеры
      • Mimaki
      • Epson
    • Режущие плоттеры
  • Принтеры
    • Принтеры формата А4
      • Kyocera Mita
      • Xerox
      • HP
      • OKI
      • Epson
      • Canon
    • Принтеры формата А3
      • Kyocera Mita
      • OKI
      • Epson
      • HP
      • Xerox
    • Матричные принтеры
  • Портативные сканеры
    • I.R.I.S
    • Fujitsu
    • Microtek
    • Epson
    • Canon
    • Brother
    • Mustek
    • Avision
    • DOKO
  • Паспортные сканеры/считыватели
    • Сканеры
      • Plustek
      • Fujitsu
      • Avision
    • Видео считыватели паспортов
      • Smart Engines
    • Считыватели паспортов
      • Regula
    • ПО для паспортных сканеров
      • Cognitive
  • Сканеры визиток
    • I.R.I.S
  • Книжные сканеры
    • Avision
    • Sceye
    • Plustek
    • Microtek
    • Kodak alaris
    • Fujitsu
    • ATIZ
    • Optima
    • DOKO
  • Фильм сканеры
    • Canon
  • Сканеры слайдов
    • Nikon
    • Plustek
  • Медицинские сканеры
    • Microtek
  • Опции и расходники
    • Опции для документных сканеров
      • Canon
      • Avision
      • Fujitsu
      • Epson
      • Kodak alaris
      • I.R.I.S
      • Panasonic
      • Kofax
      • Brother
      • Silex
    • Опции для широкоформатных сканеров
      • Colortrac
      • Contex
      • Rowe
      • WideTEK
      • Panasonic
      • Avision
    • Опции для плоттеров
      • Canon
      • Epson
      • Es-Te
      • Mimaki
      • Seiko
      • HP
      • Kyocera Mita
      • Ricoh
      • OCE
      • OKI
    • Опции и оригинальные расходные материалы для МФУ и принтеров
      • Epson
      • Brother
        • CANON
          • Canon
        • OKI
          • OKI
          • Canon
        • Konica Minolta
          • Konica Minolta
          • Kyocera Mita
        • Kyocera Mita
          • Kyocera Mita
        • Ricoh
          • Ricoh
        • XEROX
          • Xerox
    • Бумага плёнка холст
      • листовые носители
        • Canon
        • Epson
        • Mondi
        • TrendArt
        • Xerox
        • OKI
        • HP
      • рулоны 297-331 мм (A4-A3+)
        • Xerox
        • Славич
        • Epson
        • Albeo
        • Mega
      • рулоны 406-432 мм (A2)
        • Xerox
        • Славич
        • Epson
        • Albeo
        • Mega
        • Canon
      • рулоны 594-610 мм (A1+)
        • Xerox
        • Славич
        • Albeo
        • Epson
        • HP
        • Mega
        • Canon
      • рулоны 841-914 мм (А0+)
        • Xerox
        • Славич
        • Albeo
        • HP
        • Mega
        • Canon
      • рулоны более 914 мм
        • Albeo
        • Epson
        • Mega
        • Canon
  • Многофункциональные устройства
    • МФУ формата А1
      • Canon
      • HP
    • МФУ Формат А0 (инженерные системы)
      • Цветные МФУ формата А0
        • Canon
        • HP
        • Epson
      • Монохромные МФУ формата А0
        • Seiko
        • OCE
        • Ricoh
    • МФУ формата А4
      • Монохромные МФУ А4
        • Лазерные монохромные МФУ А4
          • Canon
          • Konica-Minolta
          • Ricoh
          • Brother
          • HP
          • Sharp
          • OKI
          • Kyocera Mita
          • Xerox
        • Струйные монохромные МФУ А4
          • Epson
      • Цветные МФУ А4
        • Canon
          • Лазерные цветные МФУ А4
            • HP
            • OKI
            • Ricoh
            • Brother
            • Canon
            • Kyocera Mita
            • Xerox
          • Струйные цветные МФУ А4
            • Epson
            • Kyocera Mita
            • HP
            • Canon
    • МФУ формата А3
      • Монохромные МФУ А3
        • Kyocera Mita
        • Konica-Minolta
        • Ricoh
        • Canon
        • HP
        • Toshiba
        • Xerox
      • Цветные МФУ А3
        • Лазерные цветные МФУ А3
          • Canon
          • OKI
          • Kyocera Mita
          • Ricoh
          • Konica-Minolta
          • Toshiba
          • Panasonic
          • Xerox
          • Konica Minolta
          • HP
        • Струйные цветные МФУ А3
          • Brother
          • Epson
  • Банковское оборудование
    • Детекторы валют
      • DORS
      • Mercury
      • PRO
      • Cassida
    • счетчики банкнот и монет
      • Mercury
  • Финишное оборудование
    • Фолдеры (фальцовщики)
      • Es-Te
      • OCE
    • Ламинаторы
      • Geha
      • Fellowes
    • Переплетные аппараты
      • Fellowes
    • Уничтожители документов
      • Geha
      • HSM
      • Office Kit
      • Fellowes
    • Режущие плоттеры
      • Graphtec
      • SummaGraphics
      • Mimaki
    • Резаки для бумаги
      • Ideal
    • Воздухоочистители
      • Fellowes
  • Демо сканеры Canon
  • * снятые с производства модели
    • Kodak alaris
    • Canon
    • Colortrac
    • Panasonic
    • Avision
    • Contex
    • Epson
    • I.R.I.S
    • Graphtec
    • Plustek
    • Fujitsu
    • Portable Peripheral
    • Microtek
    • WideTEK
    • Silex
    • Xerox
    • HP
    • VisitorControl
    • Brother
    • Mercury
    • OKI
      • 1111111
  • новые товары
    • HP
    • Epson
    • Fellowes
    • Panasonic
    • для Canon
      • SAKURA
      • Canon
    • для Samsung
      • SAKURA
    • для XEROX
      • Xerox
      • SAKURA
    • для Lexmark
      • SAKURA
    • для Brother
      • SAKURA
    • для Kyocera Mita
      • SAKURA

Почему библиотека является наиболее ярким образом системологии – фундаментальной науки, изучающей организацию процессов и явлений в мире? Ответ кроется в фонде и справочно-поисковом аппарате библиотеки. Для обычного читателя книги на полках и есть фонд, но это не совсем так. Библиотечный фонд – это сложная по структуре совокупность документов, представленных на различных носителях информации, соответствующая определенным отраслям знаний и связанная со специализированным поисковым механизмом на основе карточного каталога.

Даже размещение журналов на стеллажах библиотеки основываются на научном подходе: информетрический закон Брэдфорда объясняет закономерность распределения статей по изданиям и тем самым позволяет с большой вероятностью спрогнозировать востребованность материалов, исходя из специфики информации.

Иначе говоря, библиотекам удалось создать идеальную систему классификации и структурирования информации, которая позволила решить проблему хранения и поиска огромных объемов данных из любых источников. Для этого были разработаны специализированные библиотечные классификаторы, регламентирующие распределение и расстановку фондов, методы организации систематических каталогов, стандарты оформления и учета документов.

Об оцифровке

Когда мы говорим об оцифровке книг любой библиотеки, то, помимо сохранности оригиналов и обеспечения аутентичности электронной копии, необходимо помнить о сохранении идентичности структуры классификации и поиска информации в бумажном и электронном фонде. Другими словами, сканирование книг требует обязательного создания электронного каталога и формирования индексно-поисковой базы данных с максимальной полнотой наполнения.

Проекты по созданию электронных ресурсов библиотек
являются одними из самых сложных и насыщенных с точки зрения трудозатрат,
применяемых методологий и технического исполнения.

Возникает естественный вопрос – зачем? Зачем при такой сложности реализации подобных проектов затевать оцифровку библиотечных материалов, ведь «книги могут храниться веками», да и «вообще в библиотеку уже никто не ходит»?

Это ошибочное мнение. В последние годы библиотеки активно меняются, внедряют современные технологии и стандарты обслуживания для удовлетворения потребностей нового поколения читателей, воспитанных на свободе использования цифрового контента. Принимаются программы по переоснащению, в практику работы вводятся индексы эффективности деятельности, создаются единые каталоги, региональные и краеведческие электронные коллекции. В 2015 г. запущена Национальная электронная библиотека (НЭБ), для развития которой проводится регулярная оцифровка фондов российских библиотек.

Не стоит забывать и о сохранности бесценных знаний и культурных ценностей, накопленных в книгохранилищах по всей стране. Для этих целей оцифровка – самый эффективный способ сохранения изданий и обеспечения безопасного доступа к содержащейся в них информации.

Электронный каталог

Проект в одной крупной библиотеке продолжался с 2003 по 2011 гг. В ходе проекта было выполнено сканирование и индексирование более 2 млн карточек систематического каталога на русском и иностранных языках. В АБИС перенесены данные по 17 полям с каждой карточки.

Основа основ автоматизации современных библиотек – создание электронного каталога и наполнение автоматизированной библиотечно-информационной системы (АБИС). АБИС необходима для автоматизации учета фондов. А полноценный электронный каталог значительно увеличивает эффективность и скорость поиска информации, значительно повышая общее качество обслуживания читателей.

Как правило, в библиотеке ведутся несколько видов каталогов: алфавитный, в котором все карточки расставлены по алфавиту; систематический, где карточки расставлены по отраслям знаний. Существуют каталоги, разделяющиеся по охвату фонда: генеральный или отдельных частей фонда; по назначению: читательский или служебный; по многим другим признакам: краеведческий, предметный и т.д.

При большом количестве фондов
оцифровка всего каталога – довольно длительный процесс,
который обычно проводится поэтапно.

Основа каталога – это библиотечная карточка, содержащая информацию об издании, индексы классификации, номер книги (ISBN) и другие данные. Ввиду большого объема специфической информации, карточка является сложнейшим документом для извлечения индексных данных. Еще больше затрудняют обработку информации записи на иностранных языках, рукописный текст или диакритические знаки (различные надстрочные, подстрочные, реже внутристрочные символы).

Одна библиографическая запись может содержать до 24 разных полей. Перенос записей в систему напрямую с бумажных носителей нецелесообразен из-за низкой скорости и риска потери/пропуска ключевой информации, поэтому работы по созданию электронного каталога подразумевают обязательное предварительное сканирование библиотечной картотеки, формирование и проверку индексной базы данных перед загрузкой в АБИС.

Даже в небольшой библиотеке количество карточек исчисляется тысячами единиц. В таких условиях искать собственные кадровые и технические ресурсы и самостоятельно заниматься формированием электронного каталога практически невозможно, поэтому для экономии времени и денег привлекаются профессиональные подрядчики, которые специализируются на обработке библиотечной информации и готовы гарантировать итоговый результат.

Типовой технологический процесс создания электронного каталога

Оцифровку целесообразно производить на территории библиотеки, чтобы не изымать библиотечные карточки из использования и не нарушать работу с читателями. Процесс делится на несколько этапов:

Экспертиза. Оценивается физическое состояние карточек и объемов картотеки. Определяется состав библиографического описания и требуемый формат машиночитаемых записей. Исходя из полученных данных, составляется дальнейшая технологическая цепочка работ. На перечень работ и методы извлечения данных влияют нюансы в написании символов, формате и даже составе материала (картон, бумага). Ниже приведены возможные типы карточек:

Современное оборудование позволяет достигать скорости сканирования 170 карточек в минуту, при этом выбор профессионального сканера позволяет избежать повреждения самих карточек.

  • добавочная карточка. Особенность: печатные и рукописные символы,
  • разделитель. Особенность: отличный от стандартного формат карточки,
  • ссылочная карточка. Особенность: только рукописные символы,
  • описание. Особенность: старорусский текст.

Сканирование. Поточное сканирование бумажных карточек осуществляется на высокоскоростных документных сканерах. Стандартные требования к оцифровке: разрешение 300 dpi, черно-белый режим сканирования, формат файлов TIFF или JPEG. Большинство карточек типового размера 130х80 мм, но встречаются до формата А6 (148х105 мм) включительно. Иногда перед сканированием производится склейка поврежденных карточек. Часто проводится двустороннее сканирование карточек, где на обратной стороне содержатся инвентарные номера, разбивка по филиалам. Незначимые карточки-разделители не сканируются.

После оцифровки бумажный массив картотеки приводится в исходное состояние.
Все последующие работы проводятся с полученными
графическими образами карточек.

Обязательно должны проводиться поворот перекошенных изображений, удаление фона, проявление слабоконтрастных символов и т.д.

Свойства электронных копий должны исключать потерю информации и не ухудшать читаемость документа по сравнению с бумажным оригиналом. В случае плохого состояния исходного материала допускается использование программных средств улучшения качества изображений.

Вся обработка изображений выполняется в автоматическом режиме. Возможна ручная коррекция геометрии образов, очистка от шумов и следов сгиба при необходимости обработки небольшого количества поврежденных документов.

Даже в случае набора текста на печатной машинке, далеко не все символы распознаются корректно. Автоматическое распознавание рукописного текста, карандашных пометок и карточек, созданных до середины 20 века практически невозможно.

Количество графических образов должно совпадать с числом листов бумажного массива. Нормой стало сканирование в порядке следования карточек каталога. Пропуск страниц считается браком.

Ретроконверсия: ввод информации с отсканированных карточек и формирование базы данных. Карточки могут содержать машинопечатный и рукописный текст, карандашные пометки, нечеткие символы и иметь другие особенности заполнения.

В редких случаях, при хорошем качестве документа, содержащего печатный текст, можно использовать программные средства распознавания для автоматического извлечения определенных полей карточки.

Поэтому данные с библиотечных карточек в основном вводятся вручную
и проходят многоуровневую систему контроля качества.

Перед ретроконверсией производится сепарация (сортировка) изображений с целью группировки отдельных частей массива по типам карточек и другим признакам индексирования (сцепка составных карточек, создание блоков данных для томов, разделение по языкам и т.д.). Производится разметка блоков для удобства извлечения данных оператором.

На выходе формируется база данных в требуемом для библиотеки формате (RUSMARC, UNIMARK, MARC21 и др.). В некоторых случаях при создании электронного каталога предметом обработки могут служить напрямую графические образы книг. Тогда к работе привлекаются операторы, владеющие знаниями правил составления библиографических описаний.

Требования к минимальному проценту ошибок в базе данных очень высоки, так как это напрямую влияет на качество поиска информации в электронном каталоге. Поэтому после ввода данных присутствует этап проверки по различным параметрам опытными верификаторами.

Для ускорения процесса ретроконверсии используется технология заимствования,
упрощающая ввод информации за счет автоподбора заполнения полей
на основе ранее введенных данных.

Сканирование книг

Многие библиотеки уже обладают профессиональными планетарными сканерами для ежедневной оцифровки книг. Но собственными силами в основном сканируется поступающая литература. Для массовой качественной оцифровки обычно заказываются аутсорсинговые услуги. Так, в одной крупной федеральной библиотеке с 2008 по 2014 гг. оцифровано более 16,5 млн страниц библиотечных и архивных фондов силами привлеченного подрядчика.

После создания электронного каталога или параллельно этому процессу библиотеки решают задачи по обеспечению сохранности и доступности книжного фонда путем оцифровки книг. Работы по оцифровке проводятся для наполнения национальных электронных проектов, создания коллекций редких книг и полнотекстовых ресурсов, собраний тематических иллюстрированных материалов и много другого.

Библиотеки могут проводить работы по оцифровке фондов самостоятельно. Например, в крупных библиотеках организованы целые отделы сканирования, располагающие парком профессионального оборудования.

Важным аспектом являются характеристики цифровых копий. Если решаются локальные задачи, библиотека может самостоятельно определять требования к выходным электронным ресурсам. Но при реализации национальных проектов, где используются фонды различных библиотек, необходим общий стандарт, регламентирующий основные характеристики работы.

При создании НЭБ электронные ресурсы, созданные техническим исполнителем
и библиотеками самостоятельно, имели разные параметры оцифровки,
что усложняло работу по обработке и загрузке цифрового контента.

Поэтому отраслевым экспертным советом были подготовлены «Рекомендации по оцифровке материалов из фондов библиотек»*, которые показывают принцип создания электронных библиотечных ресурсов. В рекомендациях указаны три вида цифровых копий. Мастер-копия – эталонная копия оригинала в полиграфическом качестве (разрешение не ниже 600 dpi). Пользовательская копия – для создания электронных коллекций и предоставления читателям (разрешение не ниже 300 dpi). Служебная копия используется для внутренних задач библиотеки и размещения на web-сайтах (разрешение не ниже 150 dpi).

Особенности сканирования книг

При оцифровке книг этапы работ повторяют процесс создания электронного каталога. Действует библиотека самостоятельно или нанимает подрядчика, но так или иначе в первую очередь необходимо определить цель проекта и провести экспертизу книжного фонда для понимания стоимости и трудоемкости работы. В дальнейшем формируется состав подлежащих оцифровке изданий, согласовываются технические требования, и производится окончательная оценка проекта.

Рассмотрим несколько особенностей оцифровки книг, которые влияют на стоимость и сроки проектов. Большое значение имеет формат и состояние книг, а также объем бумажного фонда. Исходя из этих особенностей, определяется вид сканирующего оборудования и технологии оцифровки.

1 | 2 | 3 | 4 Ветхая, рваная бумага, а также толстый переплет многих книг позволяет применять только бесконтактное сканирование – профессиональные планетарные (книжные) сканеры. Использование планшетных сканеров исключено.

После сканирования полученные цифровые копии проходят процесс программной коррекции, приводятся к наиболее удобному для чтения качеству изображений. Зачастую при использовании профессиональных книжных сканеров для этого достаточно встроенных программных средств обработки. После получения массива цифровых копий при необходимости составляются библиографические описания отсканированных изданий.

Отдельно стоит выделить работы по высококачественному сканированию коллекций редких книг, книжных памятников, фолиантов и других ценных экземпляров. Для этого используются специализированные комплексы высококачественного сканирования, обеспечивающие уникально высокие показатели оптического разрешения.

Особенности формирования полнотекстовых PDF-книг

*В Гражданском кодексе РФ (ч. IV в ред. 2006 г.) статьями 1274 и 1275 допускается без согласия автора предоставление экземпляров произведений, правомерно введенных в гражданский оборот во временное безвозмездное пользование. Но цифровые экземпляры произведений могут предоставляться только в помещениях библиотек при условии исключения возможности создать копии этих произведений в цифровой форме. Для предоставления доступа к ограниченным изданиям в среде национальной электронной библиотеки был разработан специальный защищенный просмотровщик для удаленной работы граждан с произведениями в электронной форме.

Но цифровых копий порой бывает недостаточно. Существуют задачи по превращению изображения в полноценную электронную книгу. На основе графических образов формируются электронные книги в формате PDF. Этот формат наиболее универсален и позволяет осуществлять полнотекстовый поиск и навигацию по оглавлению и гиперссылкам. Электронные книги, не ограниченные авторским правом, можно публиковать в интернете или давать «защищенный» доступ в читальном зале библиотеки*.

Для создания таких книг проводится полнотекстовое распознавание с дальнейшей верификацией текста и проверкой орфографии. Для окончательной вычитки документа привлекаются профессиональные корректоры.

В результате макетирования формируется электронная книга,
полностью идентичная бумажному оригиналу — с точным расположением страниц,
иллюстрациями, сохранением языка и стиля.

Оцифровка книг и каталогов библиотек, особенно при существенном объеме, разнородности фондов по формату и состоянию оригиналов, – сложнейший производственный процесс, осуществить который качественно могут только специализированные компании, обладающие всей необходимой инфраструктурой и большим опытом в создании электронных ресурсов.

Короткая ссылка на материал: http://cnews.ru/link/a4439