Библиотека внедряет чат-бота, который отвечает на вопросы по книгам, или сервис, который автоматически формирует аннотации к новым поступлениям — и на первый план выходит вопрос: а законно ли это с точки зрения авторского права? Тексты, аннотации, обложки, оцифрованные издания в фонде — всё это объекты авторского права, и работа ИИ с ними требует понимания границ допустимого использования. Разбираем, где чаще всего возникают правовые риски при внедрении ИИ в библиотеке и как их избежать. О более широком контексте ответственного внедрения ИИ — в статье «ИИ и этика в библиотеках».

Оглавление

  1. Почему это важно именно для библиотеки
  2. Где возникают основные риски
  3. Обучение моделей на текстах из фонда
  4. Генерация контента: аннотации, описания, ответы бота
  5. Лицензии на готовые ИИ-сервисы
  6. Практические правила для библиотеки
  7. Типичные ошибки
  8. Частые вопросы

Почему это важно именно для библиотеки

Библиотека по своей природе работает с чужими произведениями — это её основная деятельность, и законодательство традиционно предусматривает для библиотек особые режимы использования (например, право на выдачу изданий читателям, межбиблиотечный абонемент, ограниченное копирование в учебных и научных целях). Но эти режимы создавались для традиционных форм использования — выдачи, чтения, ограниченного копирования. Когда в процесс включается ИИ, который анализирует, обрабатывает и иногда воспроизводит фрагменты текста, старые правила не всегда однозначно покрывают новые сценарии. Библиотеке важно понимать, где заканчивается привычная законная деятельность и начинается зона правовой неопределённости.

Где возникают основные риски

Сценарий использования ИИ Уровень риска Почему
Чат-бот отвечает по метаданным и аннотациям Низкий Аналог справочной консультации, полного текста произведения не воспроизводит
Автоматическая генерация коротких описаний книг Низкий-средний Если описание составлено моделью самостоятельно, а не скопировано с фрагментов текста
Обучение собственной модели на полных текстах книг под охраной Высокий Требует явного разрешения правообладателя или лицензии
Чат-бот дословно цитирует крупные фрагменты текста Высокий Может выходить за рамки допустимого цитирования
Использование стороннего облачного ИИ-сервиса с передачей текстов фонда Средний-высокий Зависит от условий лицензии сервиса — куда уходят данные и как используются
Читатель рассматривает книгу у книжных полок
Авторское право защищает и печатные, и оцифрованные издания в фонде библиотеки.

Обучение моделей на текстах из фонда

Общественное достояние — самый безопасный источник

Произведения, у которых истёк срок охраны авторских прав (в России — как правило, 70 лет после смерти автора), переходят в общественное достояние и могут свободно использоваться, в том числе для обучения ИИ-моделей. Это касается значительной части классической литературы и исторических изданий в фонде — надёжный источник данных без правовых рисков.

Произведения под действующей охраной

Для книг, которые всё ещё под охраной авторского права, обучение модели на полном тексте без согласия правообладателя — прямое нарушение, даже если цель некоммерческая и модель используется только внутри библиотеки. Здесь нужна либо явная лицензия от правообладателя или издательства, либо отказ от использования таких текстов в обучающих данных.

Использование метаданных вместо полного текста

Практичный компромисс — обучать или настраивать модель не на полных текстах, а на метаданных: аннотациях, оглавлениях, ключевых словах, рецензиях. Это резко снижает правовые риски и почти всегда достаточно для задач вроде рекомендаций или поиска.

Генерация контента: аннотации, описания, ответы бота

Когда ИИ генерирует новый текст — аннотацию, краткое описание, ответ чат-бота — важно различать две ситуации.

Модель создаёт оригинальный текст на основе фактов

Если система формулирует описание книги своими словами на основе темы, жанра, ключевых фактов — это создание нового текста, а не копирование. Такой подход низкорискованный, похож на работу библиографа, который пишет собственную аннотацию.

Модель воспроизводит фрагменты оригинала

Если ответ бота или сгенерированное описание содержит дословные или почти дословные фрагменты текста произведения — это уже использование объекта авторского права, и оно должно укладываться в рамки допустимого цитирования: с указанием источника, в объёме, оправданном целью цитирования (например, иллюстрация или критический разбор), а не как замена чтения произведения.

Лицензии на готовые ИИ-сервисы

Если библиотека использует не собственную разработку, а готовый ИИ-сервис — облачную языковую модель, платформу для чат-ботов, инструмент генерации аннотаций — вопрос авторского права частично переходит в плоскость условий использования этого сервиса.

Подписание документа ручкой крупным планом
Использование ИИ-сервисов часто требует лицензионного соглашения с поставщиком технологии.

Что важно проверить в договоре с поставщиком

  • Куда уходят загруженные тексты: используются ли они для дообучения модели поставщика, или остаются изолированными для конкретного клиента
  • Кто владеет сгенерированным контентом: права на ответы бота, сгенерированные описания — библиотеки или поставщика сервиса
  • Ответственность за нарушения: что происходит, если модель сгенерировала текст, нарушающий права третьих лиц — кто отвечает
  • Возможность удаления данных: может ли библиотека полностью удалить загруженные тексты и историю обработки при прекращении договора

Пример: как разграничить риски на практике

Библиотека решает подключить ИИ-чат-бота, который помогает читателям находить книги и отвечать на справочные вопросы. Комплектатор и юрист вуза разбирают сценарий по частям. Ответы на вопросы «где найти книги по теме X» и «сколько экземпляров доступно» — используют только метаданные каталога, риска нет. Функция «покажи краткое содержание книги» реализована через генерацию нового текста моделью на основе аннотации издательства, а не копирование текста произведения — тоже низкий риск. А вот запрошенная функция «процитируй мне главу 3 полностью» отклонена на этапе проектирования: это прямое воспроизведение охраняемого текста в объёме, который выходит за рамки допустимого цитирования. В итоге бот отвечает содержательно, но не превращается в канал нелегального распространения текста.

Практические правила для библиотеки

  1. Разделяйте фонд по правовому статусу: держите отдельный список произведений в общественном достоянии — с ними можно работать свободно
  2. Не загружайте полные тексты охраняемых произведений в сторонние облачные ИИ-сервисы без явного разрешения на это в лицензии сервиса
  3. Предпочитайте работу с метаданными, а не с полными текстами, везде, где это решает задачу
  4. Фиксируйте в договоре с поставщиком ИИ-решения условия использования данных и ответственность за контент
  5. Настройте бота так, чтобы он не воспроизводил дословные крупные фрагменты — только краткие цитаты с указанием источника
  6. При сомнениях консультируйтесь с юристом — особенно для нестандартных сценариев, например использования ИИ для оцифровки редких изданий

Чек-лист правовой проверки перед внедрением ИИ

  • Определено, какие тексты фонда в общественном достоянии, а какие под охраной
  • Проверены условия лицензии стороннего ИИ-сервиса — куда уходят данные
  • Договор с поставщиком фиксирует ответственность за сгенерированный контент
  • Чат-бот настроен не воспроизводить крупные дословные фрагменты текстов
  • Для обучения собственных моделей используются метаданные, а не полные охраняемые тексты
  • Есть возможность удалить загруженные данные при прекращении работы с сервисом
  • Сложные случаи согласованы с юристом библиотеки или вуза

Типичные ошибки

Ошибка 1. Загрузка полных текстов в публичный ИИ-сервис

Проблема: сотрудники копируют текст охраняемой книги в публичный чат с ИИ, чтобы быстро получить аннотацию — не задумываясь, что текст уходит на сторонние серверы и может использоваться для дообучения модели поставщика.

Решение: используйте для таких задач метаданные и краткие отрывки, а не полный текст, либо выбирайте сервисы с явной гарантией неиспользования данных клиента для обучения.

Ошибка 2. Отсутствие разграничения в договоре с поставщиком

Проблема: библиотека подключает готовый ИИ-сервис по типовому договору, не проверяя условия об ответственности за сгенерированный контент.

Решение: перед подключением любого ИИ-сервиса запрашивайте условия использования данных отдельно, а не полагайтесь на общие условия оферты.

Ошибка 3. Игнорирование статуса общественного достояния

Проблема: библиотека одинаково осторожно (или одинаково неосторожно) относится ко всем текстам фонда, не разделяя их по правовому статусу — и теряет возможность свободно использовать значительную часть классики.

Решение: составьте и поддерживайте актуальным список изданий в общественном достоянии — это расширит возможности для ИИ-проектов без правовых рисков.

Что почитать

Частые вопросы

Нарушает ли авторское право чат-бот, который отвечает на вопросы по книгам из фонда?

Если чат-бот отвечает на основе кратких метаданных, аннотаций и общедоступной информации о книге — риска нет, это аналог справочной консультации библиотекаря. Риск возникает, если бот воспроизводит значительные фрагменты текста произведения без разрешения правообладателя — тогда это уже вопрос неправомерного копирования.

Можно ли использовать оцифрованные книги из фонда для обучения собственной ИИ-модели?

Только если это прямо разрешено лицензией на произведение или это произведения, вышедшие в общественное достояние (истёк срок охраны авторских прав). Для книг под действующей охраной обучение модели на полном тексте без согласия правообладателя — нарушение, даже если модель используется во внутренних, некоммерческих целях библиотеки.

Кто несёт ответственность, если ИИ-сервис сгенерировал текст с нарушением авторских прав?

Прямого готового ответа в российской практике пока нет — вопрос новый и активно обсуждается юристами. На практике безопаснее исходить из того, что ответственность может лечь и на библиотеку как на организацию, которая внедрила и использует сервис, поэтому важно закреплять в договоре с поставщиком ИИ-решения зону ответственности за контент, который генерирует система.

Нужно ли отдельное согласие читателей на использование ИИ-сервисов библиотеки?

Отдельное согласие на «авторское право» не требуется — читатель не является правообладателем контента. Но если сервис использует персональные данные читателя (историю выдач, вопросы в чат-боте) для персонализации, действуют требования законодательства о персональных данных — это отдельный вопрос, не связанный напрямую с авторским правом.

Внедряете ИИ-сервис и хотите быть уверены в деталях?

Мы помогаем библиотекам подключать AI-чат-бота с прозрачными условиями использования данных — без риска, что тексты фонда уйдут в чужую модель. Расскажем, как это устроено технически и юридически.

Обсудить внедрение