Документы поступали с телефона и из существующих папок, но единых правил классификации не было. Простого копирования файлов было недостаточно для поиска по содержимому.
Поиск и защита документов в Paperless-ngx
Разрозненные сканы и PDF прошли контролируемый импорт, получили полнотекстовый поиск и остались защищены от случайного удаления.
- Не раскрывать содержимое и реквизиты документов
- Сохранить исходные файлы до проверки результата импорта
- Предусмотреть восстановление документов вместе с метаданными
До
- Сканы и PDF находились в разных каталогах
- Поиск зависел от названия файла и памяти пользователя
- Удаление или сбой базы могли нарушить доступность архива
После
- Документ можно добавить с телефона и найти по содержимому
- Категории помогают сузить результат без знания имени файла
- Критичные действия ограничены ролью пользователя
Почему так: Полнотекстовый индекс решает проблему поиска, но сохраняет ценность только вместе с базой, исходными документами и понятной процедурой восстановления.
- Зафиксировано исходное состояние
- Собрана тестовая схема
- Проверены рабочий сценарий и откат
- Изменения переданы владельцу
Риски
- Плохое изображение снижает качество распознавания
- Слишком общие автоматические правила создают неверные категории
- Неполная копия восстанавливает файлы без структуры архива
Проверка
После тестового импорта проверялись поиск по содержимому, категории, ограничения ролей, корзина и открытие документов с мобильного устройства.
Восстановление
Документы, база данных, конфигурация и версия приложения включены в единый план. Проверка выполняется на отдельном экземпляре без замены рабочего архива.
Архив стал доступен через поиск и категории, при этом исходники и путь восстановления не зависят от одного рабочего экземпляра.
Разобрать похожую задачу
Архитектура всегда зависит от исходных ограничений. Начнём с безопасного описания текущего состояния.