Первичка за семь лет: где бухгалтеру держать архив, чтобы найти за минуту
Первичка копится годами: счета-фактуры, УПД, акты, накладные, банковские выписки, кассовые документы. Через пару лет это уже не папка на рабочем столе, а десятки тысяч файлов, в которых не находится нужный акт даже вами самими — не то что во время проверки, когда счёт идёт на дни. Дальше — как устроить архив первички так, чтобы он не зависел от конкретного компьютера бухгалтера и любой документ поднимался за минуту, а не за полдня раскопок.
Содержание
- Семь лет — это не «сложил в шкаф и забыл»
- Почему локальный диск и офисная «расшаренная папка» не работают на дистанции
- Как устроить архив, чтобы документ находился за минуту
- Сервер вместо диска бухгалтера: что меняется на практике
- Разворачиваем хранилище: три рабочих варианта
- Бэкап архива: сервер тоже может отказать
Семь лет — это не «сложил в шкаф и забыл»
За семь лет через бухгалтерию малого или среднего бизнеса проходят тысячи документов в год: счета, акты, УПД, товарные накладные, банковские выписки, кассовые ордера, договоры и приложения к ним. Если считать по сканам — это не сотни файлов, а десятки и сотни тысяч за весь срок хранения. И растёт архив не линейно, а вместе с бизнесом: чем больше контрагентов и оборотов, тем быстрее пухнет папка.
Рабочий комп бухгалтера для такого срока не рассчитан. Ноутбуки меняют раз в несколько лет, диски забиваются, а найти акт за позапрошлый год по имени файла «скан1 (3) — копия.pdf» физически невозможно — такие имена сканер и телефон присваивают по умолчанию, и переименовывать вручную тысячи файлов никто не успевает.
Отдельная история — налоговая или аудиторская проверка. Запрос обычно приходит не «дайте всё», а «предоставьте документы по контрагенту X за период Y» — и на ответ отводится не месяц, а несколько рабочих дней. Если архив не организован, поиск превращается в ручной перебор папок вместо минутного запроса. Дальше разберём, как построить архив, который выдерживает такой темп, и почему для этого нужен не более мощный диск, а другой подход к хранению.
Почему локальный диск и офисная «расшаренная папка» не работают на дистанции
На коротком горизонте — квартал, год — локальный диск и сетевая папка в офисе работают более-менее сносно. Проблемы вылезают именно на длинной дистанции в семь лет:
- Единая точка отказа. Диск ноутбука бухгалтера — это один физический носитель. Отказ SSD, залитый чаем ноутбук или банальная кража техники ставят под удар годы архива, если нет отдельного системного бэкапа (а «на всякий случай скопировала на флешку в прошлом году» бэкапом не является).
- Смена техники и передача дел. Бухгалтер увольняется, меняет комп, уходит в декрет — архив нужно физически перенести, и при переносе часть файлов теряется или дублируется, потому что «на всякий случай скопировали и старую, и новую версию папки».
- Поиск по имени файла упирается в дисциплину сканирования. Единообразные имена вида
2026-03-14_upd_ooo-vektor_45820.pdf— это ручная работа, которую физически невозможно поддерживать при потоке в десятки документов в день. В реальности архив забит файлами со сканера и с телефона без единой системы именования. - Офисная «расшаренная папка» не даёт доступа из дома или командировки без VPN и настройки, не хранит историю версий, не разграничивает права («ассистент не должен видеть архив за прошлые годы»), и переезд офиса или замена сервера в шкафу превращается в отдельный проект.
- Нет единой точки резервного копирования. Если архив размазан по нескольким личным компьютерам бухгалтерии, бэкапить нужно каждый из них отдельно — и на практике это не делает никто.
Итог: диск бухгалтера прекрасно справляется с текущим кварталом, но плохо подходит в роли архива на годы вперёд. Дальше — как сделать так, чтобы архив жил отдельно от конкретной рабочей машины.
Нужен сервер под эту задачу?
Разверните VPS MAATRIX за пару минут: NVMe, AMD EPYC, root-доступ, локации UK, США, Франция и РФ. Оплата картой РФ и по СБП.
Арендовать серверКак устроить архив, чтобы документ находился за минуту
Прежде чем переносить архив на сервер, стоит навести порядок в структуре — иначе вы просто перенесёте тот же хаос в новое место. Рабочая схема, которая закрывает и разбор по годам (для проверок, которые обычно идут по периодам), и разбор по контрагентам (для сверок):
/arhiv
/2024
/ooo-vektor
/schet-faktury
/akty
/upd
/bank-vypiski
/ip-ivanov
/dogovory
/akty
/2025
...
/2026
...
Внутри года — папка на каждого контрагента, внутри контрагента — подпапки по типу документа. Такая структура закрывает оба типичных запроса при проверке: «дайте всё по контрагенту X» и «дайте документы за период Y» (год виден сразу на верхнем уровне).
Имена файлов внутри папок можно упростить, раз структура папок уже несёт основную нагрузку: 2026-03-14_upd_45820.pdf — дата, тип, номер документа. Дата в формате ГГГГ-ММ-ДД в начале имени даёт сортировку по хронологии без дополнительных усилий — файловый менеджер и веб-интерфейс хранилища отсортируют список по алфавиту, и он совпадёт с хронологией.
Но одной структуры папок недостаточно, если документ нужно найти не по номеру, а по содержанию — например, вспомнить, в каком акте упоминалась конкретная позиция или сумма. Здесь помогает то, что сканы — это в первую очередь изображения, а не текст, и обычный поиск по названию файла содержимое не видит. Решение — прогонять сканы через OCR и сохранять как «распознаваемый» PDF (с текстовым слоем поверх картинки), тогда поиск по содержимому начинает работать как в обычном текстовом документе:
# распознать один документ, сохранить с текстовым слоем
ocrmypdf --language rus vhodящий_scan.pdf 2026-03-14_upd_45820.pdf
# прогнать пакетом все pdf в папке года, пропуская уже распознанные
find /arhiv/2026 -name "*.pdf" -exec ocrmypdf --skip-text --language rus {} {} \;
После этого документ находится по фрагменту текста внутри — названию товара, номеру договора, фамилии — а не только по имени файла. Дальше — почему для такого архива правильное место не рабочий комп, а отдельный сервер.
Сервер вместо диска бухгалтера: что меняется на практике
Перенос архива с личного диска на сервер решает сразу несколько проблем из раздела выше, причём не по отдельности, а системно:
- Архив не привязан к конкретной машине. Бухгалтер меняет ноутбук, уходит на удалёнку или в отпуск — доступ к архиву не теряется, потому что он не хранится локально, а открывается по логину с любого устройства.
- Общий доступ без пересылки файлов почтой. Аудитору, бухгалтеру на аутсорсе или руководителю можно выдать доступ к нужным папкам напрямую, вместо того чтобы собирать документы вручную и отправлять архивом на 200 мегабайт по почте.
- Разграничение прав по ролям. Ассистенту — доступ только к текущему году, главному бухгалтеру — ко всему архиву, внешнему аудитору на время проверки — временный доступ к конкретной папке контрагента.
- Одна точка бэкапа вместо нескольких. Резервное копирование сервера настраивается один раз и работает автоматически, а не зависит от того, вспомнил ли конкретный сотрудник скопировать файлы на флешку.
Отдельный практический плюс: конкретные требования к срокам хранения документов у разных видов первички отличаются и меняются — точную цифру по каждому виду документа лучше сверять с действующим законодательством и с аудитором компании, здесь мы не будем на них гадать. Но сам принцип не завязан на цифру: если архив организован на сервере с понятной структурой по годам, требование «храните семь лет» (как в заголовке этой статьи) или любой другой срок реализуется одинаково — документы просто не удаляются раньше срока и лежат в понятной годовой папке, а не расползаются по личным дискам сотрудников. Подробнее про сроки хранения бухгалтерских данных — в отдельном материале: сроки хранения бухгалтерских данных.
Разворачиваем хранилище: три рабочих варианта
Для архива первички не нужна сложная инфраструктура — достаточно веб-интерфейса с папками, поиском и разграничением прав. Три варианта, которые реально работают для такой задачи:
| Вариант | Что даёт | Кому подходит |
|---|---|---|
| Nextcloud | Папки и файлы как в проводнике, доступ через браузер и приложение на телефоне, права по пользователям и группам, версии файлов | Бухгалтерии, которым важен привычный интерфейс «папка → файл», в том числе для нетехнических сотрудников |
| Seafile | Похоже на Nextcloud, но легче по нагрузке на сервер и быстрее синхронизирует большие библиотеки файлов | Архивы с большим количеством файлов на ограниченных ресурсах сервера |
| S3-совместимое хранилище (MinIO) | Хранилище «объект — ключ» без файлового интерфейса, зато удобно подключается скриптами и выгрузками из учётных систем | Автоматическую выгрузку сканов из 1С или другой системы напрямую в архив без ручного перекладывания файлов |
Для большинства бухгалтерий, где с архивом работают руками — открыл папку, нашёл файл, скачал — практичнее всего Nextcloud: интерфейс привычный, поиск по названию и содержимому есть из коробки, права доступа настраиваются по пользователям и группам.
Минимальный docker-compose.yml для разворачивания (полный пошаговый разбор — в отдельной статье установка Nextcloud на Ubuntu 24.04):
version: "3"
services:
nextcloud:
image: nextcloud
restart: unless-stopped
ports:
- "8080:80"
volumes:
- nc_data:/var/www/html
- /srv/arhiv:/var/www/html/data/buhgalter/files/Arhiv
environment:
- MYSQL_HOST=db
- MYSQL_DATABASE=nextcloud
- MYSQL_USER=nextcloud
- MYSQL_PASSWORD=change-me
depends_on:
- db
db:
image: mariadb
restart: unless-stopped
volumes:
- db_data:/var/lib/mysql
environment:
- MYSQL_ROOT_PASSWORD=change-me-too
- MYSQL_DATABASE=nextcloud
- MYSQL_USER=nextcloud
- MYSQL_PASSWORD=change-me
volumes:
nc_data:
db_data:
Папку /srv/arhiv с уже готовой структурой по годам и контрагентам монтируем прямо в каталог пользователя — так существующий архив не нужно заново загружать через интерфейс, он сразу появляется в веб-версии.
Если параллельно нужна выгрузка сканов напрямую из учётной системы или скрипта без участия человека — рядом стоит поднять S3-совместимое хранилище: S3-совместимое хранилище у себя на сервере. Оно не заменяет Nextcloud с папками, а закрывает автоматическую часть — например, когда сканер-МФУ или скрипт выгрузки из 1С кладёт файл сразу в хранилище по расписанию.
Бэкап архива: сервер тоже может отказать
Перенос архива на сервер снимает риск «сгорел ноутбук бухгалтера», но не отменяет резервное копирование — сервер тоже физическое оборудование, и диск на нём может выйти из строя точно так же, как на ноутбуке. Разница в том, что бэкап сервера настраивается один раз и дальше работает без участия человека, а не зависит от того, вспомнил ли кто-то скопировать файлы на флешку.
Практический принцип — хранить не одну копию архива, а минимум две, причём одну не на том же сервере, где лежит рабочий архив: если сломается диск основного сервера, копия на другой площадке остаётся доступной. Пример автоматического бэкапа через restic по расписанию:
# /etc/cron.d/arhiv-backup — каждую ночь в 3:00
0 3 * * * root restic -r /mnt/backup-remote backup /srv/arhiv --password-file /etc/restic-pass
# раз в неделю чистим старые снапшоты, оставляя ежедневные за последний месяц
0 4 * * 0 root restic -r /mnt/backup-remote forget --keep-daily 30 --prune
/mnt/backup-remote здесь — смонтированное хранилище на отдельном сервере или в отдельном дата-центре, а не вторая папка на том же диске. Подробный разбор, какой сервер и конфигурация нужны конкретно под бэкапы и архивы (объём диска, канал, куда складывать копии) — в отдельной статье: VPS для бэкапов и архива: что выбрать и как настроить.
Нужен сервер под эту задачу?
Разверните VPS MAATRIX за пару минут: NVMe, AMD EPYC, root-доступ, локации UK, США, Франция и РФ. Оплата картой РФ и по СБП.
Арендовать серверНужны сами нейросети для контента?
Генерируйте изображения, видео и озвучку нейросетями на falapi.io — десятки моделей в одном окне. Оплата картой РФ и по СБП.
Частые вопросы
Нужно ли хранить бумажные оригиналы, если документ уже отсканирован и лежит в архиве на сервере?
Зависит от вида документа и требований, которые к нему применимы — единого правила «скан заменяет бумагу для всего» нет. Этот вопрос лучше сверять отдельно с аудитором или бухгалтерским регламентом компании, а не решать по умолчанию.
Можно ли удалять документы, когда установленный для них срок хранения истёк?
Технически архив на сервере это позволяет — например, удалить или перенести в холодное хранилище папку конкретного года. Но перед удалением стоит убедиться, что срок для этого конкретного вида документа действительно истёк: он не одинаков для всей первички, и разбираться в этом лучше с бухгалтером или аудитором, а не по общей цифре из заголовка статьи.
В старом архиве годами царил беспорядок — с чего начать наведение порядка?
Не пытайтесь реструктурировать всё сразу. Начните с последнего актуального года — он нужнее всего прямо сейчас — разложите его по схеме «год → контрагент → тип документа», прогоните через OCR, и только потом постепенно разбирайте предыдущие годы, пока действующий процесс уже работает на новой структуре.
Сколько места на сервере закладывать под архив бухгалтерии?
Точную цифру заранее не назвать — она зависит от количества документов и от того, сканируете вы в чёрно-белом режиме с сжатием или цветные сканы в высоком разрешении. Как ориентир: скан одной страницы после OCR обычно занимает от нескольких сотен килобайт до пары мегабайт, и это стоит один раз прикинуть на собственном потоке документов за месяц, а не полагаться на чужие цифры.
Что делать, если в бухгалтерии несколько человек и нужен разный доступ к архиву?
В Nextcloud это решается группами пользователей: создаётся группа на каждую роль (главбух, ассистент, внешний аудитор) и права выдаются на уровне папки — например, ассистенту открывается только текущий год, а не весь архив за семь лет.
Обсудить статью, задать вопрос или начать новую тему
Есть вопрос по этой статье, идея для обсуждения или просто хотите поделиться опытом? Сообщество MAATRIX ждёт. Для общения, пожалуйста, зарегистрируйтесь в нашем личном кабинете.
Перейти в сообщество →