Повреждённый PDF восстанавливают только из копии. Сначала сохраните проблемный файл как отдельный образец, продублируйте его ещё раз и работайте с дубликатом. Не нажимайте «Сохранить» поверх единственного экземпляра: неудачный повторный экспорт, автоматическая оптимизация или синхронизация облака способны заменить последние читаемые байты новой, но уже бесполезной версией.
Результат зависит от характера сбоя. Если загрузка оборвалась, лучший способ — получить файл заново из того же источника. Если один просмотрщик выдаёт ошибку, а другой показывает страницы, можно извлечь читаемое содержимое и пересобрать новый документ. Если уничтожены потоки страниц, шрифты или изображения, ни одна программа не обязана вернуть их из отсутствующих данных. Задача состоит не в обещании «починить любой PDF», а в том, чтобы определить сохранные части, выбрать безопасный метод и проверить новую копию.
Что сделать до восстановления: зафиксировать исходное состояние
Создайте рабочую папку и поместите в неё три объекта: нетронутую копию повреждённого файла, рабочий дубликат и текстовый журнал. Например: report_damaged_original.pdf, report_working_copy.pdf и recovery-notes.txt. В журнал запишите дату получения, источник, размер в байтах, сообщение об ошибке, программу и устройство, на котором оно появилось. Такая фиксация нужна не для формальности: по размеру и источнику часто сразу видно, что файл не повреждён внутри, а просто недокачан.
Если PDF пришёл по почте, не редактируйте вложение прямо из временной папки почтового клиента. Нажмите «Скачать», выберите обычную локальную папку и сравните размер с указанным в письме или на сервере. Для файла из мессенджера запросите отправку как документа, а не как превью. Для загрузки с сайта повторите скачивание в другом браузере или через другую сеть. Если две независимые загрузки имеют разный размер, чинить меньшую копию бессмысленно: сначала нужно получить полный объект.
Минимальный журнал диагностики
| Что записать | Зачем | Признак проблемы |
|---|---|---|
| Имя и расширение | Исключить маскировку другого формата | Файл называется PDF, но сигнатура не начинается с %PDF- |
| Размер в байтах | Сравнить копии без округления проводника | Новая загрузка заметно больше старой |
| Источник | Понять, можно ли повторить экспорт | Есть исходный DOCX, XLSX, макет или скан-проект |
| Точная ошибка | Отделить повреждение от пароля и запрета доступа | «Access denied» — не то же самое, что «file is damaged» |
| Число ожидаемых страниц | Проверить полноту результата | Просмотрщик показывает 18 страниц вместо ожидаемых 32 |
| Контрольная сумма | Убедиться, что копия не меняется во время опытов | SHA-256 изменился без осознанного сохранения |

Сфотографируйте или сохраните скриншот ошибки, затем закройте программу. Не запускайте подряд десятки «ремонтов» над одним и тем же экземпляром. Некоторые утилиты записывают служебные изменения рядом с исходником, а облачная синхронизация может распространить перезаписанный файл на другие устройства.
Как сделать копию без случайной перезаписи
- В Проводнике Windows или Finder выделите файл и скопируйте его в новую папку.
- Добавьте к имени суффикс
_working-copy. - Для исходной копии включите атрибут «Только чтение» в Windows либо поместите её в архив ZIP без последующего редактирования.
- Проверьте, что рабочая и исходная копии имеют одинаковый размер и SHA-256.
- Все результаты сохраняйте как
_rebuilt-01.pdf,_rebuilt-02.pdfи так далее.
Контрольную сумму в Windows можно получить командой certutil -hashfile "report_damaged_original.pdf" SHA256, в macOS — shasum -a 256 report_damaged_original.pdf, в Linux — sha256sum report_damaged_original.pdf. Хеш не показывает, исправен ли PDF; он подтверждает только побайтовую неизменность конкретной копии.
Диагностика: повреждён файл или неправильно работает просмотрщик
Ошибка открытия сама по себе не доказывает разрушение структуры. Один и тот же симптом появляется при неполной загрузке, неправильном расширении, нулевом файле-заглушке, блокировке антивирусом, отсутствии прав, ошибке сетевого диска, повреждённой установке просмотрщика и несовместимом PDF. Поэтому диагностику выполняют от простого к сложному, не меняя содержимое.
- Проверьте размер. Ноль байт или несколько килобайт у многостраничного отчёта почти всегда означают, что нужных данных в копии нет.
- Переместите файл локально. Скопируйте его с флешки, сетевого диска, облачной папки или вложения на внутренний диск. Открытие из временного каталога не подходит для проверки.
- Сократите путь. Используйте папку вроде
C:\PDF-Test\и простое имя латиницей. Это исключает проблемы старых приложений с длинными путями и символами. - Откройте другой заведомо исправный PDF. Если не открывается и он, сначала обновите или восстановите просмотрщик.
- Проверьте рабочую копию в другом движке. Попробуйте встроенный просмотрщик браузера, системный просмотрщик и настольный PDF-редактор. Не сохраняйте файл на этом этапе.
- Сравните поведение. Если второй движок показывает все страницы, структура частично читаема. Если показывает только начало, вероятно, утеряна хвостовая часть или часть дерева страниц.

Сообщение «The file is damaged and could not be repaired» означает, что конкретный движок не смог разобрать объект. Оно не указывает, какие байты утрачены, и не гарантирует, что другой анализатор получит тот же результат. Однако если одинаковая ошибка повторяется в нескольких независимых программах и после новой загрузки, вероятность структурного повреждения возрастает.

Проверьте, действительно ли это PDF
Расширение .pdf — часть имени, а не доказательство формата. Откройте копию в шестнадцатеричном просмотрщике или выполните команду file report_working_copy.pdf в macOS/Linux. У обычного PDF в начале встречается заголовок вида %PDF-1.4, %PDF-1.7 или %PDF-2.0. Перед заголовком иногда есть небольшое количество посторонних байтов, которые терпят некоторые просмотрщики, но правильный экспорт обычно помещает сигнатуру в начале.
Если вместо сигнатуры видны <html, текст страницы входа, JSON-ответ, ZIP-заголовок или пустое содержимое, перед вами не повреждённый PDF, а неверно сохранённый ответ сервера либо другой формат с ошибочным расширением. Переименование не преобразует данные. Вернитесь к источнику и скачайте настоящий документ.
Проверьте конец файла
Классический PDF обычно содержит маркер %%EOF ближе к концу и значение startxref, которое указывает на таблицу или поток перекрёстных ссылок. Отсутствие последних килобайт после оборванной загрузки часто уничтожает startxref, трейлер и сведения о корневом объекте. Некоторые программы реконструируют ссылки сканированием объектов, но они не могут восстановить поток страницы, которого физически нет.
Наличие %%EOF тоже не гарантирует исправность: PDF поддерживает инкрементальные сохранения, поэтому в файле может быть несколько секций и несколько маркеров конца. Последняя секция может быть повреждена, а предыдущая — ещё пригодна. Это одна из причин, почему специализированный анализатор иногда открывает более раннее состояние документа.
Как устроено повреждение PDF: страницы, объекты и кросс-таблица
PDF — не последовательность готовых изображений страниц. Документ состоит из пронумерованных объектов: словарей, массивов, потоков, шрифтов, изображений, аннотаций, форм и служебных структур. Страница обычно ссылается на ресурсы и один или несколько потоков команд рисования. Каталог документа ведёт к дереву страниц, а таблица перекрёстных ссылок — к физическим позициям объектов в файле.
В старых вариантах используется текстовая таблица xref; в PDF 1.5 и новее могут применяться потоки перекрёстных ссылок и объектные потоки. Значение после startxref должно привести читатель к актуальной секции. При неверном смещении просмотрщик ищет объекты эвристически. Если он находит каталог и дерево страниц, документ может открыться после предупреждения. Если корневой объект или узлы дерева отсутствуют, отдельные потоки всё ещё могут существовать, но автоматическая сборка становится существенно сложнее.
Что реально может сохраниться
- Целые страницы. Лучший случай: нарушена служебная таблица, а страничные объекты и ресурсы целы.
- Только часть страниц. Дерево содержит ссылки на повреждённые или отсутствующие объекты; извлекают читаемые диапазоны.
- Изображения без текста. В скане уцелели растровые потоки, но потеряны привязки или текстовый слой OCR.
- Текст без оформления. Из потоков удаётся извлечь символы, но шрифты, координаты и порядок чтения восстановлены неполно.
- Предыдущее инкрементальное состояние. Последнее сохранение повреждено, но более ранняя секция ещё читается.
- Ничего полезного. Файл обрезан до нескольких килобайт, зашифрован без пароля или нужные потоки перезаписаны.
Почему повторный экспорт помогает
Когда программа способна отрисовать страницу, она уже разобрала достаточную часть объектов. Экспорт выбранных страниц или печать в новый PDF создаёт другой контейнер: новая таблица ссылок, новый каталог и новое дерево страниц. При этом могут потеряться интерактивные элементы, подписи, вложения, слои, закладки, теги доступности и исходная семантика. Поэтому повторный экспорт — метод спасения видимого содержания, а не безусловное восстановление всех функций исходного документа.
Определите тип исходника до выбора способа
| Тип PDF | Что проверять | Главный риск при пересборке |
|---|---|---|
| Текстовый PDF | Выделение, поиск, порядок чтения, встроенные шрифты | Текст превратится в изображение или потеряет кодировку |
| Скан | Резкость, разрешение, поворот, цвет, наличие OCR-слоя | Повторное JPEG-сжатие ухудшит мелкий текст |
| Защищённый паролем | Требуется ли пароль на открытие, известен ли он владельцу | Пароль ошибочно принимают за повреждение; обход защиты не является ремонтом |
| Подписанный PDF | Панель подписей, сертификат, целостность подписанной версии | Любая пересборка изменит байты и сделает прежнюю подпись недействительной |
| PDF-форма | Поля, расчёты, кнопки, JavaScript, отправка данных | Печать или растрирование сплющит поля и удалит логику |
| PDF с вложениями и слоями | Панели Attachments и Layers, скрытые состояния | Новая копия может сохранить только видимый слой |
| PDF/A или PDF/UA | Профиль соответствия, теги, метаданные, шрифты | Обычный экспорт снимает профиль архивности или доступности |
Для подписанного документа сначала сохраните исходную повреждённую копию как доказательство состояния. Восстановленный вариант маркируйте как производную копию. Он может быть пригоден для чтения, но не заменяет юридически значимый подписанный оригинал. Для формы отдельно решите, что важнее: внешний вид заполненных полей или сохранение редактируемых полей. Одновременно гарантировать оба свойства после серьёзного повреждения удаётся не всегда.
Способ 1. PDF Commander: извлечь читаемые страницы и собрать новую копию
PDF Commander используют не как «магическую кнопку ремонта», а как редактор для безопасного спасения того, что программа смогла открыть. Рабочий сценарий состоит из четырёх частей: импорт копии, проверка миниатюр, извлечение или перестановка читаемых страниц, сохранение нового файла. Если копия вообще не открывается, переходите к специализированному анализатору или повторному скачиванию; не приписывайте редактору несуществующую команду исправления структуры.
Шаг 1. Откройте только рабочий дубликат
- Запустите PDF Commander.
- В стартовом окне нажмите Открыть PDF.
- Перейдите в подготовленную рабочую папку.
- Выберите файл с суффиксом
_working-copy. - Нажмите Открыть и дождитесь построения первой страницы.


Если окно зависло, не завершайте процесс мгновенно: большой скан может строить миниатюры заметно дольше обычного. Но если приложение стабильно закрывается на одной и той же копии, зафиксируйте это и не повторяйте попытку поверх исходника. Проверьте файл другим движком.
Шаг 2. Проверьте карту страниц
Откройте вкладку Страницы. Просмотрите миниатюры сверху вниз и составьте диапазоны: например, 1–7 читаются, 8 пустая, 9–13 читаются, 14 не строится, 15–22 читаются. Не ориентируйтесь только на миниатюру: откройте подозрительную страницу в основном окне, увеличьте масштаб и проверьте текст, изображения и края.

У сканов проверяйте, не заменена ли страница серым прямоугольником и не обрезана ли часть изображения. У текстового документа попробуйте выделить строку и выполнить поиск по слову, которое точно присутствует. Если картинка видна, но поиск не работает, возможно, утрачен только текстовый слой; это не делает страницу пустой.
Шаг 3. Исправьте порядок и ориентацию только у читаемых страниц
Выделите перевёрнутую страницу и используйте кнопки поворота. Для восстановления последовательности перетащите миниатюру в нужное место. Сверяйтесь с печатной нумерацией внутри документа, а не только с номером миниатюры: обложка, титульный лист и ненумерованные вставки могут сдвигать счёт.


Если два объекта отображают одну и ту же страницу, сравните их при увеличении и удалите дубликат только из новой сборки. Пустой объект не удаляйте автоматически: он может быть намеренно вставленной оборотной стороной, разделителем главы или частью разворота. Проверяйте соседние номера и содержание.

Шаг 4. Соберите документ из нескольких уцелевших частей
Если одна копия открывает начало, а другая — конец, сохраните их отдельно и объедините в новом проекте. Используйте добавление файлов или страниц. После вставки сразу проверьте границу: последнюю страницу первой части и первую страницу второй. Частые ошибки — повтор одного листа, пропуск страницы и неверная ориентация.


Шаг 5. Восстановите навигацию после окончательной перестановки
Откройте панель закладок. Старые закладки могут ссылаться на неверные позиции, если страницы удалялись или добавлялись. Сначала завершите состав документа, затем переименуйте и перепривяжите закладки. Нажмите каждую закладку и убедитесь, что открывается правильный раздел.


Шаг 6. Сохраните новую копию и закройте программу
Выберите Файл → Сохранить как либо команду сохранения, которая позволяет задать новое имя. Используйте имя вроде report_rebuilt-01.pdf и другую папку. Не заменяйте report_damaged_original.pdf. После сохранения закройте документ и программу: контрольное открытие должно происходить с диска, а не из внутреннего кэша редактора.



Если страница отображается, но целиком не сохраняется
Перейдите к конвертации и извлеките доступное содержимое. Для скана разумно сохранить страницы как изображения без лишнего снижения разрешения, затем собрать из них новый PDF. Для текстового документа можно попробовать текстовый или HTML-экспорт, но форматирование потребует проверки. Это аварийный путь: он сохраняет информацию, а не исходную структуру.


Ограничения способа
- Редактор не восстановит отсутствующие байты неполной загрузки.
- Повторная сборка может изменить метаданные, идентификаторы, закладки и внутренние ссылки.
- Цифровая подпись исходника не переносится как действующая подпись новой копии.
- Экспорт страниц изображениями убирает поиск и выделение, если затем не выполнить отдельное OCR.
- Сложные формы, вложения, видео и слои требуют отдельной проверки.
Способ 2. DataNumen PDF Repair: реконструировать служебные ссылки
DataNumen PDF Repair предназначен для файлов, которые не открываются обычным редактором. Программа принимает исходный PDF и создаёт отдельный выходной файл. Это соответствует безопасной схеме, но путь назначения всё равно нужно проверить вручную, чтобы результат не совпал с исходником.
- Закройте Acrobat, браузеры и другие приложения, которые могут держать копию открытой.
- Запустите DataNumen PDF Repair.
- В поле исходного файла выберите
report_working_copy.pdf. - В поле результата задайте
report_datanumen_fixed.pdfв отдельной папке. - Запустите восстановление кнопкой Start Repair или Восстановить — название зависит от языка интерфейса.
- Дождитесь завершения и сохраните журнал программы, если он доступен.

Не меняйте настройки пакетного режима без необходимости. Для одного важного файла лучше выполнить один контролируемый прогон, проверить результат и только затем пробовать другой вариант. Пакетная обработка удобна для множества копий, но усложняет сопоставление предупреждений конкретным документам.

Окно об успешном завершении означает, что приложение записало выходной PDF, а не то, что восстановлены все страницы и функции. Сравните число страниц, откройте начало, середину и конец, проверьте изображения, шрифты и поиск. Если результат меньше исходника, это может быть нормальным удалением мусорных объектов, но также признаком потери страниц.
Когда способ прекращать
Если результат открывается, но страницы пустые или повторяются, не запускайте восстановление поверх него. Сохраните этот вариант как отдельный эксперимент и попробуйте извлечение диапазонов другим движком. Если демонстрационная версия показывает только предварительный результат и не сохраняет файл, не утверждайте, что данные уже восстановлены: оцените превью и ограничения лицензии до оплаты.
Способ 3. PDF2Go: попробовать онлайн-восстановление неконфиденциальной копии
Онлайн-сервис удобен, когда нельзя установить программу, но он передаёт документ на чужой сервер. Не загружайте договоры, паспорта, медицинские сведения, закрытую отчётность, персональные данные, коммерческие тайны и файлы с действующими сертификатами без разрешения владельца и организации. Для чувствительных документов используйте локальные методы.
- Откройте инструмент восстановления PDF2Go.
- Нажмите Выбрать файл или перетащите рабочую копию в область загрузки.
- Убедитесь, что загружается правильное имя и ожидаемый размер.
- Нажмите Начать. У этой функции нет обязательных дополнительных настроек.
- После обработки скачайте результат под новым именем.
- Удалите локальные временные копии из папки загрузок только после проверки.


Если сервис сообщает об ошибке до начала обработки, проверьте лимит размера, стабильность соединения и то, что файл действительно PDF. Повторная отправка одного и того же обрезанного файла не добавит отсутствующие данные. Если страница результата открылась, но скачанный документ снова повреждён, сравните размер загрузки и результата и попробуйте локальный анализ.
После скачивания отключите интернет не требуется; важнее открыть файл локально в двух программах. Браузер может показывать собственное онлайн-превью и скрывать ошибку, поэтому сохраните результат на диск и проверьте его отдельно.
Способ 4. OnlineFile.Repair: восстановить копию через пошаговый веб-мастер
OnlineFile.Repair работает по схеме выбора файла, анализа и получения результата. Правила конфиденциальности те же: серверная обработка подходит только для документа, который разрешено передавать третьей стороне.
- Перейдите к форме ремонта PDF.
- Нажмите кнопку выбора или перетащите
_working-copy.pdfв выделенную область. - Дождитесь окончания загрузки; не переключайте сеть и не закрывайте вкладку.
- Запустите анализ.
- Просмотрите сведения о найденном содержимом и условиях скачивания.
- Сохраните результат в отдельную папку, затем переименуйте его осмысленно.


Не считайте предварительный просмотр доказательством полной целостности. Веб-мастер может показать одну страницу, миниатюру или оценку возможности восстановления. Нужна локальная проверка всего файла. Если сервис предлагает только платное скачивание, сравните число найденных страниц с ожиданием до оплаты и не удаляйте остальные варианты.
При медленной загрузке проверьте, не отправляете ли вы гигантский скан через мобильную сеть. Но не сжимайте повреждённый исходник перед ремонтом: сжатие требует успешного чтения и может создать ещё одну неполную копию. Сначала восстановление, затем оптимизация результата.
Способ 5. Recovery Toolbox for PDF: настольный и онлайн-сценарии
Настольная версия подходит для локального процесса, онлайн-версия — для разрешённых к загрузке документов. Не смешивайте результаты: давайте каждому выходному файлу отдельное имя, например _toolbox-desktop.pdf и _toolbox-online.pdf.
Настольная версия
- Запустите Recovery Toolbox for PDF.
- В поле Source file name (.pdf) укажите рабочую копию.
- Нажмите Next.
- Выберите путь и параметры сохранения, которые предлагает мастер.
- Не указывайте исходный файл как выходной.
- После завершения закройте мастер и откройте результат независимо.

Онлайн-версия
Загрузите разрешённую копию и дождитесь 100 процентов. Затем проверьте карточку результата: имя исходного файла, размер восстановленной копии, заявленное число страниц и доступность предварительного просмотра. Значительное уменьшение размера может означать удаление повреждённых объектов, но также и потерю ресурсов.


Сравнивайте настольный и онлайн-результаты постранично. Один движок может лучше восстановить дерево страниц, другой — извлечь больше потоков. Не объединяйте версии автоматически: сначала определите, какие диапазоны в каждой из них действительно полны, затем соберите окончательный PDF из лучших частей.
Как выбрать лучший результат
- Совпадает ожидаемое число страниц.
- Нет пустых миниатюр и повторов.
- Начало и конец каждого раздела логичны.
- Текст ищется и копируется без «кракозябр».
- Изображения не заменены чёрными или серыми блоками.
- Файл повторно открывается после закрытия программы.
Способ 6. Повторная загрузка, другой движок и предыдущая версия
Самый качественный «ремонт» нередко состоит в том, чтобы не чинить повреждённую копию. Если доступен исходный файл, сервер, отправитель, облачная история или резервная версия, восстановите полноценные данные оттуда. Этот путь сохраняет текст, шрифты, формы и подписи лучше, чем растрирование страниц.
Повторная загрузка
- Сохраните текущую копию и её размер.
- Очистите только незавершённую загрузку браузера с расширением вроде
.crdownloadили.part; исходный PDF не удаляйте. - Скачайте файл снова в новую папку.
- Сравните точный размер и SHA-256.
- Откройте новую копию локально.
- Если размеры снова различаются, сообщите владельцу сайта или отправителю.
Другой движок без сохранения
Откройте копию в системном просмотрщике или браузере. Если страницы видны, сначала пролистайте весь документ и отметьте диапазоны. Не нажимайте «Сохранить» автоматически: некоторые программы переписывают структуру сразу после открытия. Используйте экспорт в новый файл только после проверки.

Сообщение Acrobat с рекомендацией создать документ заново из исходной программы отражает важное ограничение: если доступен DOCX, XLSX, презентация, издательский макет, CAD-чертёж или набор сканов, повторный экспорт обычно надёжнее реконструкции. Откройте исходник в родном приложении и выполните экспорт в PDF под новым именем. Затем сравните страницы с повреждённой копией, потому что исходник мог быть более ранней редакцией.
Проверьте приложение, а не только файл
Откройте другой исправный PDF. Если он тоже не работает, обновите Acrobat через Help → Check for updates. В Windows доступна команда Help → Repair Installation. Ремонт установки исправляет компоненты программы, но не изменяет повреждённый документ. После ремонта снова проверьте копию.
Предыдущие версии Windows
История файлов работает только если резервное копирование было настроено заранее. В Проводнике откройте папку, где лежал PDF, щёлкните её правой кнопкой мыши и выберите восстановление предыдущих версий. Сначала используйте Открыть или Восстановить в…, чтобы извлечь копию в другое место. Команда обычного восстановления может заменить текущую версию.

Для OneDrive, SharePoint и других систем с историей версий откройте веб-интерфейс хранилища, найдите историю и скачайте нужную редакцию отдельно. Не полагайтесь на дату единственного локального файла: синхронизация могла уже распространить повреждение, тогда полезна серверная версия до инцидента.
macOS и резервные копии
Если настроена Time Machine, откройте папку с документом, войдите в Time Machine и выберите дату до повреждения. Восстановите файл под другим именем или в отдельную папку. Если PDF был создан приложением, которое хранит собственную историю, сначала экспортируйте нужную версию из него, а не переписывайте текущий файл.
Проверка и пересборка структуры через qpdf
qpdf — инструмент командной строки для структурных преобразований PDF. Он не является просмотрщиком и не понимает смысл графики на странице, зато умеет читать объекты, проверять синтаксис, показывать кросс-ссылки и переписывать файл с новой структурой. Работайте только с копией и всегда задавайте отдельный выходной файл.
Проверка без записи
qpdf --check report_working_copy.pdf Код завершения 0 означает, что qpdf не обнаружил синтаксических ошибок; это не доказывает корректность каждого потока изображения или смысловую полноту страниц. Код 3 соответствует предупреждениям, код 2 — ошибкам. Сохраните весь вывод в журнал:
qpdf --check report_working_copy.pdf > qpdf-check.txt 2>&1 Посмотреть перекрёстные ссылки
qpdf --show-xref report_working_copy.pdf > qpdf-xref.txt Если qpdf реконструировал таблицу, вывод покажет восстановленные сведения. Команда полезна для диагностики, но не требует ручного редактирования смещений. Не меняйте числа в бинарном PDF обычным текстовым редактором: любое добавление байтов снова делает смещения неверными.
Переписать файл
qpdf report_working_copy.pdf report_qpdf_rebuilt.pdf Без дополнительных преобразований qpdf читает входной файл и записывает функционально эквивалентный выход, структурно реорганизуя его и удаляя потерянные объекты. При чтении повреждённого файла программа по умолчанию пытается реконструировать кросс-таблицу. Если чтение завершилось, проверьте новый файл. Не используйте --replace-input: в восстановлении важно сохранить исходную копию.
Извлечь читаемые страницы в новый контейнер
qpdf --empty --pages report_qpdf_rebuilt.pdf 1-7,9-13,15-z -- report_pages_rescued.pdf Диапазон задавайте только после того, как узнали фактическое число страниц и отметили повреждённые позиции. Буква z обозначает последнюю страницу. Если команда падает на конкретном диапазоне, делите его пополам: так можно локализовать проблемную страницу, не перебирая каждый номер вручную.
Что qpdf не делает
- не восстанавливает отсутствующий растровый поток;
- не выполняет OCR;
- не гарантирует сохранение действительности подписи после перезаписи;
- не исправляет смысловой порядок текста;
- не заменяет визуальную проверку.
Повторный экспорт через LibreOffice Draw
LibreOffice Draw способен открыть некоторые PDF как набор редактируемых страниц. Метод полезен, если документ открывается частично и нужно сохранить видимое содержимое в новый контейнер. Но импорт PDF в Draw не равен полноценному восстановлению: текст может разбиться на множество объектов, сложные шрифты замениться, формы стать обычной графикой.
- Создайте копию и откройте LibreOffice Draw.
- Выберите Файл → Открыть и укажите рабочий PDF.
- Дождитесь импорта всех доступных страниц.
- Просмотрите миниатюры и удалите только явно повреждённые или дублированные страницы из новой версии.
- Проверьте текстовые блоки, изображения и повороты.
- Выберите Файл → Экспортировать как → Экспортировать как PDF.
- На вкладке «Общие» задайте диапазон страниц. Для сканов используйте без потерь либо высокое качество и не снижайте разрешение без необходимости.
- Сохраните как
report_draw_export.pdf.
В окне экспорта можно указать страницы в виде диапазона и отдельных номеров. После экспорта проверьте закладки, ссылки, комментарии и формы: часть функций могла не перенестись. Если исходник был PDF/A, новый файл не следует автоматически считать соответствующим тому же профилю, пока валидатор не подтвердит это.
Как локализовать повреждённую страницу
Когда файл открывается, но экспорт целиком завершается ошибкой, используйте деление диапазона пополам. Для 100 страниц сначала экспортируйте 1–50 и 51–100. Если ошибка во второй половине, проверяйте 51–75 и 76–100. Через несколько итераций останется конкретная страница или небольшой диапазон. Такой двоичный поиск быстрее последовательного перебора.
- Создайте таблицу диапазонов и результатов.
- Каждый удачный диапазон сохраняйте отдельным PDF.
- Не включайте в название слово «финал», пока не выполнена полная проверка.
- Проблемную страницу попробуйте вывести как изображение из другого движка.
- Если она не отображается нигде, запросите страницу у источника или отметьте пропуск.
- Объедините успешные диапазоны в правильном порядке.
Если сбой связан с общей таблицей ссылок, даже маленький диапазон может не экспортироваться до структурной переписи qpdf или специализированной утилитой. Если сбой находится в потоке одной страницы, остальные диапазоны часто сохраняются независимо.
Особые случаи: пароль, подпись, форма, скан и вложения
Пароль на открытие
Запрос пароля не является повреждением. Используйте пароль владельца документа или запросите его у отправителя. Не пытайтесь «ремонтировать» зашифрованный файл без ключа: корректная программа не должна выдавать содержимое, которое защищено шифрованием. Если пароль верный, но после ввода возникает структурная ошибка, работайте с копией уже как с повреждённым зашифрованным PDF и сохраняйте пароль только в защищённом менеджере.
Цифровая подпись
Подпись связывается с определённым набором байтов. Перестановка страниц, печать, экспорт и структурная перепись создают другой файл. Сохраните исходник, отчёт проверки подписи и восстановленную читаемую копию как три разных объекта. Не переносите изображение подписи и не называйте его электронной подписью.
PDF-форма
Проверьте поля до и после восстановления. Печать в PDF обычно превращает видимые значения в статическую страницу, но удаляет возможность редактировать поля, расчёты, кнопки и сценарии. Если нужны данные формы, дополнительно экспортируйте их штатной функцией исходного приложения, пока файл ещё открывается.
Скан
Для сканов главная ценность — растровая страница. Не уменьшайте разрешение и не применяйте повторное JPEG-сжатие несколько раз. После спасения изображений можно выполнить OCR отдельным инструментом, но OCR создаёт новый текстовый слой и может ошибаться в цифрах, фамилиях, формулах и таблицах. Сверяйте критичные данные с изображением.
Вложения, портфолио и слои
Видимая страница не показывает всё содержимое. Проверьте панели вложений и слоёв до экспорта. PDF-портфолио может содержать самостоятельные файлы; обычная печать сохранит только оболочку или текущий вид. Сначала извлеките вложения штатной функцией, затем восстанавливайте основной документ.
Проверка восстановленного PDF: обязательный контроль
Не оценивайте результат по тому, что первая страница открылась. Проверка должна быть воспроизводимой и включать структуру, содержание и повторное открытие.
- Закройте программу, которая создала результат. Это исключает показ документа из памяти.
- Откройте файл в двух независимых движках. Например, настольный просмотрщик и браузер.
- Сравните число страниц. Учитывайте обложки, пустые обороты и приложения.
- Просмотрите миниатюры. Ищите пустые, чёрные, повторяющиеся и обрезанные страницы.
- Проверьте контрольные точки. Первая, последняя, по одной странице из каждой главы и места склейки.
- Проверьте текст. Поиск по пяти словам из разных частей, выделение и копирование фрагмента.
- Проверьте изображения. Диаграммы, печати, подписи как графику, QR-коды и мелкий текст.
- Проверьте навигацию. Закладки, внутренние ссылки, оглавление и номера страниц.
- Проверьте специальные элементы. Поля, комментарии, вложения, слои, теги и подписи.
- Запустите qpdf —check. Сохраните вывод рядом с результатом.
- Сделайте пробную печать в файл или одной страницы. Убедитесь, что печатный движок не выдаёт новую ошибку.
- Запишите SHA-256 результата. Он пригодится для последующей передачи и архива.
Сравнение с эталоном
Если есть скриншоты, бумажная копия или исходный документ, сравните не только страницы, но и даты, суммы, номера договоров, подписи, сноски и приложения. Автоматическое восстановление может пропустить отдельный объект, не разрушив внешний вид остальной страницы.
Имена и хранение
Храните исходник и результат отдельно: damaged-original, recovered-readable, verified-final. В журнале укажите, каким методом создан каждый вариант и какие функции потеряны. Для корпоративных документов перед заменой в рабочей системе получите согласование владельца данных.
Типичные ошибки и что они означают
| Симптом | Вероятная причина | Следующее действие |
|---|---|---|
| Файл 0 байт | Данные не записаны | Искать источник, резервную копию или повторную загрузку |
| Новая загрузка больше старой | Старая копия была неполной | Использовать большую копию и проверить хеш |
| Один просмотрщик открывает, другой нет | Разная строгость парсеров | Извлечь страницы в новый PDF и проверить функции |
| Открывается только начало | Обрезан хвост, повреждено дерево или ресурсы поздних страниц | Повторно скачать; попробовать реконструкцию xref и диапазоны |
| Миниатюры есть, страницы пустые | Повреждены потоки содержимого или ресурсы | Проверить другой движок и извлечение изображений |
| Текст виден, но копируется неверно | Проблема кодировки или карты шрифта | Сохранить визуальную копию и выполнить проверяемое OCR |
| После экспорта пропала подпись | Изменились подписанные байты | Хранить оригинал и считать экспорт производной копией |
| Форма стала обычной страницей | Произошло сплющивание | Искать исходную форму или экспорт данных полей |
| Файл открывается, но не печатается | Ошибка отдельного ресурса или прозрачности | Печатать диапазонами, локализовать страницу, пересобрать |
| Результат снова повреждается | Проблемный носитель, синхронизация или приложение | Сменить диск, проверить файловую систему, исключить перезапись |
Чего не делать
- Не переименовывать DOCX, ZIP или HTML в PDF в надежде на преобразование.
- Не редактировать бинарный PDF в обычном текстовом редакторе.
- Не удалять исходную копию после первого удачного открытия.
- Не загружать конфиденциальные файлы в случайные онлайн-сервисы.
- Не отключать защиту просмотрщика постоянно ради одного подозрительного файла.
- Не считать ремонт установки Acrobat ремонтом документа.
- Не запускать неизвестные утилиты с правами администратора без проверки происхождения.
- Не обещать заказчику полное восстановление до постраничной проверки.
- Не заменять цифровую подпись картинкой.
- Не выполнять OCR до сохранения качественных изображений страниц.
После завершения работы храните исходную копию в неизменном виде хотя бы до подтверждения владельца документа. Дополнительные материалы по программам и рабочим сценариям собраны на главной странице сайта; вопросы о содержимом конкретного повреждённого файла решайте с его владельцем, а не методом необратимых экспериментов.
Практические сценарии восстановления
Сценарий 1. PDF скачался из браузера и сразу не открылся
Не запускайте утилиту ремонта первой. Откройте список загрузок браузера, проверьте, завершена ли операция и не осталось ли расширение временного файла. Запишите размер. Скачайте документ повторно в другую папку и сравните размеры. Если сервер показывает контрольную сумму, сравните её. Затем откройте новую копию локально. Только когда повторная загрузка имеет тот же размер и ту же ошибку, переходите к структурному анализу.
Сценарий 2. PDF много лет лежал на флешке
Не работайте непосредственно с флешки. Скопируйте файл и соседние документы на исправный диск. Если копирование выдаёт ошибку ввода-вывода, сначала создайте образ носителя специализированными средствами восстановления данных; многократное чтение умирающего носителя может ухудшать ситуацию. PDF-ремонт начинается после получения стабильной побайтовой копии. Сравните размер нескольких попыток: меняющийся результат указывает на проблему носителя.
Сценарий 3. Документ открывается до определённой страницы
Отметьте последнюю полностью читаемую страницу. Попробуйте перейти сразу к странице после сбоя и к последней странице. Если конец открывается, проблема локальная: экспортируйте диапазоны вокруг сбоя отдельно. Если всё после точки недоступно, вероятно, отсутствует часть файла или повреждён общий узел дерева страниц. Попробуйте qpdf и специализированную реконструкцию, затем снова проверьте диапазоны.
Сценарий 4. После сбоя питания PDF перестал открываться
Найдите временные и резервные версии приложения, которым файл создавался. Проверьте облачную историю и предыдущие версии папки. Текущий PDF мог остаться на промежуточной стадии записи, когда старая таблица ссылок уже заменена, а новая не дописана. Специализированный инструмент иногда возвращает предыдущую инкрементальную секцию, но исходный проект обычно даёт лучший результат.
Сценарий 5. Повреждён подписанный договор
Сначала сохраните исходный файл, хеш и отчёт просмотрщика о подписи. Запросите оригинал у подписанта или из системы электронного документооборота. Любой экспорт создаст производную копию и не сохранит криптографическую силу подписи. Восстановленная версия может служить для чтения, но статус юридически значимого оригинала определяется системой и сертификатами, а не визуальным изображением подписи.
Сценарий 6. В скане пропало несколько страниц
Сравните с физическим оригиналом и исходными изображениями сканера. Если TIFF/JPEG страниц сохранились, соберите PDF заново из них; это надёжнее ремонта контейнера. Зафиксируйте разрешение и порядок. Не применяйте агрессивное сжатие до проверки мелкого текста. OCR выполняйте после сборки и сохраняйте версию без OCR как визуальный эталон.
Сценарий 7. Файл открывается в браузере, но не в Acrobat
Сначала обновите Acrobat и проверьте другой исправный документ. Если проблема только у одного файла, браузерный движок, вероятно, терпимее к структуре. Пролистайте все страницы, затем используйте экспорт или печать в новый PDF. Сравните интерактивные функции: браузерная печать может потерять форму, слои, вложения и подпись. Не отключайте защищённый режим постоянно без необходимости.
Сценарий 8. Онлайн-сервис показывает превью, но требует оплату
Оцените число найденных страниц, качество превью и ограничения сохранения. Не платите только за сообщение «восстановление возможно», если сервис не показывает, что нужные страницы обнаружены. Сравните с локальными результатами. Для конфиденциального файла прекратите онлайн-обработку и используйте настольный инструмент или резервную копию.
Подробная карта принятия решения
- Есть источник или резервная версия? Да — получите новую копию и сравните. Нет — продолжайте.
- Размер выглядит правдоподобно? Нет — ищите данные, а не средство ремонта. Да — продолжайте.
- Сигнатура PDF присутствует? Нет — проверьте фактический формат. Да — продолжайте.
- Файл зашифрован? Да — нужен законный пароль. Нет или пароль известен — продолжайте.
- Хотя бы один движок показывает страницы? Да — спасайте видимые диапазоны и пересобирайте. Нет — используйте структурный анализатор.
- qpdf или утилита создали новый файл? Да — выполните полную проверку. Нет — попробуйте другой анализатор или ручное извлечение доступных потоков специалистом.
- Документ содержит подписи, формы, вложения? Да — проверяйте их отдельно и фиксируйте потери. Нет — обычная постраничная проверка достаточнее.
- Результат прошёл два просмотрщика и qpdf —check? Да — передайте владельцу с журналом. Нет — не называйте его финальным.
Эта последовательность уменьшает число ненужных преобразований. Каждый новый экспорт — изменение данных. Чем раньше найдена полноценная копия, тем меньше риск потерять функции, которые не видны на странице.
Часто задаваемые вопросы
Можно ли гарантировать восстановление любого повреждённого PDF?
Нет. Если нужные байты не были загружены, перезаписаны или физически не читаются, программа не может достоверно восстановить отсутствующее содержимое. Успех возможен, когда уцелели страницы, ресурсы или предыдущая секция документа.
Почему нельзя сохранять поверх исходника?
Исходник может содержать фрагменты, которые не использовал первый инструмент, но сможет прочитать другой. Перезапись уничтожает возможность повторного анализа и усложняет доказательство того, что именно было повреждено до работы.
Что важнее: размер файла или число страниц?
Оба показателя. Размер помогает обнаружить неполную загрузку, число страниц — оценить логическую полноту. Но одинаковое число страниц не гарантирует сохранность изображений, текста, форм и вложений.
Если браузер открыл файл, он уже исправен?
Не обязательно. Браузер мог реконструировать структуру в памяти или пропустить ошибку. Сохраните новую копию, закройте вкладку и откройте результат локально в другом движке.
Можно ли просто распечатать в PDF?
Можно, если цель — сохранить видимые страницы. Но печать обычно удаляет интерактивные поля, вложения, слои, часть ссылок, теги доступности и действующую цифровую подпись. Для сканов контролируйте качество.
Почему после восстановления не работает поиск?
Страницы могли быть сохранены как изображения либо потерялась карта символов шрифта. Выполните OCR отдельным инструментом и проверьте распознанный текст, не удаляя визуальный эталон.
Можно ли использовать онлайн-сервис для паспорта или договора?
Только если владелец данных и правила организации разрешают передачу стороннему серверу. Для чувствительных документов предпочтительна локальная обработка.
Что делать с цифровой подписью?
Хранить исходный файл и отчёт проверки отдельно. Восстановленная копия изменена и не наследует действительность исходной подписи. Изображение подписи не является криптографической подписью.
Почему qpdf пишет предупреждения, но создаёт файл?
Некоторые состояния считаются восстанавливаемыми. qpdf может реконструировать кросс-таблицу и продолжить запись. Предупреждение нужно сохранить, а выходной файл — визуально и структурно проверить.
Нужно ли восстанавливать пустую страницу?
Сначала установите, была ли она намеренной. В книгах, договорах и двусторонней печати пустые обороты могут быть частью структуры. Не удаляйте страницу только из-за отсутствия текста.
Как понять, что проблема в носителе?
Копирование выдаёт ошибки, размер или хеш меняются между чтениями, другие файлы на носителе тоже повреждаются. Сначала стабилизируйте данные или создайте образ носителя, затем работайте с PDF-копией.
Можно ли вручную исправить startxref?
Теоретически возможно в рамках низкоуровневого анализа, но изменение одного числа редко решает сложное повреждение и легко создаёт новые ошибки смещений. Практичнее использовать qpdf или специализированный парсер, который пересчитает ссылки.
Как передать восстановленный документ другому человеку?
Передайте проверенный файл, его SHA-256 и краткое описание: источник, метод, сохранённые страницы и известные потери. Не отправляйте десяток неразличимых вариантов без пояснений.
Когда обращаться к специалисту по восстановлению данных?
Когда единственный экземпляр находится на неисправном носителе, содержит критичные юридические или научные данные, а копирование нестабильно. Сначала нужен образ носителя; самостоятельные записи на него могут ухудшить шанс восстановления.
Финальный контрольный лист
- Исходный повреждённый файл сохранён неизменным.
- Работа велась с дубликатом.
- Повторная загрузка и резервные версии проверены до ремонта.
- Тип PDF определён: текст, скан, форма, подпись, защита, вложения.
- Точные сообщения об ошибках записаны.
- Результат сохранён под новым именем.
- Число и порядок страниц сверены.
- Текст, изображения, закладки и ссылки проверены.
- Формы, подписи, вложения и слои проверены отдельно.
- Файл закрыт и повторно открыт в двух движках.
- qpdf —check выполнен, предупреждения сохранены.
- SHA-256 результата записан.
- Владелец документа предупреждён о потерянных функциях.
Рабочий результат — это не файл, который один раз открылся, а новая копия с известным происхождением, проверенными страницами и честно зафиксированными ограничениями. Для обратной связи по сайту используется страница контактов; сведения о содержании и правовом статусе конкретного документа должен подтверждать его владелец.
Глубокая диагностика по слоям: от контейнера до содержимого страницы
Уровень 1. Файл как набор байтов
На первом уровне не важно, что нарисовано на страницах. Проверяется, существует ли стабильная последовательность байтов: одинаковы ли размер и SHA-256 при повторном копировании, нет ли ошибок чтения, не изменяет ли файл синхронизатор. Если две копии с одного носителя дают разные хеши, анализ структуры преждевременен. Сначала получают устойчивую копию с носителя или сервера, потому что любой вывод парсера будет относиться только к одному из нестабильных чтений.
Проверьте свободное место в папке результата. Структурная перепись иногда создаёт временный файл размером, сопоставимым с исходным или превышающим его. Нехватка места может оборвать экспорт и породить ещё один усечённый PDF. На сетевом ресурсе дополнительно исключите квоту пользователя и кратковременные разрывы соединения.
Уровень 2. Заголовок, конец и инкрементальные секции
Заголовок сообщает версию синтаксиса, но фактические возможности могут быть расширены ключом Version в каталоге. В конце обычно находятся startxref и маркер конца. При инкрементальном сохранении новые объекты дописываются в хвост, а предыдущие данные остаются. Поэтому резкое отключение питания может повредить только последнюю редакцию. Анализатор, который следует цепочке Prev или реконструирует таблицу, иногда возвращает состояние до последнего изменения.
Не обрезайте файл вручную у предположительно «последнего правильного» маркера EOF без отдельной копии. После EOF могут находиться легитимные обновления, подписи и новая таблица ссылок. Эксперимент с обрезкой выполняют только специалисты на дубликате и документируют точную границу.
Уровень 3. Каталог и дерево страниц
Каталог Root ведёт к дереву Pages. Узлы дерева содержат количество потомков и ссылки на страницы или поддеревья. Несогласованное значение Count, циклическая ссылка или ссылка на отсутствующий объект могут остановить строгий просмотрщик. Более терпимый парсер пропустит ошибочный узел и покажет часть документа. Если восстановление даёт меньше страниц, сравните диапазоны: возможно, целая ветка дерева не была подключена, хотя её объекты остались в файле.
При объединении найденных диапазонов не полагайтесь на номера объектов. После переписи они могут измениться. Сверяйте печатные номера, заголовки, колонтитулы, оглавление и логические переходы между разделами.
Уровень 4. Ресурсы и потоки страницы
Страница ссылается на шрифты, изображения, цветовые пространства, графические состояния и формы XObject. Если словарь страницы читается, а ресурс отсутствует, страница может быть пустой, частично чёрной или показывать текст без изображений. Ошибка одного общего шрифта способна затронуть десятки страниц. Поэтому одинаковый визуальный дефект на разных страницах чаще указывает на общий ресурс, а не на независимое повреждение каждой страницы.
При извлечении страницы в новый PDF программа должна перенести все достижимые ресурсы. Простое копирование фрагмента бинарного файла этого не делает. Используйте функцию экспорта страниц, qpdf —pages или редактор, который строит новый граф объектов.
Уровень 5. Логическая структура и доступность
Теги определяют порядок чтения, заголовки, таблицы и альтернативные описания. Визуально восстановленный PDF может стать недоступным для экранного диктора. Если документ используется людьми с ограничениями зрения или должен соответствовать PDF/UA, проведите отдельную проверку тегов. Обычная печать в PDF почти всегда упрощает или удаляет исходное дерево структуры.
Как проверять текст, шрифты и кодировку после восстановления
Видимый текст может храниться с нестандартным сопоставлением кодов символам. Поэтому проверка «я вижу буквы» недостаточна. Выберите контрольные фразы с буквами, цифрами, знаками и редкими символами. Найдите их через поиск, скопируйте в простой текстовый редактор и сравните. Особенно важны номера счетов, даты, десятичные разделители, знак минуса, буквы Ё/Й, латиница внутри артикулов и математические символы.
Признаки повреждённой карты символов
- текст выглядит правильно, но вставляется пустым;
- поиск не находит видимое слово;
- буквы заменяются квадратиками или другими знаками;
- порядок символов нарушается в словах;
- цифры копируются как буквы;
- строки из нескольких колонок перемешиваются.
Если внешний вид важнее редактирования, сохраните визуальную копию страниц. Если нужен поиск, выполните OCR поверх качественного изображения и сохраните результат как отдельную версию. Не удаляйте исходный текстовый слой до сравнения: иногда он содержит корректные фрагменты, которые OCR распознает хуже.
Замена шрифта
При повторном экспорте программа может заменить отсутствующий шрифт системным. Это меняет ширину строк, переносы, положение подписей и таблиц. Сравните края абзацев, номера страниц, формулы и поля бланка. Для документов с точной вёрсткой используйте визуальное сравнение страниц или наложение изображений с прозрачностью.
Встроенные и подмножественные шрифты
Подмножество содержит только использованные символы. Если повреждён один фрагмент встроенного шрифта, часть текста может отображаться, а часть — нет. Пересборка из исходного DOCX или макета предпочтительнее попытки подобрать похожий шрифт вручную, потому что исходное приложение заново сформирует корректные таблицы и встраивание.
Проверка изображений, сканов и графики
Разрешение и повторное сжатие
После извлечения сканов сравните размеры страниц в пикселях. Если исходная страница имела 2480 × 3508 пикселей, а результат — 1240 × 1754, разрешение уменьшено вдвое. Для экранного чтения это может быть приемлемо, но мелкие печати и подписи потеряют детали. Сохраняйте первый восстановленный набор изображений без дополнительной оптимизации; уменьшенную копию создавайте отдельно.
JPEG-потоки уже сжаты с потерями. Повторное сохранение с низким качеством добавляет блоки и ореолы. Для промежуточной работы выбирайте PNG, TIFF или без потерь, если программа позволяет. Финальный размер оптимизируйте только после проверки.
Цвет и прозрачность
Сложные PDF используют профили ICC, DeviceN, плашечные цвета, маски и прозрачность. После печати в новый PDF цвета могут измениться, а прозрачные области — получить белый или чёрный фон. Проверьте диаграммы, печати, выделения маркером, логотипы и наложенные подписи. Для производственной печати результат должен проверить специалист допечатной подготовки.
QR-коды и штрихкоды
Откройте каждый критичный код сканером после восстановления. Визуально целый квадрат может стать нечитаемым из-за масштабирования или интерполяции. Сверьте декодированное значение с текстом рядом. Не используйте один удачный код как доказательство качества всех страниц.
Чёрные и серые прямоугольники
Такие блоки появляются, когда просмотрщик не смог декодировать изображение, маску или цветовое пространство. Попробуйте другой движок и экспорт конкретной страницы. Если один движок показывает картинку, сохраните страницу оттуда. Если ни один не показывает, ресурс может быть повреждён физически; запросите исходное изображение или повторный экспорт.
Стратегии извлечения страниц при разных типах сбоя
Когда повреждена лишь часть контейнера, после восстановления соберите целую копию, а затем при необходимости разложите PDF на отдельные файлы по диапазонам или закладкам.
Непрерывный читаемый диапазон
Сохраните диапазон одной операцией, затем проверьте его начало и конец. Большой диапазон лучше множества одиночных страниц: так сохраняется больше общей навигации и меньше риск ошибиться в порядке. Однако при сбое делите диапазон пополам, пока не локализуете проблемный объект.
Чередующиеся читаемые страницы
Если каждая вторая страница повреждена из-за неудачного сканирования или структуры, создайте список номеров и экспортируйте только уцелевшие. В журнале явно укажите пропуски. Не сдвигайте последующие страницы так, чтобы скрыть отсутствие листов; при необходимости вставьте нейтральную страницу-заглушку с согласованной пометкой в рабочей копии, сохранив отдельный вариант без добавлений.
Одна страница вызывает падение приложения
Откройте документ и перейдите к соседним страницам через поле номера, не прокручивая проблемную миниатюру. Экспортируйте диапазоны до и после неё. Если приложение строит все миниатюры при открытии и падает заранее, используйте qpdf —pages или другой парсер, который не рендерит страницу.
Две копии с разными уцелевшими частями
Составьте матрицу: строки — номера страниц, столбцы — копии, значения — «полная», «частичная», «не читается». Выберите лучший источник для каждой страницы. При равном качестве отдавайте предпочтение копии, которая сохранила текстовый слой и исходные ресурсы, а не изображению экрана.
Документ с приложениями и вложенными файлами
Сначала извлеките вложения из той копии, где они доступны. Затем работайте со страницами. При пересборке приложите извлечённые файлы заново только если это разрешено и проверено; обычное объединение страниц не переносит портфолио автоматически.
Проверка результата по ролям и назначению документа
Бухгалтерский и финансовый документ
Сверьте суммы, знаки минуса, десятичные разделители, номера счетов, даты, валюты и итоги таблиц. OCR-ошибка одной цифры может быть важнее потери оформления. Для критичных значений применяйте двойную проверку человеком.
Договор и юридический файл
Проверьте стороны, реквизиты, номера пунктов, приложения, нумерацию страниц и подписи. Зафиксируйте, является ли результат читаемой производной копией или официальным оригиналом. Не удаляйте повреждённый подписанный файл даже после получения визуально полного экспорта.
Технический чертёж
Проверьте масштаб, размеры, толщину линий, слои, цветовые обозначения и листы большого формата. Печать в PDF может изменить размер страницы или подогнать чертёж. Сверьте MediaBox/CropBox и выполните тестовую печать с масштабом 100 процентов.
Научная статья
Проверьте формулы, индексы, греческие буквы, ссылки, рисунки и подписи к ним. Копирование формулы как текста часто бессмысленно; визуально сравните её с источником. Убедитесь, что библиография не обрезана и гиперссылки ведут к правильным разделам.
Архивный скан
Сохраняйте максимально близкую к исходнику визуальную версию. Не удаляйте пустые обороты, поля, штампы и дефекты бумаги без архивной политики. OCR и улучшение контраста храните как производные версии, не заменяя мастер-копию.
Платформенные различия и безопасная организация файлов
Windows
Работайте из локальной папки с коротким путём. Проверьте свойства файла, атрибут «Только чтение» для исходника и предыдущие версии папки. Если файл пришёл из интернета, Windows может пометить его как загруженный; блокировка в свойствах отличается от структурного повреждения. Ремонт установки Acrobat выполняется отдельно от документа.
macOS
Используйте Finder для дубликата и Get Info для проверки размера. Preview иногда открывает файлы, которые отвергает другой просмотрщик; экспортируйте только в новую копию. Time Machine полезна, если была настроена до инцидента. Не заменяйте текущую версию, пока не сравнили восстановленную.
Linux
Команды file, sha256sum и qpdf удобны для диагностики. Сохраняйте stdout и stderr в журнал. Разные просмотрщики могут использовать Poppler, MuPDF или собственный движок; различие результатов помогает понять, насколько повреждение зависит от строгости парсера.
Облачные папки
Перед экспериментами приостановите синхронизацию рабочей папки либо создайте локальную папку вне синхронизатора. Иначе каждая промежуточная запись уйдёт в облако и может вытеснить полезную версию. Историю версий просматривайте в веб-интерфейсе сервиса и скачивайте варианты отдельно.
Сетевые диски
Скопируйте файл локально и сравните хеш. Не экспортируйте напрямую на нестабильный сетевой ресурс. После получения проверенного результата загрузите его на сервер под новым именем и повторно сравните контрольную сумму.
Как документировать неизбежные потери
Не каждый результат обязан полностью совпадать с оригиналом, но различия должны быть перечислены. Создайте короткий отчёт: какие страницы восстановлены, какие отсутствуют, сохранён ли поиск, работают ли закладки, потеряны ли поля, подписи, вложения или слои. Укажите метод и дату. Такой отчёт предотвращает ошибочное использование производной копии как оригинала.
| Элемент | Статус | Как проверено |
|---|---|---|
| Страницы | Полностью / частично / неизвестно | Сравнение с оглавлением и эталоном |
| Текстовый слой | Сохранён / OCR / отсутствует | Поиск и копирование контрольных фраз |
| Изображения | Полные / снижено качество / пропуски | Визуальное сравнение и размеры в пикселях |
| Закладки и ссылки | Работают / пересозданы / отсутствуют | Ручной переход по каждому элементу |
| Форма | Редактируемая / сплющена / потеряна | Ввод тестового значения в копии |
| Подпись | Исходная отдельно / недействительна в копии | Панель проверки сертификата |
| Вложения | Извлечены / отсутствуют | Панель вложений и открытие файлов |
Если страницу пришлось восстановить из изображения экрана, укажите это прямо. Такой файл может быть достаточен для чтения, но не для точной печати, архива или извлечения данных. Честная маркировка полезнее неподтверждённого заявления о полном восстановлении.
Расширенный журнал восстановления
Для сложного случая ведите журнал каждой попытки. Он позволяет сравнить результаты и не повторять действия, которые уже ухудшили качество.
| Поле | Что фиксировать |
|---|---|
| Идентификатор попытки | Короткий номер: A01, A02, A03. |
| Входной файл | Имя, размер, SHA-256 и расположение копии. |
| Программа и версия | Точное название, версия и операционная система. |
| Команда или меню | Полная последовательность действий. |
| Время начала и окончания | Помогает отличить зависание от долгой обработки. |
| Сообщения | Предупреждения и коды завершения без пересказа. |
| Выходной файл | Имя, размер, SHA-256. |
| Страницы | Ожидаемое и фактическое число. |
| Текст | Результат поиска и копирования контрольных фраз. |
| Графика | Состояние диаграмм, печатей, QR-кодов и мелких деталей. |
| Интерактивность | Формы, ссылки, закладки, вложения, слои. |
| Решение | Сохранить вариант, отклонить или использовать как источник диапазона. |
Контрольная точка 1
На этапе 1 сравните текущий результат с исходной копией и предыдущей попыткой. Не оценивайте только внешний вид первой страницы. Запишите число доступных страниц, состояние текста, изображений и навигации. Если новый метод сохранил меньше данных, не заменяйте им более полный вариант; используйте его только для тех страниц или объектов, которые он восстановил лучше.
Контрольная точка 2
На этапе 2 сравните текущий результат с исходной копией и предыдущей попыткой. Не оценивайте только внешний вид первой страницы. Запишите число доступных страниц, состояние текста, изображений и навигации. Если новый метод сохранил меньше данных, не заменяйте им более полный вариант; используйте его только для тех страниц или объектов, которые он восстановил лучше.
Контрольная точка 3
На этапе 3 сравните текущий результат с исходной копией и предыдущей попыткой. Не оценивайте только внешний вид первой страницы. Запишите число доступных страниц, состояние текста, изображений и навигации. Если новый метод сохранил меньше данных, не заменяйте им более полный вариант; используйте его только для тех страниц или объектов, которые он восстановил лучше.
Контрольная точка 4
На этапе 4 сравните текущий результат с исходной копией и предыдущей попыткой. Не оценивайте только внешний вид первой страницы. Запишите число доступных страниц, состояние текста, изображений и навигации. Если новый метод сохранил меньше данных, не заменяйте им более полный вариант; используйте его только для тех страниц или объектов, которые он восстановил лучше.
Контрольная точка 5
На этапе 5 сравните текущий результат с исходной копией и предыдущей попыткой. Не оценивайте только внешний вид первой страницы. Запишите число доступных страниц, состояние текста, изображений и навигации. Если новый метод сохранил меньше данных, не заменяйте им более полный вариант; используйте его только для тех страниц или объектов, которые он восстановил лучше.
Контрольная точка 6
На этапе 6 сравните текущий результат с исходной копией и предыдущей попыткой. Не оценивайте только внешний вид первой страницы. Запишите число доступных страниц, состояние текста, изображений и навигации. Если новый метод сохранил меньше данных, не заменяйте им более полный вариант; используйте его только для тех страниц или объектов, которые он восстановил лучше.
Контрольная точка 7
На этапе 7 сравните текущий результат с исходной копией и предыдущей попыткой. Не оценивайте только внешний вид первой страницы. Запишите число доступных страниц, состояние текста, изображений и навигации. Если новый метод сохранил меньше данных, не заменяйте им более полный вариант; используйте его только для тех страниц или объектов, которые он восстановил лучше.
Контрольная точка 8
На этапе 8 сравните текущий результат с исходной копией и предыдущей попыткой. Не оценивайте только внешний вид первой страницы. Запишите число доступных страниц, состояние текста, изображений и навигации. Если новый метод сохранил меньше данных, не заменяйте им более полный вариант; используйте его только для тех страниц или объектов, которые он восстановил лучше.
Контрольная точка 9
На этапе 9 сравните текущий результат с исходной копией и предыдущей попыткой. Не оценивайте только внешний вид первой страницы. Запишите число доступных страниц, состояние текста, изображений и навигации. Если новый метод сохранил меньше данных, не заменяйте им более полный вариант; используйте его только для тех страниц или объектов, которые он восстановил лучше.
Контрольная точка 10
На этапе 10 сравните текущий результат с исходной копией и предыдущей попыткой. Не оценивайте только внешний вид первой страницы. Запишите число доступных страниц, состояние текста, изображений и навигации. Если новый метод сохранил меньше данных, не заменяйте им более полный вариант; используйте его только для тех страниц или объектов, которые он восстановил лучше.
Контрольная точка 11
На этапе 11 сравните текущий результат с исходной копией и предыдущей попыткой. Не оценивайте только внешний вид первой страницы. Запишите число доступных страниц, состояние текста, изображений и навигации. Если новый метод сохранил меньше данных, не заменяйте им более полный вариант; используйте его только для тех страниц или объектов, которые он восстановил лучше.
Контрольная точка 12
На этапе 12 сравните текущий результат с исходной копией и предыдущей попыткой. Не оценивайте только внешний вид первой страницы. Запишите число доступных страниц, состояние текста, изображений и навигации. Если новый метод сохранил меньше данных, не заменяйте им более полный вариант; используйте его только для тех страниц или объектов, которые он восстановил лучше.

