Конвертация PDF в Markdown
Береста сохраняет PDF и распознанные сканы в Markdown — с заголовками, абзацами, списками и таблицами в порядке чтения. Такой текст удобно вставить в базу знаний, вики или передать нейросети.
Как сохранить PDF в Markdown
- 1
Откройте PDF или скан в Бересте.
- 2
Выберите «Экспорт в Markdown…».
- 3
Укажите, куда сохранить файл.
Порядок чтения
PDF хранит текст кусками в произвольном порядке, поэтому простое копирование часто перемешивает колонки и разрывает абзацы. Береста восстанавливает порядок чтения: заголовки, абзацы, списки и таблицы идут так, как их читает человек.
Что сохраняется
- Заголовки — становятся заголовками Markdown разных уровней.
- Абзацы и списки — сохраняются как текст и маркированные списки.
- Колонки — читаются по очереди, а не построчно поперёк страницы.
- Таблицы — таблицы с линиями превращаются в таблицы Markdown.
На сканах Береста сначала распознаёт текст и определяет разметку страницы, а колонтитулы, печати и подписи пропускает.
Для чего это нужно
- База знаний и вики. Регламенты, инструкции и договоры в Markdown легко вставить в Confluence, Notion, Obsidian, GitLab или внутреннюю вики.
- Нейросети. Языковые модели лучше понимают структурированный текст: Markdown-версия документа подходит для загрузки в чат-бот или поисковую систему по документам.
- Редактирование. Текст из Markdown удобно править в любом редакторе и переносить в другие форматы.
Пример результата
Фрагмент договора после экспорта выглядит так:
# ДОГОВОР ПОСТАВКИ № 14/2026
## 3. ПОРЯДОК РАСЧЁТОВ
3.1. Покупатель вносит предоплату в размере 70 % от общей стоимости
Товара в течение 5 (пяти) банковских дней с даты подписания
настоящего договора.
| № | Наименование | Кол-во | Цена, руб. |
|---|---|---|---|
| 1 | Каталог продукции, 48 с., А4 | 2 500 | 209,00 |
Markdown или Word
Word хранит оформление — шрифты, отступы, поля. Markdown хранит только структуру: заголовки, списки, таблицы. Поэтому Markdown-файл маленький, читается в любом текстовом редакторе и не ломается при переносе между системами — а оформление добавит та система, куда вы его вставите.
Ограничения
Таблицы без линий и объединённые ячейки передаются ограниченно — проверьте их после конвертации. На сканах с очень низким разрешением линии таблиц могут не найтись.
Связанные возможности
Перед конвертацией скан стоит распознать и при необходимости улучшить. А задать вопрос по документу можно прямо в Бересте — ИИ-ассистенту.
Вопросы и ответы
Можно ли сохранить в Markdown скан?
Да. Береста распознаёт скан и сохраняет текст в Markdown с заголовками, списками и колонками в правильном порядке.
Сохраняются ли таблицы?
Да, таблицы с линиями сохраняются как таблицы Markdown. Таблицы без линий и объединённые ячейки передаются ограниченно.
Попадут ли в файл колонтитулы, печати и подписи?
На сканах колонтитулы, печати и подписи убираются, чтобы в тексте осталось только содержание.
Зачем нужен Markdown?
Это простой текстовый формат с разметкой заголовков, списков и таблиц. Его понимают базы знаний, вики, редакторы заметок и языковые модели.
Нужен ли интернет?
Нет. Конвертация и распознавание выполняются на компьютере.
Можно ли исправить документ перед экспортом?
Да. Сначала поправьте текст, поверните или переставьте страницы и улучшите скан, а затем сохраните результат в Markdown.
Подходит ли Markdown для загрузки в нейросеть?
Да. Языковые модели хорошо понимают Markdown: заголовки и таблицы помогают модели разобраться в структуре документа.
Попробуйте Бересту — интеллектуальный PDF‑редактор с ИИ
Правка PDF и сканов, сравнение версий, распознавание и ИИ-ассистент в одной программе. Версия 0.7.0 для Windows, macOS, Astra Linux, Альт и РЕД ОС, документы остаются на вашем компьютере.