Конвертировать PDF в Markdown онлайн
Превратите PDF в чистый Markdown с заголовками, жирным и курсивом, списками, таблицами, блоками кода, ссылками и изображениями по желанию. Бесплатно, конфиденциально, прямо в браузере.
Как преобразовать PDF в Markdown
PDF создан для печати, а Markdown — для того, чтобы писать, редактировать и переиспользовать текст. Конвертер WoowPDF «PDF в Markdown» восстанавливает структуру документа в виде чистого, удобочитаемого Markdown, который можно вставить в GitHub, GitLab, Obsidian, Notion, генератор статических сайтов, вики или ИИ-ассистента. Он сохраняет заголовки, выделения, списки, таблицы, блоки кода и ссылки и отбрасывает колонтитулы и номера страниц, которые засоряют текст, скопированный из PDF. Всё работает в браузере, поэтому файлы остаются на вашем устройстве.
Как преобразовать PDF в Markdown
- Добавьте PDF. Перетащите один или несколько файлов на страницу или нажмите Выбрать файлы.
- Выберите, что распознавать. Заголовки, таблицы и удаление колонтитулов включены по умолчанию. Включите Извлекать изображения, если нужны и картинки.
- При необходимости уточните настройки. В дополнительных параметрах можно отмечать разрывы страниц линией или HTML-комментарием, добавить YAML-заголовок с названием и автором или преобразовать только диапазон страниц.
- Преобразуйте и скачайте. Нажмите Преобразовать в Markdown и скачайте файл .md (или ZIP с папкой изображений).
Структура, а не просто текст
При копировании текста из PDF обычно получаются рваные строки, потерянные заголовки и номера страниц посреди предложений. Этот конвертер опирается на положение и шрифт каждого фрагмента текста. Строки собираются в абзацы, а слова, перенесённые с дефисом, снова склеиваются. Измеряется размер основного текста, и более крупные строки становятся заголовками #, ## или ###. Жирные и курсивные слова сохраняют выделение, моноширинный текст превращается во встроенный код или блок кода, а ссылки — в настоящие ссылки Markdown.
Списки и таблицы
Маркеры •, ▪, – и * становятся пунктами списка Markdown, нумерованные пункты остаются нумерованными, а пункты с отступом вкладываются. Строки текста, разбитые на выровненные колонки, превращаются в таблицы Markdown в стиле GitHub со строкой заголовков — они хорошо отображаются на GitHub, в Obsidian и большинстве систем документации. Таблицы с объединёнными ячейками проверьте и при необходимости поправьте вручную.
Чистый результат на реальных документах
Отчёты, статьи и руководства повторяют один и тот же верхний и нижний колонтитул и номер на каждой странице. WoowPDF находит эти повторяющиеся элементы и удаляет их, поэтому абзацы идут без разрывов, а предложение, продолжающееся на следующей странице, остаётся целым. Двухколоночная вёрстка, частая в научных статьях и рассылках, читается по колонкам, а не построчно через всю страницу.
Изображения в готовой папке
Если включено Извлекать изображения, вы получите ZIP-архив с документом Markdown и папкой images. Каждое изображение подключено по относительному пути там, где оно находится в PDF, поэтому документ сразу корректно отображается после распаковки. Логотипы, повторяющиеся на каждой странице, пропускаются.
Идеально для ИИ, документации и заметок
Markdown компактен и сохраняет смысл, который теряется в простом тексте, поэтому это отличный формат для передачи документов в ChatGPT, Claude или RAG-систему. Это также родной формат баз знаний Obsidian и Logseq, файлов README и сайтов документации на Docusaurus, MkDocs или Hugo.
Советы для лучшего результата
- Документ отсканирован? Сначала сделайте его доступным для поиска с помощью PDF OCR, затем преобразуйте.
- Нужен простой текст без форматирования? Воспользуйтесь извлечением текста из PDF. Для веб-страницы попробуйте PDF в HTML, для редактируемого документа — PDF в Word.
- Нужны только картинки? Извлеките изображения из PDF напрямую.
- Нужно наоборот? Вставьте текст в Текст в PDF.
Возможности
- Заголовки определяются по размеру шрифта и превращаются в #, ## и ###
- Жирный, курсив и встроенный код сохраняются
- Маркированные и нумерованные списки, включая вложенные
- Таблицы в формате Markdown как на GitHub
- Моноширинный текст превращается в блоки кода
- Ссылки сохраняются, повторяющиеся колонтитулы и номера страниц удаляются
- Двухколоночная вёрстка читается в правильном порядке
- Извлечение изображений по желанию — ZIP с папкой images
- Конфиденциально: PDF обрабатывается в браузере без загрузки
Частые вопросы
Что такое Markdown?
Markdown — формат простого текста, в котором структура задаётся простыми символами: # для заголовков, * для выделения, - для пунктов списка и | для таблиц. Его используют GitHub, GitLab, Obsidian, Notion, генераторы статических сайтов, системы документации и ИИ-ассистенты.
Что сохраняется из моего PDF?
Заголовки, абзацы, жирный и курсив, маркированные и нумерованные списки, простые таблицы, моноширинный код, ссылки и, если включить, изображения. Повторяющиеся колонтитулы и номера страниц удаляются.
Загружается ли мой PDF на сервер?
Нет. Преобразование полностью выполняется в браузере, файл не покидает ваше устройство.
Работает ли это со сканами?
Отсканированный PDF содержит только изображения текста. Сначала обработайте его инструментом PDF OCR, чтобы добавить текстовый слой, а затем преобразуйте результат в Markdown.
Как определяются заголовки?
Конвертер находит размер шрифта основного текста. Более крупные строки становятся заголовками: самый крупный размер — #, следующий — ##, меньшие — ###. Определение заголовков можно отключить.
Преобразуются ли таблицы?
Да. Строки, текст которых разбит на выровненные колонки, превращаются в таблицы Markdown со строкой заголовков. Очень сложные таблицы с объединёнными ячейками могут потребовать ручной правки.
Что происходит с изображениями?
По умолчанию преобразуется только текст. Включите «Извлекать изображения», чтобы получить ZIP с файлом .md и папкой images; каждое изображение вставлено там, где оно находится в документе.
Можно ли использовать результат с ChatGPT, Claude и другими ИИ?
Да. Markdown — один из лучших форматов для передачи документов языковым моделям: он сохраняет структуру и остаётся компактным.
Поддерживаются ли документы в две колонки?
Да. Если на странице две колонки текста, сначала читается левая, затем правая — строки не перемешиваются.
Можно ли преобразовать несколько PDF сразу?
Да. Добавьте несколько файлов — каждый будет обработан с одинаковыми настройками. Скачайте их по отдельности или вместе в ZIP.