Перейти к содержимому
WoowPDF

Конвертировать PDF в Markdown онлайн

Превратите PDF в чистый Markdown с заголовками, жирным и курсивом, списками, таблицами, блоками кода, ссылками и изображениями по желанию. Бесплатно, конфиденциально, прямо в браузере.

Бесплатно Работает в браузере

Как преобразовать PDF в Markdown

PDF создан для печати, а Markdown — для того, чтобы писать, редактировать и переиспользовать текст. Конвертер WoowPDF «PDF в Markdown» восстанавливает структуру документа в виде чистого, удобочитаемого Markdown, который можно вставить в GitHub, GitLab, Obsidian, Notion, генератор статических сайтов, вики или ИИ-ассистента. Он сохраняет заголовки, выделения, списки, таблицы, блоки кода и ссылки и отбрасывает колонтитулы и номера страниц, которые засоряют текст, скопированный из PDF. Всё работает в браузере, поэтому файлы остаются на вашем устройстве.

Как преобразовать PDF в Markdown

  1. Добавьте PDF. Перетащите один или несколько файлов на страницу или нажмите Выбрать файлы.
  2. Выберите, что распознавать. Заголовки, таблицы и удаление колонтитулов включены по умолчанию. Включите Извлекать изображения, если нужны и картинки.
  3. При необходимости уточните настройки. В дополнительных параметрах можно отмечать разрывы страниц линией или HTML-комментарием, добавить YAML-заголовок с названием и автором или преобразовать только диапазон страниц.
  4. Преобразуйте и скачайте. Нажмите Преобразовать в Markdown и скачайте файл .md (или ZIP с папкой изображений).

Структура, а не просто текст

При копировании текста из PDF обычно получаются рваные строки, потерянные заголовки и номера страниц посреди предложений. Этот конвертер опирается на положение и шрифт каждого фрагмента текста. Строки собираются в абзацы, а слова, перенесённые с дефисом, снова склеиваются. Измеряется размер основного текста, и более крупные строки становятся заголовками #, ## или ###. Жирные и курсивные слова сохраняют выделение, моноширинный текст превращается во встроенный код или блок кода, а ссылки — в настоящие ссылки Markdown.

Списки и таблицы

Маркеры •, ▪, – и * становятся пунктами списка Markdown, нумерованные пункты остаются нумерованными, а пункты с отступом вкладываются. Строки текста, разбитые на выровненные колонки, превращаются в таблицы Markdown в стиле GitHub со строкой заголовков — они хорошо отображаются на GitHub, в Obsidian и большинстве систем документации. Таблицы с объединёнными ячейками проверьте и при необходимости поправьте вручную.

Чистый результат на реальных документах

Отчёты, статьи и руководства повторяют один и тот же верхний и нижний колонтитул и номер на каждой странице. WoowPDF находит эти повторяющиеся элементы и удаляет их, поэтому абзацы идут без разрывов, а предложение, продолжающееся на следующей странице, остаётся целым. Двухколоночная вёрстка, частая в научных статьях и рассылках, читается по колонкам, а не построчно через всю страницу.

Изображения в готовой папке

Если включено Извлекать изображения, вы получите ZIP-архив с документом Markdown и папкой images. Каждое изображение подключено по относительному пути там, где оно находится в PDF, поэтому документ сразу корректно отображается после распаковки. Логотипы, повторяющиеся на каждой странице, пропускаются.

Идеально для ИИ, документации и заметок

Markdown компактен и сохраняет смысл, который теряется в простом тексте, поэтому это отличный формат для передачи документов в ChatGPT, Claude или RAG-систему. Это также родной формат баз знаний Obsidian и Logseq, файлов README и сайтов документации на Docusaurus, MkDocs или Hugo.

Советы для лучшего результата

Возможности

  • Заголовки определяются по размеру шрифта и превращаются в #, ## и ###
  • Жирный, курсив и встроенный код сохраняются
  • Маркированные и нумерованные списки, включая вложенные
  • Таблицы в формате Markdown как на GitHub
  • Моноширинный текст превращается в блоки кода
  • Ссылки сохраняются, повторяющиеся колонтитулы и номера страниц удаляются
  • Двухколоночная вёрстка читается в правильном порядке
  • Извлечение изображений по желанию — ZIP с папкой images
  • Конфиденциально: PDF обрабатывается в браузере без загрузки

Частые вопросы

Что такое Markdown?

Markdown — формат простого текста, в котором структура задаётся простыми символами: # для заголовков, * для выделения, - для пунктов списка и | для таблиц. Его используют GitHub, GitLab, Obsidian, Notion, генераторы статических сайтов, системы документации и ИИ-ассистенты.

Что сохраняется из моего PDF?

Заголовки, абзацы, жирный и курсив, маркированные и нумерованные списки, простые таблицы, моноширинный код, ссылки и, если включить, изображения. Повторяющиеся колонтитулы и номера страниц удаляются.

Загружается ли мой PDF на сервер?

Нет. Преобразование полностью выполняется в браузере, файл не покидает ваше устройство.

Работает ли это со сканами?

Отсканированный PDF содержит только изображения текста. Сначала обработайте его инструментом PDF OCR, чтобы добавить текстовый слой, а затем преобразуйте результат в Markdown.

Как определяются заголовки?

Конвертер находит размер шрифта основного текста. Более крупные строки становятся заголовками: самый крупный размер — #, следующий — ##, меньшие — ###. Определение заголовков можно отключить.

Преобразуются ли таблицы?

Да. Строки, текст которых разбит на выровненные колонки, превращаются в таблицы Markdown со строкой заголовков. Очень сложные таблицы с объединёнными ячейками могут потребовать ручной правки.

Что происходит с изображениями?

По умолчанию преобразуется только текст. Включите «Извлекать изображения», чтобы получить ZIP с файлом .md и папкой images; каждое изображение вставлено там, где оно находится в документе.

Можно ли использовать результат с ChatGPT, Claude и другими ИИ?

Да. Markdown — один из лучших форматов для передачи документов языковым моделям: он сохраняет структуру и остаётся компактным.

Поддерживаются ли документы в две колонки?

Да. Если на странице две колонки текста, сначала читается левая, затем правая — строки не перемешиваются.

Можно ли преобразовать несколько PDF сразу?

Да. Добавьте несколько файлов — каждый будет обработан с одинаковыми настройками. Скачайте их по отдельности или вместе в ZIP.