PDF в Markdown — извлеките текст для заметок в браузере
Извлеките текст PDF в Markdown в браузере для заметок или LLM — файл остаётся на устройстве и не загружается на сервер. Шаги: выберите PDF с текстовым слоем, Конвертировать, просмотр, скачать .md. Пример: образец одной страницы даёт .md с «Hello PDF to Markdown sample.» Скан без OCR не сработает. Зашифрованные — понятная ошибка.
Как это работает
Выберите PDF, Конвертировать, проверьте предпросмотр, скачайте .md. Строки по вертикали; страницы через ---. Всё во вкладке после загрузки библиотек—файл не уходит на сервер.
Ожидаемые правила
Извлечение текстового слоя, разделители, без OCR, конфиденциальность и сбои.
- Движок: getTextContent на страницу; близкий y → строки через пробел.
- Страницы: пустая строка + --- + пустая строка между страницами.
- Без OCR: пустой trim → явный сбой.
- Лимиты: байты во вкладке; шифр/повреждение — ясная ошибка; >~25 МБ может тормозить.
Пример
Образец создаёт одностраничный PDF Helvetica, конвертирует, показывает фразу в предпросмотре и включает Скачать .md.
Подходящие сценарии
- Офис: копируйте пункты договора в заметки без перепечатки.
- Авторы и ИИ: экспорт отчётов в Markdown для правок или промптов.
- Студенты: текст лекций из PDF с текстовым слоем.
Frequently asked questions
Загружается ли PDF?
Нет. рендерер страниц работает во вкладке (скрипты могут грузиться с CDN). PDF не отправляется на наши серверы.
Почему скан не работает?
Скан обычно картинка без текстового слоя. Без OCR извлечение пустое — явная ошибка.
Сохраняются ли заголовки или таблицы?
Не восстанавливает заголовки и таблицы — простой текст по позиции.
Чем отличается от Markdown в HTML?
Markdown в HTML превращает синтаксис Markdown в веб-страницу. Этот инструмент экспортирует текст PDF в .md.
Когда использовать PDF в JPG?
PDF в JPG растеризует каждую страницу. Используйте этот инструмент, когда нужен редактируемый текст.
Вопросы и отзывы
Что-то неясно, сломано или отсутствует? Напишите сообщение ниже — мы читаем каждую заметку об этих инструментах.