Инструменты

PDF → Markdown

Документ разбирается прямо во вкладке браузера: Python работает в WebAssembly, файл никуда не загружается. Тот же принцип, что и в самом облаке — данные остаются у вас.

pdf2md — выполняется на вашем устройстве
Загружается Python… Первый запуск скачивает Pyodide, около 15 МБ
Инициализация…


            

            

Разбор идёт в основном потоке вкладки, поэтому на объёмных документах страница на минуту-другую перестаёт отвечать — это нормально, дождитесь конца. Если текста в PDF нет, страницу можно распознать здесь же: движок OCR лежит на этом домене, документ так же никуда не отправляется.

Как это устроено

Приватность как в облаке — только без облака

Страница не отправляет документ никуда: весь разбор происходит в вашем браузере.

Ничего не уходит в сеть

PDF открывается прямо во вкладке, а разбирает его Python в WebAssembly. Ни исходный файл, ни результат не попадают на сервер.

Таблицы и структура

Таблицы распознаются по разлиновке и по выравниванию текста, нумерованные строки становятся заголовками, колонтитулы и оглавление отбрасываются.

Готовый markdown

Результат сохраняется файлом .md или копируется в буфер — и сразу отправляется в общую папку команды.

Храните результат там, где его никто не прочитает

Готовый markdown можно положить в зашифрованное пространство команды — с историей версий и защищёнными ссылками.