onepagers — это набор точечных инструментов для извлечения данных из PDF. Каждый создан для определённого семейства документов и сохраняет связь факта с источником.
Сейчас есть инструменты для PDF Closing Disclosure и Loan Estimate, юридических discovery-продукций и налоговых форм K-1 или 1099.
Он находит сумму займа, процентную ставку, ежемесячный платёж по основному долгу и процентам, расходы при закрытии, cash to close, срок и имя кредитора в поддерживаемых ипотечных PDF.
Он создаёт первичный индекс дат, сторон, денежных сумм, приложений и ссылок Bates, добавляя исходный файл и страницу к каждому результату.
Он распознаёт поддерживаемые макеты K-1 и 1099, сопоставляет значения полей и показывает поле, страницу, уверенность и использованный текст для каждого результата.
Зависит от инструмента. Discovery использует OCR для страниц без пригодного текстового слоя; ипотечному и налоговому экстракторам нужен выделяемый текст. Перед загрузкой PDF-изображения выполните OCR.
Да. В зависимости от инструмента отображаются файл, страница, поле формы, ссылка Bates, соседний текст или выделенная область источника.
Они показывают, насколько хорошо экстрактор сопоставил значение с ожидаемой подписью, полем или исходным текстом. Используйте их для приоритета проверки, а не как гарантию.
В K-1 Extractor можно редактировать значения в таблице проверки и экспортировать проверенные строки. Остальные инструменты дают свои экспорты, но не встроенную таблицу исправлений.
Загрузка принимает PDF. Документы Word, изображения, таблицы и другие форматы напрямую не принимаются.
Бесплатная обработка во всех инструментах ограничена 8 MB и 15 страницами. Discovery принимает до 50 PDF и один PDF до 80 страниц; K-1 — до 25 страниц, а ипотечный экстрактор использует бесплатный предел в 15 страниц.
Discovery принимает до 50 PDF в одной партии. Closing и K-1 обрабатывают по одному PDF за проверку.
Файлы сверх бесплатного предела, если инструмент это поддерживает, отправляются в очередь тяжёлой обработки. Discovery отклоняет больше 50 PDF или PDF длиннее 80 страниц; K-1 отклоняет PDF длиннее 25 страниц.
Байты PDF удаляются после обработки. Текущая проверка сохраняет результаты и метаданные источника в рамках сессии, но истории документов нет.
Нет. Согласно текущему описанию продукта, загруженные документы не используются для обучения моделей, а содержимое файлов недоступно сотрудникам.
Публичный интерфейс — это загрузка через браузер. В этой версии нет публичного документированного API с регистрацией разработчика и ключами.
Точность зависит от макета документа, текстового слоя, качества сканирования и сходства PDF с поддерживаемой формой. Важные значения проверяйте по оригиналу.
Браузерные инструменты можно пробовать в пределах бесплатной обработки. Цена и платёжный процесс для платной обработки пока не опубликованы.
Да. В зависимости от инструмента можно скачать CSV или JSON, а также проверенный CSV из экрана проверки K-1.
Для тех, кто регулярно проверяет ипотечные раскрытия, юридические discovery-продукции или налоговые формы и хочет структурированные факты с сохранёнными источниками.