Архитектурный сдвиг: от конвейера к одному проходу
Reducto выпустила модель r-1, которая кардинально меняет подход к парсингу документов. В отличие от предыдущих версий, где распознавание текста, обнаружение макета и постобработка выполнялись как отдельные этапы с вызовами различных моделей, r-1 объединяет все эти задачи в едином полном проходе по странице (single full page pass).
Модель одновременно извлекает:
- Текст (включая цифровой, сканированный и рукописный);
- Структуру таблиц с учетом контекста страницы, объединенных ячеек и вложенных заголовков;
- Чтение порядка (reading order) для колонок, заголовков, подвалов;
- Семантическое форматирование (заголовки, списки, жирный шрифт, зачеркивания);
- Грундинг (bounding boxes относительно страницы) для каждого блока.
Это решает проблему оркестрации: командам больше не нужно маршрутизировать файлы между несколькими провайдерами и «наращивать» точность постобработкой.
Ключевые метрики и сравнения
Reducto заявляет о существенном улучшении показателей по сравнению с собственной предыдущей агентной системой и крупными облачными решениями. Важно отметить, что снижение ошибки на 20% измерено относительно внутренних пайплайнов Reducto, а сравнение с AWS и Azure проведено в закрытых тестах без публикации датасетов.
| Параметр | Reducto r-1 (Preview) | Legacy Agentic (Reducto) | Базовые облачные решения (AWS/Azure) |
|---|---|---|---|
| Стоимость | 1 цент за страницу (flat rate) | 3–6 центов за страницу | Информация недостаточна (обычно выше) |
| Точность (Error Rate) | -20% ошибок относительно legacy | База сравнения | Уступает в сложных макетах (по заявлению Reducto) |
| Архитектура | Single Pass (единый проход) | Multi-stage pipeline | Multi-stage / LLM-based |
| Доступность | Preview, V3 API | Стандартная | Production |
Технические детали и миграция
Модель r-1 доступна в режиме preview через Parse API V3. Открытых весов (open weights) для локального хостинга нет. Для переключения на новую модель в запросе необходимо указать флаг:
settings.model = "r-1"
Если параметр не указан, система продолжит использовать legacy-парсер, что предотвращает скрытые сбои. Для новых пайплайнов в Studio r-1 установлен по умолчанию.
Агентная обработка не исчезла полностью: для сложных случаев (кастомные промпты, извлечение графиков) данные из r-1 могут дополнительно обрабатываться агентным конвейером, что добавляет задержку. Reducto также анонсировала будущие модели r-1 mini для задач, чувствительных к скорости и стоимости, и систему автоматической маршрутизации страниц.
Для кого это важно
Решение нацелено на индустрии с высокими требованиями к точности: финансы, страхование, юридическая сфера. Ошибка в распознавании зачеркнутого текста или структуры таблицы может привести к неверному выводу агента, что критично в регулируемых отраслях. Reducto предлагает компаниям, переходящим с других парсеров, кредиты до $5,000 для сравнительного тестирования.
Источник: MarkTechPost ↗
