Добавлена поддержка аудио и видео как полноценных модальностей, прямая обработка медиафайлов и извлечение изображений из Markdown.
- Added: Аудио и видео стали полноценными модальностями: добавлены AudioModalProcessor (faster-whisper) и VideoModalProcessor (SceneDetect + OpenCV + VLM) с оконной обработкой длинных файлов.
- Added: Медиафайлы (mp3, mp4 и др.) теперь можно передавать напрямую в process_document_complete, минуя парсер документов, с автоматическим хешированием для дедупликации.
- Added: Изображения из ссылок Markdown () теперь корректно извлекаются и обрабатываются через тот же мульти модальный конвейер, что и картинки из PDF.
- Fixed: Исправлена порча sys.modules в тестах из-за некорректного teardown в test_modalprocessors_config.py, устраняющая зависимость результатов от порядка запуска.
- Added: Добавлены рекомендации по настройке моделей Whisper (WHISPER_MODEL=medium) для улучшения распознавания китайской речи и устранения искажений имен собственных.