Извлечение таблиц
Discover and install skills for AI agents.
AIclaude-office-skills
official
Данные
Что делает навык
Навык обеспечивает точное извлечение таблиц из PDF-документов с использованием библиотеки camelot, поддерживая сложные структуры, такие как объединенные ячейки и таблицы без границ. Он преобразует извлеченные данные в форматы pandas DataFrames для дальнейшей обработки.
Когда применять
- Извлечение всех таблиц из PDF-документа или конкретной страницы
- Конвертация таблиц из PDF в форматы Excel, CSV, JSON или HTML
- Анализ финансовых отчетов или научных статей для выделения структурированных данных
- Извлечение строк позиций из счетов-фактур (инвойсов)
- Сравнение таблиц между двумя версиями PDF-документов
Как работает
- Указать путь к PDF-файлу и опционально выбрать страницы для обработки
- Выбрать метод извлечения: lattice для таблиц с видимыми границами или stream для таблиц без границ
- При необходимости задать параметры чувствительности, отступы или конкретные области извлечения
- Получить результаты в виде объектов camelot, содержащих DataFrames и метаданные (точность, номер страницы)
- Экспортировать данные в требуемый формат (CSV, Excel, JSON, HTML) или обработать DataFrames программно
Примеры запросов агенту
Извлеки все таблицы из этого PDF-документа
Получи таблицу со страницы 5 отчета
Извлеки таблицы без границ из документа и сохрани их в Excel
Что понадобится
- Библиотека camelot
- PDF-файл (не зашифрованный)
- Python-окружение с поддержкой pandas
Описание составлено по SKILL.md навыка, сверено 05.10.2026.
Как подключить
1Скачать навык
# возьмите папку навыка «table-extractor» из репозитория:
# https://github.com/claude-office-skills/skills
2Положить папку с
SKILL.md к навыкам ассистента# положите папку навыка туда, где ассистент ищет skills:
cp -r table-extractor/ ~/.claude/skills/table-extractor/
Навык — папка с файлом SKILL.md (описание + инструкции) и опциональными скриптами. Ассистент (Claude, Claude Code и совместимые) подхватывает его по описанию и следует шагам.