Два новых инструмента для агентов
В Hermes Agent интегрированы две ключевые функции, доступные через вызовы моделей: web_search для поиска в сети с ранжированием результатов и web_extract для получения и извлечения читаемого контента с одной или нескольких ссылок. Настройка осуществляется через единый бэкенд, где провайдеры выбираются либо через интерфейс hermes tools, либо напрямую в config.yaml.
Доступные провайдеры и тарифы
Разработчики предлагают гибкий выбор бэкендов. Можно комбинировать разные провайдеры для поиска и извлечения. Например, использовать бесплатный SearXNG для поиска и Firecrawl для извлечения. Ниже приведена сводка по доступным опциям:
| Провайдер | Тип | Бесплатный тариф | Особенности |
|---|---|---|---|
| Firecrawl | Поиск + Извлечение | 500 кредитов/мес | По умолчанию, полная функциональность |
| SearXNG | Только поиск | Бесплатно (self-hosted) | Агрегатор 70+ поисковиков, приватность |
| Brave Search | Только поиск | 2 000 запросов/мес | Требует API ключ |
| DDGS (DuckDuckGo) | Только поиск | Бесплатно | Без ключа, использует пакет ddgs |
| Tavily | Поиск + Извлечение | 1 000 поисков/мес | Оптимизировано для AI |
| Exa | Поиск + Извлечение | 1 000 поисков/мес | Нейросетевой семантический поиск |
| xAI (Grok) | Только поиск | Платно | Результаты генерируются LLM, не индексные |
Умная обработка длинных страниц
Чтобы не перегружать контекстное окно и снизить затраты, инструмент web_extract автоматически сжимает контент перед передачей агенту. Логика зависит от размера страницы (в символах):
- До 5 000 символов: контент возвращается в исходном виде (markdown), без вызова LLM.
- 5 000 – 500 000 символов: однократное суммирование через вспомогательную модель, вывод ограничен ~5 000 символами.
- 500 000 – 2 000 000 символов: разбивка на чанки по 100к символов, параллельное суммирование каждого и синтез итогового резюме (~5 000 символов).
- Более 2 000 000 символов: запрос отклоняется с рекомендацией использовать более узконаправленный URL.
Суммаризация сохраняет цитаты, блоки кода и ключевые факты. Если процесс терпит неудачу, Hermes возвращает первые 5 000 символов сырого контента.
Настройка и оптимизация затрат
По умолчанию для суммаризации используется основная модель чата. Для экономии средств на дорогих моделях (например, Opus) рекомендуется перенаправить вспомогательную задачу на более дешевые модели, такие как google/gemini-flash-preview через OpenRouter. Настройка осуществляется в config.yaml или через команду hermes model.
Для пользователей с платной подпиской Nous Portal доступны инструменты через Tool Gateway с управляемым Firecrawl без необходимости ввода API-ключей. Для локального развертывания SearXNG рекомендуется использовать Docker, что обеспечивает отсутствие лимитов и полную приватность.
Источник: Nousresearch ↗
