hegelai/prompttools

Инструменты с открытым исходным кодом для тестирования и экспериментов с промптами, поддерживающие LLM (например, OpenAI, LLaMA) и векторные базы данных (например, Chroma, Weaviate, LanceDB).

Инструменты⭐ 3 055Pythonпоследний релиз: v0.0.45
Открыть на GitHub ↗Сайт проекта ↗

Что это за инструмент

PromptTools — это open-source библиотека для тестирования, экспериментов и оценки качества работы LLM, векторных баз данных и промптов.

Зачем нужен

Инструмент позволяет разработчикам быстро сравнивать ответы разных моделей (например, OpenAI, LLaMA, Anthropic) при одинаковых входных данных, что критично для выбора оптимальной конфигурации. Он также поддерживает оценку точности извлечения информации (retrieval accuracy) в RAG-системах через интеграцию с векторными базами данных.

Что можно реализовать

  • A/B-тестирование промптов и параметров (temperature, top_p) на нескольких LLM одновременно
  • Оценка качества работы RAG-пайплайнов и сравнение эффективности разных векторных баз данных
  • Локальный запуск плейграунда для интерактивного экспериментирования с моделями
  • Экспорт результатов экспериментов в CSV, JSON или MongoDB для дальнейшего анализа

Ключевые возможности

  • Поддержка широкого спектра LLM: OpenAI, Anthropic, LLaMA, HuggingFace, Google Gemini, Mistral, Azure и др.
  • Интеграция с векторными БД: Chroma, Weaviate, Qdrant, LanceDB, Pinecone, Milvus
  • Простой API для запуска экспериментов в коде, Jupyter Notebooks или через Streamlit-плейграунд
  • Полная приватность: данные и API-ключи остаются на локальной машине, нет передачи на сторонние серверы
  • Встроенная визуализация результатов экспериментов

👤 Кому подойдёт: разработчики, работающие с LLM и RAG, ML-инженеры, исследователи, оценивающие качество моделей и промптов

Релизы

v0.0.45major
🕐 33 мес назад · релиз на GitHub ↗

Запуск приватной беты observability для мониторинга LLM, интеграция с OpenAI Moderation API и обновление до версии клиента 1.0+.

  • Added: Добавлена observability на хостинговой платформе: мониторинг и оценка использования LLM в продакшене одной строкой кода.
  • Added: Интеграция OpenAI Moderation API как функции оценки для проверки ответов любых LLM на нарушение политик безопасности.
  • Added: Доступно API для логирования в продакшене (по запросу).
  • Fixed: Обновлены эксперименты и примеры для использования последних функций и Python API OpenAI (требуется версия 1.0+).