zilliztech/GPTCache

Семантический кэш для LLM. Полная интеграция с LangChain и llama_index.

Инструменты⭐ 8 197Pythonпоследний релиз: 0.1.44
Открыть на GitHub ↗Сайт проекта ↗

Что это за инструмент

GPTCache — это библиотека для создания семантического кэша запросов к LLM, которая сохраняет ответы на основе их смыслового сходства, а не точного совпадения текста.

Зачем нужен

Инструмент решает проблему высоких затрат на API и медленного отклика при большом количестве запросов к большим языковым моделям. Он полезен для снижения расходов на вызовы LLM (до 10 раз) и ускорения получения ответов (до 100 раз), переиспользуя ранее полученные результаты для похожих вопросов.

Что можно реализовать

  • Чат-боты с высокой нагрузкой, где пользователи часто задают одинаковые или схожие вопросы
  • Интеграция кэширования в существующие приложения на базе LangChain или llama_index без переписывания логики
  • Развертывание кэширующего сервера через Docker для использования в мультиязычных проектах
  • Оптимизация затрат на платные API LLM в продакшен-средах с большим трафиком

Ключевые возможности

  • Семантическое сопоставление: кэш срабатывает на похожие по смыслу запросы, а не только на точные совпадения
  • Глубокая интеграция с LangChain и llama_index, что упрощает внедрение в популярные фреймворки
  • Поддержка мультиязычности через отдельный Docker-сервер GPTCache
  • Автоматическая установка зависимостей при подключении новых функций
  • Гибкий API для ручного управления кэшем (get/set), так как поддержка новых моделей API больше не добавляется

👤 Кому подойдёт: разработчики, использующие Python и LLM, инженеры по машинному обучению, архитекторы AI-приложений

Релизы

0.1.44patch
🕐 26 мес назад · релиз на GitHub ↗

Исправлена ошибка с нулевым кэшем при использовании init_similar_cache и обновлена версия до 0.1.44.

  • Fixed: Устранена ошибка, приводившая к nil-памяти при вызове метода init_similar_cache.
  • Версия библиотеки обновлена до 0.1.44.