nomic-ai/gpt4all

GPT4All: Запускайте локальные LLM на любом устройстве. Открытый исходный код, доступен для коммерческого использования.

Инференс⭐ 77 392C++последний релиз: v3.10.0
Открыть на GitHub ↗Сайт проекта ↗

Что это за инструмент

GPT4All — это open-source приложение и Python-библиотека для запуска больших языковых моделей (LLM) локально на обычных компьютерах без необходимости в GPU или API.

Зачем нужен

Инструмент позволяет работать с LLM полностью приватно, обрабатывая данные на устройстве пользователя. Он устраняет зависимость от облачных сервисов и дорогостоящего оборудования, делая доступным использование моделей, таких как Llama 3 и DeepSeek R1 Distillations, на повседневных ноутбуках и десктопах.

Что можно реализовать

  • Локальный чат с документами (LocalDocs) для анализа личных данных без отправки их в сеть
  • Интеграция LLM в Python-проекты через библиотеку gpt4all для создания автономных приложений
  • Запуск LLM на устройствах с ограниченными ресурсами (Intel Core i3, AMD Bulldozer, Apple Silicon)
  • Использование в качестве бэкенда для Langchain или Weaviate Vector Database
  • Развертывание локального API-сервера с интерфейсом, совместимым с OpenAI, через Docker

Ключевые возможности

  • Работа без GPU и API-вызовов, оптимизация под CPU
  • Поддержка архитектуры GGUF и квантованных моделей (Q4_0, Q4_1)
  • Возможность GPU-инференса через Nomic Vulkan для NVIDIA и AMD карт
  • Кроссплатформенность: Windows, macOS, Linux (включая ARM и x86-64)
  • Open-source лицензия, разрешающая коммерческое использование

👤 Кому подойдёт: разработчики, исследователи, пользователи, ценящие приватность данных, и разработчики, ищущие легковесное решение для локального запуска LLM без сложной инфраструктуры

Релизы

v3.10.0minor
🕐 19 мес назад · релиз на GitHub ↗

GPT4All v3.10.0: поддержка удалённых моделей (Groq, OpenAI, Mistral), CUDA 5.0, Granite и улучшенные шаблоны чата.

  • Added: Добавлена поддержка удалённых моделей через Groq, OpenAI и Mistral с удобным интерфейсом настройки.
  • Added: Расширена совместимость CUDA: теперь поддерживаются GPU с вычислительной способностью 5.0 (например, GTX 750).
  • Added: Добавлена поддержка новой модели Granite (non-MoE) и улучшены шаблоны чата для OLMoE и Granite 3.1.
  • Fixed: Исправлено поведение пробелов в выводе моделей на базе DeepSeek-R1 и устранены причины возможных сбоев приложения.
  • Added: Значительно улучшен перевод интерфейса на упрощённый китайский язык и обновлён итальянский перевод.