Новости про GitHub
992 материалов с упоминанием GitHub: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице GitHub.
-
NVIDIA VA-API 0.0.18: исправление артефактов HEVC и поддержка Chrome на Wayland
Вышла версия 0.0.18 открытого драйвера NVIDIA VA-API. Обновление устраняет артефакты при декодировании HEVC, добавляет поддержку аппаратного ускорения в Chrome/Chromium через прямой бэкенд и готовит почву для кодирования
-
CTA: Как линейные зонды учатся видеть концепции внутри LLM
Исследователи представили CTA — метод, который объясняет не то, какой токен сгенерирует модель, а почему в её скрытых слоях возникает конкретная концепция. Это прорыв в механистической интерпретируемости.
-
LAION выпустила BVD: 80 млн видео и 300 млн кадров для мультимодального обучения
Лаборатория LAION представила крупнейший открытый датасет LAION-BVD объемом 10 млн часов видео. Модель ViCLIP на этих данных превосходит аналоги на 2,1%.
-
AMD ROCm на FreeBSD: итоги стажировки и путь к HMM
Стажер Sourojeet Adhikari завершил работу по портированию стека вычислений AMD ROCm на FreeBSD. Проект достиг важного этапа: драйвер способен загрузить и выполнить простую задачу сложения векторов.
-
Turbovec: векторный поиск на Rust быстрее FAISS и в 8 раз компактнее
Библиотека turbovec использует алгоритм TurboQuant для сжатия индекса в 8 раз (с 31 ГБ до 4 ГБ) и обеспечивает ускорение поиска до 3.5x по сравнению с FAISS на ARM и x86.
-
macOS Harness: LLM-агент с полным доступом к системе без фреймворков
Новый open-source инструмент macOS Harness позволяет языковым моделям управлять Mac напрямую через Python, используя нативные API вместо специфичных инструментов для каждого приложения.
-
V-RAE: 4x сжатие видео без потери семантики и точности
Новая архитектура V-RAE достигает 90.92% точности на UCF101, сохраняя визуальную структуру после 4-кратного временного сжатия.
-
ScreenCoder: Превращаем скриншоты в чистый HTML/CSS с помощью мультиагентной ИИ-системы
Исследователи из CUHK представили ScreenCoder — систему на базе модульных мультимодальных агентов, которая генерирует готовый к продакшену HTML/CSS-код прямо из скриншотов или макетов дизайна.
-
MaskVidExperiments: Как ComfyUI победил дрожание видео при инпейнтинге
Новый пакет нод для ComfyUI решает проблему «дрожания» камеры при обработке видео: стабильная обрезка вокруг объекта и корректная работа масок в латентном пространстве.
-
Collaborator: бесконечный холст для AI-агентов с локальным хранением
Новый open-source инструмент Collaborator объединяет терминалы, редакторы кода и AI-агентов на едином бесконечном холсте, исключая необходимость переключения вкладок.
-
Rembg: Удаление фона на Python с поддержкой GPU и 4 режимами обработки краев
Open-source инструмент Rembg обновился, добавив поддержку AMD ROCm, гибкие режимы обработки краев (alpha matting, decontamination) и интеграцию с API без загрузки моделей.
-
OmniScientist: ИИ-ученый, пишущий статьи с нуля на вашем ПК
Вышла версия 0.1.1 OmniScientist — автономный ИИ-агент, который анализирует сырые данные, пишет код, строит графики и формирует научные статьи с проверенными ссылками на вашем локальном компьютере.
-
103 скилла для Claude Code: от бренда до SEO за секунды
Библиотека RampStack превращает Claude в полноценную команду разработки, предлагая 103 готовых сценария для создания веб-приложений, брендинга и SEO-аудита.
-
418 AI-моделей в одном репозитории: Ailia упрощает запуск SOTA-решений
Проект Ailia-Models объединил 418 предварительно обученных нейросетей — от LLM до детекции объектов — с единым интерфейсом CLI, устраняя барьеры для внедрения AI в кроссплатформенные приложения.
-
Jacobian Lens от Anthropic: как заглянуть в скрытые слои LLM
Anthropic представила Jacobian Lens (J-lens) — инструмент интерпретируемости, исправляющий ошибки Logit Lens и позволяющий видеть «мысли» модели до генерации ответа.
-
OpenBot: доверенные AI-сотрудники с изолированными браузерами и аудитом
CopilotKit представили OpenBot — платформу для запуска AI-агентов в собственной инфраструктуре с изолированными окружениями, детальной политикой доступа и полным аудитом действий.
-
4DAnyone: Создание 4D-аватара из одного видео без калибровки
Исследователи из Zhejiang University и Ant Group представили 4DAnyone — метод генерации фотореалистичных 4D-аватаров из одного случайного монокулярного видео без использования спецоборудования.
-
WithEveryone: новый SOTA в генерации мультиперсон
Модель GPT-Image-2 от проекта WithEveryone демонстрирует рекордное сходство ArcFace (0.614) при генерации изображений с несколькими людьми, превосходя аналоги.
-
SenseNova-U1.5-8B: Нативное 4K, 8-шаговая генерация и новый стандарт MLLM
OpenSenseNova выпустила SenseNova-U1.5-8B-MoT — модель с архитектурой NEO-unify, способную генерировать изображения в нативном 4K за 8 шагов и точно следовать сложным инструкциям.
-
Interlace: Мультипоточность для любых CLI-утилит в Linux
Разработчики представили Interlace — инструмент, превращающий однопоточные консольные утилиты в высокопроизводительные сканеры. Поддержка CIDR, глобусов и гибкое управление потоками ускоряют пентесты без написания кода.
-
CMD: новый метод дистилляции для ускорения LLM без потери качества
Исследователи представили Context-Matched Distillation (CMD) — метод, который позволяет малым языковым моделям достигать производительности больших моделей, обучаясь на контекстно-согласованных данных.
-
OpenLLM: Запуск LLM одной командой с поддержкой Llama 3.3 и Qwen2.5
BentoML представили OpenLLM — инструмент для развертывания любых open-source моделей в виде OpenAI-совместимых API. Поддержка Llama 3.3, Qwen2.5 и встроенный UI делают самохостинг LLM проще.
-
Frame Extractor: Оптимизация COLMAP через оптический поток
Новый инструмент на базе OpenCV DIS автоматически отбирает ключевые кадры для SfM-пайплайнов, сокращая время реконструкции в COLMAP за счет интеллектуального анализа движения.
-
OmniScientist: AI-ученый, пишущий статьи в 20+ дисциплинах
Команда из NUS и Оксфорда представила OmniScientist — систему, самостоятельно проводящую исследования в сейсмологии, астрономии и медицине, находя скрытые закономерности в данных.
-
TIPSv2 от Google DeepMind: прорыв в выравнивании патчей и сегментации
Google DeepMind представила TIPSv2 — новую архитектуру предобучения, которая превосходит более крупные модели в zero-shot сегментации за счет инновационных методов обучения.
-
Hyperfine v1.20.0: эталонный бенчмарк для CLI с автокалибровкой
Вышла версия 1.20.0 утилиты Hyperfine — мощного инструмента для измерения времени выполнения команд в терминале. Разбираем ключевые возможности для точного сравнения производительности.
-
Agentic RAG на LangGraph: гибрид точности и контекста
Новый open-source проект от Giovanni Pasq демонстрирует, как построить модульную Agentic RAG-систему с самокоррекцией, уточнением запросов и параллельным поиском, используя LangGraph и Qdrant.
-
Kuboard: 10k+ звезд и 1000+ компаний. Обзор UI для K8s
Kuboard, бесплатный интерфейс управления Kubernetes, достиг отметки в 10 000 звезд на GitHub и используется в продакшене более 1000 компаний. Разбираем ключевые функции и преимущества перед Dashboard.
-
Muse V2: Локальный LLM-чат в ComfyUI с поддержкой видео и аудио
Вышла версия 2.0 узла ComfyUI-Muse, интегрирующая многопоточный чат с локальными LLM прямо в граф. Теперь поддерживается загрузка моделей без сторонних серверов, а также прикрепление аудио и видео.
-
ComfyUI-MiniMax-H3-Studio: Превращаем видео-модель в инструмент для генерации изображений
Новый узел H3 Studio позволяет использовать мультимодель MiniMax H3 для генерации изображений, предлагая продвинутые функции референсов, ускорения LightX и авто-улучшения лиц.