Новости про GitHub
992 материалов с упоминанием GitHub: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице GitHub.
-
OpenSERP 2.1: Мульти-поиск по Google, Yandex и Baidu для LLM и SEO
Вышла версия 2.1 OpenSERP — open-source API для агрегации результатов поиска из Google, Yandex, Baidu, Bing и других движков. Инструмент ориентирован на RAG-пайплайны, SEO-трекинг и работу с русскоязычным/китайским сегме
-
Comfy-MSS: Профессиональное разделение звука в ComfyUI
Новый набор кастомных нод для ComfyUI интегрирует мощный Python-движок pymss, позволяя разделять аудио на стемы с поддержкой моделей VR/UVR и MSS.
-
Яндекс выпустил плагин YaGS для 3D Gaussian Splatting в Unreal Engine 5
Команда Яндекса открыла исходный код плагина YaGS, позволяющего интегрировать 3D Gaussian Splatting в UE 5.5–5.7 с корректной обработкой глубины, инстансингом и нелинейным редактированием сцен.
-
35 агентных архитектур ИИ: открытый бенчмарк и библиотека
Разработчик FareedKhan выпустил библиотеку agentic-architectures, объединяющую 35 паттернов ИИ-агентов с единым интерфейсом и реальным бенчмарком на базе Llama-3.3-70B.
-
OpenScience: Open-source AI-лаборатория для науки с 290+ навыками
Компания Synthetic Sciences выпустила OpenScience — локальную AI-рабочую среду для научных исследований, способную самостоятельно проводить обзор литературы, писать код, запускать эксперименты и составлять отчеты.
-
PhotoQuilt: Генерация фотомозаик 14K без дообучения моделей
Исследователи из Университета Торонто и Samsung представили PhotoQuilt — метод создания сверхвысоких фотомозаик (до 14 336 px) без дообучения диффузионных моделей.
-
Portkey Gateway 2.0: Open-source шлюз с задержкой <1мс и поддержкой 250+ LLM
Portkey AI выпустил pre-release версию 2.0 своего open-source AI Gateway. Решение обеспечивает маршрутизацию к 250+ моделям, задержку менее 1 миллисекунды и обработку 10 млрд токенов ежедневно.
-
No-mistakes: ИИ-прокси для Git, который чистит код до пуша
Новый инструмент No-mistakes ставит локальный прокси между разработчиком и удаленным репозиторием, автоматически исправляя ошибки и создавая чистые PR с помощью ИИ-агентов.
-
Orca: мультиагентная IDE для параллельной работы с Claude, Codex и другими
Stably AI выпустила Orca — open-source среду, позволяющая запускать до 100+ AI-агентов одновременно в изолированных worktree, с мобильным управлением и интеграцией в Git.
-
Hugging Face Kernels: Новый тип репозиториев, подпись кода и агенты
Hugging Face представил новый тип репозиториев 'kernel', внедрил обязательную подпись кода через Sigstore и добавил поддержку Torch Stable ABI и Apache TVM FFI для безопасного распределения оптимизированных ядер.
-
DXVK 3.0.1: Стабильность важнее FPS. Что изменилось в обновлении для Linux
Вышло первое обновление DXVK 3.0.1, которое жертвует небольшой производительностью ради устранения критических зависаний GPU и исправления регрессий в Direct3D 9. Разбираем технические детали.
-
Voicebox: локальный клонер голосов с 7 движками TTS и Whisper
Open-source студия Voicebox объединяет синтез речи, клонирование голосов и диктовку в одном приложении, работая полностью офлайн на вашем железе.
-
GEAR: Прорыв в генерации изображений, решающий проблему «застывших» токенизаторов
Исследователи представили GEAR — метод автогенерации изображений, который устраняет фундаментальный конфликт между качеством реконструкции и предсказуемостью токенов, характерный для VQGAN.
-
AIKraft: ИИ диагностирует поломку авто по звуку с точностью до 75%
Проект cardiag демонстрирует, как можно использовать аудио с телефонов для первичной диагностики автомобиля. Система не ставит окончательный диагноз, но с высокой вероятностью указывает на зону неисправности.
-
Agent-Native: Единый интерфейс для людей и ИИ-агентов
Появился фреймворк Agent-Native, позволяющий создавать приложения, где люди и ИИ-агенты используют одни и те же действия, состояние и контекст через единый интерфейс.
-
Ente: Open Source E2E-шифрование для фото, паролей и 2FA
Ente представил полностью открытую платформу с end-to-end шифрованием, включающую сервисы для фото, аутентификаторов и хранения документов.
-
LTX-2: Первая DiT-модель с синхронным аудио и видео
Lightricks представила LTX-2 — первую модель на архитектуре DiT, генерирующую видео и звук в едином контуре. Модель обеспечивает точную синхронизацию речи, движения и аудио, предлагая открытые веса и API.
-
MrFlow: ускорение FLUX и Qwen-Image в 10 раз без дообучения
Исследователи представили MrFlow — метод ускорения диффузионных моделей за счет двухэтапной генерации. Решение дает до 25x прироста скорости на Z-Image и Krea-2 без потери качества.
-
Wan Video: ИИ научился создавать танцевальные видео по аудио
Платформа Wan Video представила новую функцию генерации видео, где персонажи синхронно танцуют под загруженный музыкальный трек.
-
Berkeley Humanoid Lite: Доступный гуманоид за $5000 с 3D-печатью
Команда из Калифорнийского университета в Беркли представила Berkeley Humanoid Lite — открытую платформу для исследований, стоимость которой не превышает $5000 благодаря модульным редукторам и доступным компонентам.
-
OpenMontage: Автономная студия видео-продакшена за копейки
Open-source система OpenMontage превращает текстовый промпт в готовое видео, используя AI-агентов для сценария, поиска стоков и монтажа. Стоимость примеров — от $0.02 до $1.33.
-
Obscura: Rust-браузер для AI-агентов бьет Chrome по скорости
Команда Obscura представила сверхлегкий headless-браузер на Rust, который в 7 раз быстрее Chrome и потребляет в 6 раз меньше памяти, став идеальной основой для парсинга и AI-агентов.
-
Fable 5: Как AI находит «слепые зоны» в коде до написания строчки
Новый гайд по Fable 5 демонстрирует, как использовать Claude для выявления неочевидных рисков на этапах планирования, разработки и ревью, превращая интуитивные догадки в структурированные технические решения.
-
pxpipe: как превращение текста в картинки снизило счет за Claude на 70%
Проект pxpipe предлагает радикальный метод экономии токенов в LLM: прокси-сервер конвертирует объемный контекст (системные промпты, логи, историю) в PNG-изображения. Это снижает затраты на 59–70% за счет более высокой пл
-
Mistral AI выпустила Leanstral 1.5: прорыв в доказательстве теорем
Mistral AI представила Leanstral 1.5 — модель на базе Lean 4, решившую 587 из 672 задач PutnamBench. Модель работает по лицензии Apache 2.0, доступна бесплатно и превосходит аналоги по стоимости и точности.
-
Штрафы до 700 тыс. руб. за Google Login: как пережить переход на российские ID
С 1 декабря 2023 года вступили в силу штрафы по ст. 13.55 КоАП за использование иностранных провайдеров авторизации. Разбираем, какие российские альтернативы законны, почему Госуслуги не подходят для малого бизнеса и как
-
RLM: Рекурсивные языковые модели для бесконечного контекста
Лаборатория MIT OASYS представила RLMs — парадигму, позволяющую LLM разбивать задачи на подзадачи и вызывать сами себя, преодолевая ограничения длины контекста.
-
Interfaze выпустила первый открытый диффузионный ASR: 6.6% WER на LibriSpeech
Стартап Interfaze (YC) открыл код модели diffusion-gemma-asr-small. Это первый мультязычный ASR на базе диффузии, использующий 26B-модель Google как бэкбон и обучивший всего 42M параметров.
-
AI-агенты без «обвязки» бесполезны: разбор архитектуры от OpenAI, Anthropic и Microsoft
GitHub-репозиторий Awesome Harness Engineering систематизирует лучшие практики создания инфраструктуры для ИИ-агентов. Разбор показывает, что успех зависит не от модели, а от архитектуры: контекста, памяти и безопасности
-
RL3DEdit: Редактирование 3D-сцен через RL и VGGT
Команда AMAP-ML опубликовала код и веса RL3DEdit — системы на базе FLUX-Kontext-dev, использующей VGGT как модель вознаграждения для создания мульти-видово согласованных 3D-сцен.