Новости про GitHub
992 материалов с упоминанием GitHub: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице GitHub.
-
GenRecon: Генеративные модели создают 3D-сцены из 8 фото
TUM и Huawei представили GenRecon — метод, использующий prior Trellis.2 для реконструкции целых помещений из нескольких фото с точностью на 16% выше аналогов.
-
Google представил TabFM: zero-shot модель для табличных данных
Google Research выпустила TabFM — фундаментальную модель для классификации и регрессии, которая заменяет ручную настройку XGBoost одним проходом через контекст.
-
Maestro: Open-source фреймворк для UI-тестирования без компиляции
Mobile.dev представил Maestro — кроссплатформенный инструмент для E2E-тестирования Android, iOS и Web, использующий YAML-синтаксис и встроенное AI-помощник.
-
ShutterMuse: MLLM для фотосъемки в реальном времени с точностью до ключевых точек
Исследователи представили ShutterMuse — мультимодальную модель, которая помогает фотографу кадрировать снимок, а модели — корректировать позу субъекта прямо во время съемки.
-
WebBrain: локальный AI-агент для браузера с защитой от инъекций
Emre Sokullu представил WebBrain — open-source расширение для Chrome и Firefox, которое автоматизирует задачи через локальные LLM, обеспечивая полную приватность данных.
-
NeuMatEx от NVIDIA: извлечение нейроматериалов из фото в реальном времени
Исследователи NVIDIA представили NeuMatEx — метод обратного рендеринга, извлекающий сложные нейроматериалы из многовидовых изображений, превосходящий PBR по детализации отражений.
-
Puter: Open-Source альтернатива облаку с AI и серверными функциями
Проект Puter позиционирует себя как полнофункциональный интернет-компьютер с открытым исходным кодом, предлагающий хранилище, базы данных и серверные Workers для разработчиков.
-
Supervision 0.16.0: Универсальный SDK для CV-разработки на Python
Roboflow выпустила обновление библиотеки Supervision, упрощающее интеграцию моделей компьютерного зрения. Инструмент стал полностью модель-агностичным, поддерживая Ultralytics, MMDetection и другие фреймворки.
-
Instok3D: Объектно-ориентированная 3D-сцена без аннотаций
Исследователи представили Instok3D — feed-forward модель, которая реконструирует 3D-сцены из некалиброванных изображений, выделяя объекты как единые токены, а не хаотичные примитивы.
-
BioShocking: как обман ИИ-браузеров приводит к утечке данных
Исследователи LayerX обнаружили уязвимость BioShocking, позволяющую через «игровые» сценарии обходить защитные механизмы AI-браузеров и красть учетные данные.
-
Microsoft Azure Linux 4.0: новый серверный дистрибутив на базе Fedora
Microsoft выпустила Azure Linux 4.0 в виде ISO-образа для установки на собственные серверы. Это первый шаг к замене Windows Server в корпоративном секторе.
-
GFusion: обучение диффузионной LLM в GigaChat через SGLang
Команда GigaChat представила в SGLang модуль GFusion для обучения диффузионных языковых моделей (DLLM) и алгоритм EBSampling, повышающий эффективность генерации.
-
UP2You: Быстрое 3D-реконструирование себя по фото без дообучения
Новая модель UP2You (ICLR 2026) позволяет создавать детализированные 3D-аватары из неструктурированных коллекций фотографий за секунды, полностью избегая этапа дообучения (tuning-free).
-
NumpyAI: Пишем NumPy-код на естественном языке через LLM
Новый open-source инструмент NumpyAI позволяет программистам и аналитикам генерировать, проверять и отлаживать код NumPy с помощью запросов на естественном языке, интегрируя LLM прямо в рабочий процесс.
-
SFTPGo: Open Source vs Enterprise — сравнение возможностей и производительности
SFTPGo представил четкое разделение на Community и Enterprise версии. Разница не только в лицензии, но и в скорости работы с облаком, безопасности и автоматизации.
-
Google открыл Copybara: инструмент синхронизации кода между репозиториями
Google выпустила в открытый доступ Copybara — инструмент для трансформации и перемещения кода между Git-репозиториями, который годами использовался внутри компании.
-
ИИ в стиле «пещерного человека»: как компании экономят на токенах
Разработчики из OpenAI, Nvidia и GitHub используют плагин, заставляющий LLM отвечать кратко и грубо, чтобы резко сократить расходы на токены.
-
SysMocap: Бесплатный движок для мокапа из видео с поддержкой VRM 1.0 и WebXR
Разработчик xianfei представил кроссплатформенную систему SysMocap, позволяющую в реальном времени захватывать движения человека с веб-камеры и анимировать 3D-аватары. Проект поддерживает VRM 0.x/1.0, Mixamo и интеграцию
-
LUNA: революция в 3D-анимации без скелетной анимации
Исследователи из Meta и HKUST представили LUNA — первую модель, создающую фотореалистичных 3D-аватаров напрямую из 2D-сигналов, полностью отказавшись от Linear Blend Skinning.
-
ViewComfy: Превращаем ComfyUI в веб-приложения за минуты
Open-source инструмент ViewComfy позволяет конвертировать сложные узловые сценарии ComfyUI в готовые веб-интерфейсы с поддержкой серверной части и управления пользователями.
-
ASASR: ИИ-сверхразрешение на FLUX.1 с подавлением артефактов
Команда исследователей представила ASASR — метод сверхразрешения изображений на базе FLUX.1, использующий adversarial Sobolev alignment для устранения галлюцинаций и повышения структурной точности.
-
Перplexity Differencing: как простой метод выявляет скрытые цели дообучения LLM
Исследователи из Z3 Research представили метод Perplexity Differencing, который с высокой точностью обнаруживает скрытые поведения (backdoors, ложные факты) в 76 моделях-организмах, став новым SOTA в бенчмарке AuditBench
-
Google представил TabFM: нулевая настройка для табличных данных
Google AI выпустил TabFM — фундаментальную модель для табличных данных, способную выполнять классификацию и регрессию без дообучения, используя механизм in-context learning.
-
Data Formulator 0.7: Microsoft открыла AI-аналитику для корпоративных данных
Microsoft Research выпустила Data Formulator 0.7 — open-source систему для анализа корпоративных данных. Инструмент объединяет коннекторы к базам данных, контекстных AI-агентов и интерактивный интерфейс, устраняя необход
-
Face Anything: 4D-реконструкция лица за один проход с точностью 3x
TUM и Huawei Noah’s Ark Lab представили Face Anything — унифицированную модель на базе трансформеров, которая за один проход восстанавливает 4D-геометрию лица и выполняет плотное отслеживание, улучшив точность глубины на
-
Screenpipe: Локальный ИИ-архив экрана и аудио с точностью PII выше Google
Screenpipe — open-source альтернатива Rewind.ai и Microsoft Recall, записывающая экран и звук 24/7 локально. Новая PII-модель работает за 9 мс, обгоняя гигантов, а лицензия обновлена для устойчивости.
-
NVIDIA представила AI-инструменты для науки: ускорение в 14 900 раз
NVIDIA выпустила библиотеки DAQIRI, ALCHEMI и cuPhoton, превращающие часы вычислений в реальное время. Ускорение анализа астрономических данных достигло 14 900x, а материаловедение стало быстрее в 50 раз.
-
Memora от Microsoft: память для AI-агентов с экономией контекста до 98%
Microsoft Research представила Memora — систему памяти для AI-агентов, которая разделяет хранение и поиск информации. Новое решение устанавливает новые стандарты качества на бенчмарках LoCoMo и LongMemEval, превосходя RA
-
NVIDIA и Anthropic объединили BioNeMo и Claude Science для ускорения исследований
NVIDIA интегрировала свой BioNeMo Agent Toolkit в платформу Claude Science от Anthropic, позволяя ученым использовать естественный язык для запуска ускоренных вычислений в геномике и дизайне лекарств.
-
ScarfBench: ИИ-агенты провалили миграцию Java-приложений с точностью <10%
IBM Research представила ScarfBench — первый бенчмарк для оценки способности ИИ-агентов переносить корпоративные Java-приложения между фреймворками. Результаты показали, что даже топовые модели не могут гарантировать раб